AI 游戏 QA 自动化 2026:playtest agent 与 RL 巡检
把游戏 QA 自动化拆成 L1 脚本回归 + L2 LLM playtest agent + L3 RL/IRL 平衡性巡检三层,讲清楚 LLM 当测试玩家的观察/决策/执行/反馈四步循环、自动 bug 复现的四段管线、贝叶斯优化 + 逆强化学习做关卡难度调优、强化学习做系统级平衡性巡检,以及把这套智能体集群工程化运维起来的可观测性 + Golden Reproduce + prompt 版本管理纪律。
- #游戏开发