我尝试使用强化学习(Reinforcement Learning)取代脚本游戏AI来制作足球游戏。每个在这个片段中的球员都在运行相同的训练模型。训练期间,代理人从未与对手比赛,它只是学习如何踢足球。在推理期间,我将该政策的副本分配给对手球队,让他们比赛。结果令人惊讶地有趣。他们争夺球权,进攻,偶尔防守,甚至偶尔自己踢进球,所有这些都没有行为树或有限状态机。这个项目使用RL3,一个我正在开发的基于浏览器的强化学习游乐场。很想知道游戏开发者们对使用RL取代传统方法的游戏AI有什么看法。视频:https://youtu.be/1wRA4KJuMVE?si=oMZ_Ru5Q9F8J094V