有人是否已经开发了一种训练LLM玩游戏的过程。从0到“基本可行的原型”可以在分钟/小时/天内实现,但完善它仍然很费劲。例如,如果我想制作一个FIFA足球克隆版,LLM可以放置一个球,几名球员和一个球门,但球员和球的运动感觉并不真实或令人满意。我的想法是,如果我能训练LLM玩FIFA游戏,那么这套系统就可以不断迭代,直到它的游戏表现更像FIFA,而不是我通过提示和大量试错来系统地改进游戏。如果它知道它正在比较的最终状态,它就可以消除大量繁琐的中间步骤。
游戏测试Harness / 自动化
有人是否已经开发了一种训练LLM玩游戏的过程。从0到“基本可行的原型”可以在分钟/小时/天内实现,但完善它仍然很费劲。例如,如果我想制作一个FIFA足球克隆版,LLM可以放置一个球,几名球员和一个球门,但球员和球的运动感觉并不真实或令人满意。我的想法是,如果我能训练LLM玩FIFA游戏,那么这套系统就可以不断迭代,直到它的游戏表现更像FIFA,而不是我通过提示和大量试错来系统地改进游戏。如果它知道它正在比较的最终状态,它就可以消除大量繁琐的中间步骤。
评论 (0)