我正在开发Open Moves(https://openmoves.games/):目前是四个浏览器单词游戏,其中AI评判连接、类别和隐含规则,允许答案超出预定义列表。 使评判公平的部分是最具挑战性的。 层次如下: * Jev做出初始判断。 * 更强大的LLM处理不确定结果和要求重新检查。 * 解释你的连接: 如果重新检查错过了你的想法,你可以提交你的理由进行另一轮审查,同样遵循相同的规则。 * 手动审查 处理模型仍然错误的争议。 它首先检查共享数据库,然后纠正的判决对所有人都有效。 一名玩家成功的上诉修复了连接,对所有其他玩家都有效。 很希望所有反馈,尤其是裁判漏掉的聪明答案。如果你正在开发游戏,AI扮演裁判,如何处理争议? 感谢你的建造!