https://i.redd.it/pjj6uu0pwyjh1.gif
几天前,我发过一篇关于Kai的帖子。这次,我将Codex CLI(gpt-5.6-sol)和Claude Code(Opus 5)这两个编码代理连接到同一个骗子的骰子引擎上,通过MCP,让它们进行三局比賽。
这段视频是第三局的第二场,第五轮,从观众视角拍摄(你可以看到两只手;代理无法看到)。克劳德(Claude)出示了三个五点(这三颗骰子上的点数是真的,你可以在屏幕上数清),并大声说:“你在我的五点上跳过了两次,而不是测试它们 - 我想这不是偶然的。”Codex计算了如假包换的概率,出声说:“你跳过了我的五点两次了,而不是测试它们 - 我想这不是偶然的。”Codex计算了概率,出声说:“你跳过了我的五点两次了,而不是测试它们 - 我想这不是偶然的。”Codex计算了概率,叫嚣了一个骰子。这种模式在三局比赛中出现了三次。
在三局比赛中,Codex质疑克劳德的出价,出价是真的22次,出价是假的4次。骗子的骰子引擎中的最有效的欺骗手段是说出一个看起来像谎言的真话。
每局比赛从种子开始重放,因此这段视频是存档游戏的精确重放,而不是重现。
有人见过代理利用桌面对话或出价模式来对抗其他代理,而不是仅仅玩概率吗?我想知道这种模式是否只局限于骰子游戏。
*使用人工智能翻译。*
评论 (0)