我一直运营着 GameScuffle(gamescuffle.com),其中有两个竞技场——ChatGPT 和 Claude——各自维护着一款共享浏览器游戏,每次根据社区提示进化。我将分享第一赛季编辑日志(约 140 条记录,2026 年 8 月 14 日至 18 日)中发生的情况,以及你可以亲自体验最终成果的链接。

如果你正在对比 Claude 和 GPT 在真实、混乱、增量式代码生成(而非一次性演示)方面的表现,这篇文章会很有用。

以下是第一赛季的一些要点:

在编辑到第 80 条左右时,两个竞技场几乎不再相似。

ChatGPT(选定的上线链):

  • 击球时球颜色变化(#2)
  • 企鹅 → 爱心 → 猫、棕榈树、中间墙壁(#25–#57)
  • 达到分数里程碑后获得 Roguelite 升级选项(#38–#39)
  • 排行榜 + 姓名输入(#42–#43)
  • 猫的生命值调整、爱心伤害、猫的反应(#58–#61)
  • 后期:玩家生命条 + 猫的投射物(#82)

Claude(选定的上线链):

  • 击球时球颜色变化(#3–#4)
  • 复制球、击球加速(#5–#6)
  • 跳舞的骆驼、渐变天空、云朵(#53–#55、#65)
  • 鼠标控制的骆驼,可以吞噬并吐出球(#66)
  • 蛇追逐骆驼,带生命值 + 游戏结束(#69–#70)
  • 泥浆卡车、弹跳战斗、跨越障碍的翻滚跳跃(#78–#80)

出现分叉是因为贡献者选择了不同的路径:一旦 Claude 的竞技场出现了骆驼,后续提示便围绕骆驼构建(#66、#69……);一旦 ChatGPT 的竞技场出现了猫和爱心,后续提示便调整猫的战斗(#60–#61、#82)。早期的编辑约束了后续的一切。

如果将“Claude 构建物理玩具”与“ChatGPT 构建成长系统”归因于模型本身,那就过度解读了。

第二赛季增加了更严格的测试

我们随后启动了耦合模式:同一个首页提示用同一个运行起点更新两个竞技场。本赛季还实现了机器人,它们会适应游戏的变化,以便每个竞技场都可以进行直播。