https://wizzard-rick.itch.io/cyber-cowboy — 免费,浏览器,安装不需要。 cyberpunk 网络跑步卡牌游戏,9 个已授权章节,~30 张卡片,程序性合同。 代码和大部分文字都是由一个 AI 代理在长时间的会话中编写的。 提交过程是因为有用的部分不是生成,而是围绕它的所有内容。 实际上使其有效的内容: 一个无头烟雾测试,完成所有九章,使用一种故意愚蠢的策略——选择最短的通道,处理节点,离开。 “第四章是否仍然可以赢得这个平衡变化”是命令,而不是意见。 它捕捉了两个章节,它们已经悄悄变得不可能。 一个截屏抓手,渲染每个屏幕为 1280×720,降噪为 1024,写入两种类型。 读取这些 PNG 文件是如何基本上找到的布局错误的。 模型无法看到自己的 UI;如果您不渲染和查看,会将面板与行排列在右边缘下方。 这发生了三次——商店,道德,合同板——相同的错误类型,每次都不可见,直到有人看了一个图片。 一个基于 grep 的审计工具,找到了硬编码的西里尔字母。 找到了 138 个字符串,本地化从未触及过——整个过程日志,拒绝消息,广告牌。 在俄语中看起来都很好,所以没有标记。 代理在哪里一贯弱势: 空间布局,沉默截断,知道设计是否空洞。 最初的终结版仅执行任务并结束。 需要人类说“这是一个官僚任务,我很失望”才能得到终结版,结束是选择,带有真正的成本。 模型写了包含转折点的材料,然后失败了,无法注意到转折点存在。 代理在哪里真正强势: 体积与一致性。 74 个道德文件,每个文件都以特定的机构语气写成——一个被动语气的公司命令,一个疲倦的文员的聊天记录,一个带有时间戳的摄像头转录——在几个会话的周日被写成,因为约束被写成规则,而不是感觉。 你的验证循环是什么样的? 我特别想知道是否有人有比“渲染它并读取图像”更好的 UI 正确性。