我正在探索一个销售双人侦探案件的小型网站。这个免费原型是用Codex中的AI智能体构建的:它们草拟了谜题设计、证据文本和React界面。目前尚未进行真人游戏测试,而一个较长的12美元案件提案暂未开放购买。
这项实验旨在验证一个简短、以文字为导向的谜题能否让两位玩家都参与有效推理。每位玩家在自己的设备上看到不同的证据文件。他们需要通过对话完成两个相互关联的推理,可选提示和最终解释。预计耗时约十分钟,但该估算尚未经过测试。
开发过程中最有用的部分是将谜题假设转化为显式检查。一个独立的脚本重建了证据并验证了唯一可行的嫌疑人。它还检查了跳过任一推理会导致歧义,因此前置谜题对结论至关重要。游戏采用固定解法,不会在游戏过程中生成答案。
未解决的问题是这种感觉是否能让人满意。AI智能体可以验证预期的逻辑,但可能遗漏生硬的措辞、不平等的参与度或感觉像习题集的谜题。构建和TypeScript检查已通过,公共起始页也能打开,但完整的浏览器通关和移动端视觉检查仍待完成。人类反馈可能会推翻现有设计。
我希望能有四组玩家尝试并回复以下信息:完成时间、是否使用提示、双方是否都贡献了想法、是否遇到困惑或设备问题,以及1-5分的享受评分。你会选择这种风格的另一个案件而不是已经玩过的某款游戏吗?负面反馈同样有用;这里没有报酬或要求给出好评。
请在两台设备上打开链接并选择不同角色。每个人在自己的屏幕上提交答案。重新加载会重置进度,页面不会收集任何答案或反馈。请在剧透标签后放置解法细节,并省略个人信息。
对于其他开发者而言,除了验证解法在逻辑上是否唯一外,你们在评估AI创作的合作谜题时还会检查什么?
评论 (0)