我在开发一个独立的iOS推理游戏时,使用了Claude和Codex。这些工具非常有用,它们帮助我从想法到工作产品,实现交互,重构屏幕,检查双语内容,并测试大量状态组合的速度比我自己快得多。它们还使添加“有帮助”的界面层次变得非常便宜。每当一个屏幕看起来不清晰时,我就可以添加另一个摘要、关系标签、提示或确认状态。每个本地变化看起来都是合理的。第一版发布后,同样的线索在文档中解释了很多次,重复在笔记中,暴露在家族树中,并在判决之前再次确认。代码工作了。但是,游戏并没有要求玩家足够地推理。这在Reddit发布后的第一版中变得明显。“氛围编码”是最响亮的描述,但更有用的批评是打开所有记录感觉就像自动完成案件一样。1.1版本中,我删除了重复的解释层,并重建了循环,围绕明确的问题。玩家现在必须将不同记录连接到每个法律问题,重建相关的家庭线,并选择与两者都相符的继承人。引导、标准和专家模式控制暴露的上下文量,而不是在默认情况下添加帮助。人工智能工具帮助我实现和验证重建,但它们没有为我选择信息边界。需要玩家反馈、产品判断和反复询问下一个标签是否增加了理解还是仅仅移除了不确定性。肖像也是人工智能生成的,并且每个案件都被选择和迭代。没有在运行时生成任何内容。当前的iOS构建在这里:https://apps.apple.com/app/id6781295862 对其他使用代理的开发者来说:您使用哪些约束来阻止便宜的迭代变成太多的界面或内容?