大家好,

过去两周里,我利用 Grok 和 Gemini 在浏览器中完全构建了一款快速、零加载的回合制 4X 策略游戏(Hexwardia)。

我并没有仅仅用 AI 来生成模板代码,而是让它编写了整个战斗计算引擎、战争迷雾、程序化地图生成以及一个启发式 AI。

在这个过程中,我遇到了经典的多智能体瓶颈。如果你正使用 SuperGrok、Grok build 或其他大型语言模型层级来构建游戏,并希望将成本严格控制在订阅范围内,以下是我在工作流和 token 成本经济学方面学到的最重要经验:

1. 避免“过度修复”陷阱

当你向大型语言模型展示一个 500 行的引擎文件中的某个 bug 时,它的本能反应是重写整个文件,或注入 10 个你并未要求的全新推测性函数。

  • 解决方法:强制模型承担严格的“仅 diff / 精准补丁”角色。只允许它返回被修改的确切例程,并严格要求保留现有变量名和文件接口。这样我的 token 消耗降低了 60% 以上。不重写,仅编辑指定文件,不进行任何图片重绘、编辑或更改!

2. 拆分“大脑”(Grok vs. Gemini)

  • 我使用了 30 美元的 Supergrok 计划 + Grok build 作为主要构建和存储库,游戏仍然通过 grok.me 的免费服务提供。其主要问题是免费 token 不足以支持整个项目。
  • 我使用了 20 美元的 Gemini AI 作为架构层面的“灰质”审计员,用于捕捉隐藏的逻辑错误(例如 AI 因赤字计算错误而囤积金币,或寻路因无法放置的建筑而死锁)。这种分工节省了数十亿 token,因为我可以在不消耗宝贵的每周 Grok token 限额的情况下准备精准的编辑。

尝试构建 / 欢迎反馈

该引擎目前以 alpha 版本(v0.04.x)在线运行。它完全在普通浏览器中运行(无需安装,加载时间不到一秒)。

👉 在线演示:https://hexwardia.com

如果有人愿意花 10–15 分钟在最小地图上快速进行一场遭遇战,我非常希望得到反馈——因为我是独自开发,不可能测试所有情况:

  • AI 决策:战术 AI 是否带来真正的挑战?还是说你能明显感受到简单、普通、困难难度之间的差别?
  • 节奏:15 分钟的 4X 游戏体验在策略上是否令人满意?是前期拖沓,还是终局得分让人感觉努力得到了真实回报?

非常乐意回答任何关于智能体工作流、提示词约束,或我们在实时编程中如何处理 token 管理的问题!

感谢大家,祝大家开发顺利,游戏愉快!