大家好,我一年前开始开发我的第一款游戏,起初是出于兴趣,没什么严肃的。起初我觉得这和建立一个网页一样容易(我有20多年的开发经验,曾经是高级开发人员和CTO)。后来我发现游戏开发主要是好的规划,非常好的艺术,和大量的工具。Blender,Unity,Codex,Claude,RunPod,等等。我尝试用AI开发我的第一款游戏,同时学习的过程中,因为我相信学习过程中的方法。结果太多了:花费的时间太多,不够的规划,缺乏的技能。我通过分享我的第一款游戏的预告片发现了这一点,这个预告片被彻底批评了,因为缺乏的精细度。这让我产生了疑问:什么是真正的标准?如何自动检查它们?如何决定是否分享之前,工作是否真正好?我开始使用三个工具:GPT,Codex和Claude Code来手动检查。GPT是调度者:它写了任务,我将它们复制粘贴到其他两个工具中,粘贴回结果,GPT根据标准规则评估。它可以拒绝,要求修改,接受,并继续下一个任务。它有效。复制粘贴没有效果。所以我构建了一个调度器来完成所有这些:- 将一个通用提示转化为计划,分解计划为章节- 启动,监控和链式执行每章中的任务- 驱动Claude Code和Codex,它们使用允许它们使用的任何工具——Unity通过MCP,一个RunPod pod,浏览器中的图像生成。调度器本身处理任务,权限,证明和门户- 展示阻塞,等待我的,AI允许自己决定的内容- 同步证明和报告到Drive或Dropbox(您注册自己的OAuth应用程序)以便另一个机器可以获取它们- 你当然可以用你的Codex/Claude本地会话操纵这个工具,重点是自动执行计划,证明和演化的数据库,而不是替代任何AI。让我真正骄傲的是:费用来自转录,交付来自实际写于会话中的文件,“正在运行”来自没有结束时间的尝试。代理不能忘记报告其代表阅读的内容,并且不能自我评估成功。“完成”不是有人写的字段,而是评估条件:子任务关闭,通过证明的通过,图像附加,如果标准是关于查看的。一个拒绝会取消之前的批准。值得解释的一个设计选择,因为这是它可以在夜间运行的原因:裁判不是API调用。调度器在一个真正的浏览器中将报告写入ChatGPT标签,读取答案。平铺式订阅变成无限制的裁判,而不是每次转变的账单。它花费了多少钱,因为这是每个人第一个问题:我的整个安装,116次尝试,~$2000的使用费。章节价格从$22到$634不等。差异几乎完全是标准:一个章节标准命名一个返回通过或失败的命令的章节成本低于一个说“至少评分78/100”的章节。您看到的金额是Claude计算的石子,它的价值,而不是我支付的金额,使用一个100美元的订阅。POC:附带的图像是游戏的3D场景,前后。4个目标,31次尝试,大约$296,半天。一个目标被裁判拒绝了,它的渲染;循环自己再次获取它,并在第二次尝试中接受了它。只有两个问题我需要裁决。它适用于游戏,但其中没有任何东西是游戏特有的我还使用它驱动两个网络项目。要求:Node,一个专用的Chrome浏览器(通过远程调试运行),和一个后台服务。一个进程,一个端口,一个SQLite文件在你的主目录中。开源和免费的非商业用途:github.com/chaibialaa/orchestratorhttps://www.npmjs.com/package/@chaibialaa/orchestrator任何建议都是非常欢迎的。
你的AI项目的规划者和指挥者
评论 (0)