你好每个人。 我学到了抓住人们的注意力早期是至关重要的,所以这里有几张截图和我的游戏的前提。 https://i.redd.it/28emlm1e6kfh1.gif https://i.redd.it/elyzjnag6kfh1.gif https://i.redd.it/qbvhuh4y6kfh1.gif "在虚拟世界中奔跑并与你的奇怪美丽老板一起玩情绪。 * 一种独特的"情感劳动",融合了甜蜜的化学反应与节奏动作。" 我是一个普通的办公室职员。 在过去的一年里,我花了大量的时间和周末时间在这个上面,我开发了一个游戏,并最近发布了一个演示版。 由于我在整个过程中从AI那里获得了大量帮助,我想在这里分享我的工作流程和经验。 # 表格内容 1. 规划 -> 2. 故事 -> 3. 艺术 -> 4. 开发 -> 5. 声音 -> 6. Steam 发布 -> 7. 思想 # 1. 规划 我一直对音乐充满激情。 我曾经做过一些小小的表演,发布过专辑,并且一直作为一种爱好撰写曲目。 通过偶然的机会,我加入了一个独立游戏团队担任声音人员。 当我在游戏开发领域摸索的时候,我看到了AI的快速发展,并决定自己开发一个游戏。 每当我有一个想法(在睡前,等待公交车),我都会马上在手机上记录下来。 当我收集了一些想法后,我选择了我的最喜欢的故事,打开了一个Word文件,并脑海中 Dump了所有想法。 然后,我将其喂给AI,并要求它生成一个游戏设计文档。 不是为了形式而形式地创建一个正式的文档,而是有AI组织我的混乱的想法使得更容易确定下一步。 因为这是我的第一次尝试,所以很难衡量我应该开发我的初始想法的哪个类型。 所以,我决定专注于我喜欢的东西并有一个清晰的方向:故事和音乐。 那么,我就决定采用故事+节奏游戏结构。 在分析传统的节奏游戏时,我想,“如果我将其与侧滚动动作结合起来呢?”并在此简单概念上建立了核心循环。 一旦实际开发开始,我就停止了正式的设计文档。 我只是打开了引擎,建造了游戏,并在飞行中灵活地调整了东西以改善玩家体验。 # 2. 故事 我最初希望通过AI来写整个故事。 不可思议的是,结果根本不吸引人。 所以,我自己写了故事的骨架和细节。 然而,AI在脑海中为我提供了很多帮助。 我的工作流程: * 我:“我需要从A点到C点。如何处理中间的事件B?” * AI:“为什么不尝试X或Y方向呢?” * 我:(受到启发)“那么我们就去Z吧?” * AI:“这是一个出色的方法!”(当然,我后来意识到这是AI的奉承,所以我添加了一个系统提示告诉它不要奉承我了。) 总之,与AI交换想法真的帮助我克服了写作困境。 我感觉像是在与一个聪明、多才多艺的助手一起工作。 https://preview.redd.it/ztbihvwf8kfh1.png?width=1920&format=png&auto=webp&s=55a28ef754139de7b4a5f20586f02abdca7e040e 问题: 一旦脚本完成,我才意识到太晚了,节奏太传统了。 现代游戏,电影和漫画都需要在开始时有一个强大的引擎。 因为我无法从头开始重写,所以我在很开始的地方插入了一个回顾序列。 以下是用于优化它的提示: "你是专家,能够评估和提供反馈,以便在游戏场景中立即吸引用户的注意力。 大胆地切除明显的陈词滥调,并提供反映现代游戏市场最新趋势(Steam,移动,控制台)的尖锐批评。 检查是否有一个强大的事件或设置在前3分钟内会吸引用户。" 我还使用AI进行了拼写检查和翻译。 我收到了同事的反馈,称中文需要更多的工作。 如果你打算在中国本土化,那么你可能需要更仔细地结构你的提示。 以下是我的本土化提示: "100% 本土化翻译:将所有对话和叙述文本翻译为[语言]。 本地化修饰符,句子结构和描述,以便玩家在那个文化中立即理解它们,并适当地反映文化元素,如货币值。" # 3. 艺术 # 3-1. 角色人物 我先从主角开始。 我在写故事的时候已经有了一些粗略的想法。 我画了一张速写并使用i2i来建立基础。 一旦我得到了一个风格,我就调整了提示来细化细节。 https://preview.redd.it/75lu6sop8kfh1.png?width=589&format=png&auto=webp&s=737cc32d4dd1614ee55c23a9c36b3a6374b1a548 一旦我从本地模型中得到了一些基本的东西,我就在Krita中手动调整了它。 如果头发是乱糟糟的,头部比例不对,或者解剖学看起来很奇怪,我发现用AI inpainting或i2i再次处理的效率更高。 (尤其是调整头部大小是几乎不可能的,既是在线AI模型,也是本地模型。) 我经常使用的画笔 我很少使用NanoBanana模型来绘制角色。 可能我的提示没有那么好,但它的默认风格太过强大,难以维持我想要的特定调子。 最终的细节,如瞳孔,睫毛和配饰,都是手绘的。 # 3-2. 角色动画 Almost 每个对话场景都有动画图像。 https://i.redd.it/qbvhuh4y6kfh1.gif 我使用本地的i2v模型在我的基础图像上生成视频,切割好帧并移除背景。 我做了批量背景移除,但由于技术限制,细节如瞳孔经常与背景一起被裁剪。 我最终不得不手动检查帧并恢复它们。 # 3-3. 背景 背景使用了类似的本地AI -> Krita工作流程。 然而,与角色不同,我实际上在这里使用了NanoBanana模型。 它特别适合于改变时间,例如将白天场景转换为夜晚。 https://preview.redd.it/g31o8svaakfh1.png?width=1322&format=png&auto=webp&s=b1bcc92621f5ff271e939560aa8b91a782b0a387 还有,最近的GPT图像模型非常出色了。 我感觉手动后处理可能已经不再必要了。 # 3-4. 游戏内角色图像 最初,我打算使用像下面这样经典的像素艺术风格,因为我找到了一个适用的Lora。 https://preview.redd.it/ls5luxbudkfh1.png?width=347&format=png&auto=webp&s=3be6206522eacc357f0e4c9204f34a9141ee71e5 但是随着开发的进行,我变得有些雄心勃勃了。 我使用NanoBanana生成像素艺术风格图像。 之后,我按照相同的过程处理了角色动画——使用i2v将帧分割并动画它们。 即使如此,手动帧帧清理也是必要的,以修复不自然的像素。 https://preview.redd.it/xiob7b2hakfh1.png?width=992&format=png&auto=webp&s=182ea2dc3bf62de1f70c4ce135f96d594387631b # 3-5. UI NanoBanana在UI设计中是救星。 我找到了几个适合游戏风格的免费字体,要求AI“制作按钮,具有这种感觉”,结果很好。 https://preview.redd.it/hmpz24keekfh1.png?width=1547&format=png&auto=webp&s=bdf36ea3fed6c1f802f32f91a64a1afd0dcaf0b0 然而,移除背景图像的背景是困难的。 如果我使用Krita中的魔法画笔选择背景并删除它,会留下脏脏的边缘颜色。 因此,我必须在我的工作区中放置一个黑色背景并手动检查边缘以确保它们看起来干净。 我知道最近的GPT模型可以输出清晰的透明背景了。 使用GPT图像生成UI可能是一个更好的选择。 # 4. 开发 我有基本的Python知识。 因此,我选择了Godot引擎,它是最容易使用的引擎之一。 我主要使用Gemini 2.5 Pro通过AI Studio进行编码,因为它是当我开始开发时最新的模型。 我的第一个重大障碍是建立节奏游戏的核心击中检测逻辑。 即使是提示AI数十次,它也无法生成工作代码。 所以,我抓取了两个参考数据并将它们作为上下文传递给AI。 * Godot官方文档: AI经常 hallucinate过时的语法或完全虚构的函数,所以我将最新的文档传递给它。 * YouTube节奏游戏教程的转录: 我找不到一个教程与我想要的方法完全匹配,但我将有用的视频转录为文本并传递给它。 一旦我迫使它使用这些参考,问题就解决了。 后来出现的错误,我通常通过在Google上找相关源代码并将其传递给AI作为上下文来解决它们。 一旦游戏的骨架建立起来,我就将我的Game Design Document和所有写好的代码(.gd,*.tscn)打包成一个.txt文件,将其传递给AI,并要求它“创建开发笔记”。 从那时起,我就按照文档中列出的里程碑一步一步地工作。 设立一个环境,让你坐在电脑前,马上就知道“下一步该怎么做”是非常重要的。 我还意识到系统提示的重要性。 最终,我制定了一个系统提示: “设计这个非常小心地,不影响任何现有的功能。 从来不要猜测你认为适合的代码。 读取代码行行读取,并提供当前代码上下文中最优化的解决方案。” # 5. 声音 我并不太担心音乐编曲。 因为我已经有几十首我过去编写的歌曲,所以我主要花时间决定哪首歌放置在哪个场景。 然而,我遇到了一个意想不到的障碍。 虽然我喜欢写音乐,但我的音频工程技能(混音,混音,音效)相当有限。 因为这是一个节奏游戏,其中音乐是主要焦点,所以我担心的是整个音频质量。 然后我听说Suno v5发布了。 出于好奇,我将我的原曲传递给它的“Cover”功能…… 并且我的脑海里炸开了。 音乐质量非常出色。 以下是游戏中使用的一首歌的前后两段: https://reddit.com/link/1v72sf0/video/tfocd4v3gkfh1/player 你可以听到声音更加平衡,不再粗糙。 添加了自然的空间深度和乐器细节,我无法自己工程。 非常令人满意。 然而,有一个缺点。 当生成的歌曲的播放时间越来越长时,声音就会越来越瘦和退化。 超过1分钟,EQ平衡就会变得如此剧烈,以至于开头的踢鼓或打击鼓在结尾时听起来完全不同。 生成的不一致性也让我很失望。 所以,我通过将清晰的合成部分从第一段副歌中切割出来,并将其粘贴到第二段副歌中来解决这个问题。 在那些难以解决的地方,我手动匹配了EQ。 需要一些手动音频拼接,但我对最终结果非常满意。 # 6. Steam 发布 因为这是我的第一次尝试,所以我担心Steam上传和构建过程会是一个噩梦。 但我只是将Steamworks控制台的截图传递给AI,并遵循它的逐步指示。 没有任何问题。 如果你是第一次尝试,那就不用再担心这个问题了。 # 7. 最后想法 说实话,早期我当时苦于核心节奏逻辑时,我真的怀疑自己,想,“我真的会完成吗?”和“我的技能水平是否足以发布游戏?” 但站在现在的起点,我只是对我们今天拥有的工具感到深深的感激。 游戏的整体开发已经完成了。 我打算在正式发布前参加即将到来的Steam Next Fest,因此只有演示版本是公开的。 作为我的第一款游戏,肯定有很多缺点,但我感觉我已经实现了我想要尝试的一切,没有任何遗憾。 对于我的下一款游戏,我希望我能够专注于为玩家提供一种直观的有趣体验。 这是我的1年开发之旅的记录。 这里有很多比我更擅长的人,但我希望我的后记能够对社区中的某个人有所帮助。 感谢阅读这个长帖。 如果你有时间,请在下面的链接中查看游戏。 如果它看起来对你有意思,你可以将其添加到你的愿望单中。 https://store.steampowered.com/app/4678050