上次重构完保卫萝卜之后,我受了点启发,专门去找了一批相关的视频来看。不看不知道,一看好家伙,大家的想法都差不多。尤其是 GPT-6 发布之后,很多人发现它可以用来做 Blender 建模,这就厉害了,因为 2.5D、3D 游戏一直卡在建模这一环,独立开发者做起来非常困难。
而 GPT-6 能用来建模之后,独立开发者做 3D 游戏的门槛大概率会大幅降低。我看的那些视频里,有人直接拿一张俯视图,比如故宫的俯视图,用 GPT-6 接上 Blender,就能建出一个差不多的模型。
但这篇文章并不是讲那个的。今年 4 月写完我退订了 ChatGPT 那篇之后,我就把 GPT 的订阅取消了,专心用 Claude,所以 GPT-6 当时我是用不上的。
既然 3D 建模差点意思,那我开发一个 2D 游戏不就行了。于是我就琢磨,开发哪种 2D 游戏呢?开发 2D 游戏需要大量的图片资源,而 Claude 没有生图模型,所以动手之前我还有点将信将疑:这没有生图模型,能开发 2D 游戏吗?
突然间,我想出来我可以开发一个类似于火柴人的游戏,就是那种很简单的几个线条,然后加上流畅的动作、优秀的打击音效,美术资源又不复杂,还具有一定的爽感。于是马上打开了电脑,开始创建一个新的文件夹写起了 PRD。
动手之前,先让 AI 劝退我一次
首先我不是上来就开始让 AI 直接写程序了,那有点过于粗暴。我先是让 AI 调研这个游戏是否有开发的前景、开发出来是否能够得到收益,AI 直接告诉我同类型的游戏太多了,可能 iOS 应用市场上不了架。
苹果《App Store 审核指南》第 4.3 条专门讲垃圾应用,其中 4.3(b) 写得很直白:不要提交那些与已经广泛存在的应用无从区分的东西,机会主义地创造现有品类或热门应用的变体,会损害 App Store 的发现体验、拉低整体质量,对用户和开发者都是伤害。指南还点名了一批已经饱和的品类,比如约会、手电筒、音效、壁纸、简单计时器和算命,明说不会再接受新提交,除非能提供明显不同或者有所改进的体验;而且这些应用如果不更新、不改进、吸引不到用户,未来还可能被下架。横版动作过关不在那份点名清单里,但 4.3(b) 用的是同一把尺子。
这个时候我就开始打退堂鼓了,上不了架那也是白搭,但是转头一想,反正闲着也是闲着,不如先做来玩玩。
于是我就告诉 AI,我想要发布的主要平台是 iOS,内容是火柴人横版过关游戏,界面左边是操作摇杆,右边是 3 个按钮,根据不同的按钮组合可以产生不同的招式,比如长按就可以蓄力,做一个气功波一样的招式。
确定了游戏的大体内容后,我就让 AI 反过来问我一些问题,确定游戏的大体流程和方向,然后写成 PRD 放入文件中。
不知不觉间就到了 11 点,该睡了,我电脑一盖,就上床睡觉。虽然现在失业了,但健康依然是最重要的。
Claude 说 Godot 直接就能做动作
一觉醒来,昨天已经确定了大体方向和写完了 PRD 文档,我就想要 Claude 写一个 MVP 试一试,我来检验一下 Claude 的做游戏能力如何。
这个时候就又回到了之前的问题了,Claude 是没有生图模型的,资源怎么来?
我把 PRD 发给了 Claude,让它开始执行了。Claude 很自信地告诉我,Godot 能够开发出动作以及各种招式,我将信将疑,有点不太信,因为一个流畅的动作往往需要先生成一个视频,然后抽帧做出来,而 Claude 告诉我它直接使用 Godot 就能做。
按 Godot 官方文档的说法,Claude 这句话在能力上是站得住的。AnimationPlayer 那篇教程里写着,你可以动画化检查器里出现的任何东西,节点变换、精灵、UI 元素、粒子、材质的可见性和颜色都算,甚至可以改脚本变量、调用函数。2D 骨骼那套则是 Skeleton2D 加 Bone2D 加 Polygon2D,文档列出的好处之一就是「与引擎集成得更好,省去了从外部工具导入和编辑的麻烦」,刷完权重之后去动骨头,多边形会跟着形变。火柴人本来就是几根线段,压根不需要贴图,所以它确实可以整个在引擎里 K 出来,不必先出视频再抽帧。
好!Claude 说能就能,我直接给了它最高权限开整。中途我也没有闲着,我甚至还出去了一趟,回来发现 Claude 还在辛勤地工作,我一想,可能是因为流程细节很复杂,所以需要细细地做。
两个小时之后,弹出来的是这个
一直做了快 2 个小时,快接近尾声的时候,Claude 自己就把游戏窗口弹了出来,测试一些游戏内容。我看到弹出的窗口后,震惊之情无以言表,久久说不出话,只有一声叹息,骂了一句:这是什么玩意?
这里放两张 Claude 做的这个游戏的截图。


好像跟我想的完全不一样,走路、动作十分僵硬,而且火柴人的手这么短,真的能打到人吗?
然后 Claude 在后续的测试中解答了我的疑惑,真的能打到人,手短不是问题,判定大就行,就看到那个手都没有挨着敌人,敌人就在掉血了。
素材这一关,还是得交给 GPT
得,没有生图模型还是差点意思。这个时候我就想到了 GPT,它今天早上刚发布了 Image 2.5,行吧,前几天 GPT-6 发布的时候,我就将它装回来了,今天就让它试试。
由于我没有充钱,所以就用不了 GPT-6,只能用它的免费模型。这货一上来就给我整了用程序生成的 SVG,遗憾的是那个 SVG 我已经怒删了,不能贴图了。再来就是我开始执行它,让它用 Image 2.5 出图。
它扭扭捏捏了半天,先是告诉我 OPENAI_API_KEY 没有配置,然后就回了我一个:

得,真有你的,根本不让我用。于是我狠下心,忍痛花了 20 刀开了一个 Plus,我温柔地再次告诉它,让它再试一次。
这次确实能调用了,图也确实生成出来了,又一次震惊了我,和我想象中要做的游戏有些许区别,图片如下:

不得不说,这看上去也太棒了吧!于是我赶紧将模型切到 GPT-6,使用 high 推理程度,告诉它刚才已经有个模型叫做 Claude,搭了一个游戏架子,现在你根据这个图重新做个 MVP。

接下来就是生成场景图,生成装备图:

再接下来就是:

这!GPT-6 的额度消耗得真快!最多我就跑了不到半个小时,就没有额度了,那我就只有!等了,等额度恢复后再让它接着做吧。
OpenAI 的定价页写得很具体:Plus 每月 20 美元;拿 GPT-6 Astra 来说,每个五小时窗口只有 5 到 45 条消息,本地会话和云端会话共用同一份额度,此外还可能叠一层周限制。再往上是 Pro,100 美元那一档是 Plus 的 5 倍速率上限,200 美元那一档是 20 倍。
顺便说说 Image 2.5
这里再说一下 Image 2.5 这个生图模型。我之前爱好摄影的时候拍了很多人像,我就把人像发给它让它试了,只能说它的表现太强了。我不知道它的额度上限是多少,但是我生成了 10 张左右还是没有触发到上限,所以上限应该蛮高的。
它好在什么地方?
首先它能听懂话。在修图的时候,修脸是一个非常繁琐的工作,而且一旦五官调得不好,就会发现好像换了一个人,跟原本的人一点都不像。而我只需要在 GPT 的提示词中告诉它「在保证还能识别出是这个人的情况下,不要看上去变了个人」,然后再让它进行调整,不光人物的脸会做一些微调,而且调整后还能识别出这是谁。
还有一点就是它对场景的保留度非常高。使用图像模型修照片的时候,可能会遇到生成后背景变了、前景变了、衣服的花纹变了等等场景改变的情况,我在使用这个模型的时候进行了场景对比,哪怕是细微、模糊的场景细节,它都没有改变。
于是我退掉了 Claude 的订阅
总之因为这些原因,再加上我的 Claude 又会在这几天到期,于是玩了一中午的生图后,光速打开 Claude 的订阅面板,将 Claude 的订阅取消掉。不是 Fable 5.1 不给力,而是 GPT 精准地踩中了我需求的那个点,它能提供的能力恰好是我现在正需要的。
剩下的就等 GPT 额度恢复后,将游戏的 MVP 做完看看实际效果了,可能会等上那么一些时间,因为要等额度重置!
本文首发于 www.cclliang.com/2026/09/09/...,转载请注明出处。