AI 生图跨图一致性方案:把照片做成 Q 版 IP 形象(图生图实战)

文章配图解决之后,我贪心又进了一步:能不能让图里有个「固定的我」? 就像那些博主的卡通形象,读者一看就知道是你的内容。这一篇讲我怎么把自己的照片,做成一个换动作、换场景、但永远是同一个人的 Q 版形象 skill。


一、为什么通用生图不够用

上一篇我接好了免费生图 API,能给文章配流程图、对比图了。但很快发现一个问题:

这些图里没有一个「人」。 方法论文章很多时候需要一个角色出镜------「我在白板上圈选方案」「我坐在电脑前敲代码」。而且我希望这个角色是我的卡通形象,让读者形成记忆点,一看就知道「这是这个号的内容」。

通用文生图做不到这点:你让它画「一个戴眼镜的男生」,每张图画出来的都不一样,更别说像你了。

二、灵感来源:一个叫「小黑」的开源 skill

我参考了一个开源项目 ian-xiaohei-illustrations。它的思路很妙:固定一个叫「小黑」的卡通角色(黑色实心、白点眼、细腿),每张配图里小黑都在做不同的动作,但永远是那个小黑。

我想要的就是这个,但角色得是我本人 。于是问题来了:怎么让 AI 画的「我」,每张都长一样?

三、关键认知:换 IP 的难点不在画风,在「一致性」

一开始我以为,把 prompt 里的「小黑」换成「一个戴眼镜、寸头、椭圆脸的男生」就行了。结果第一张还行,第二张脸就变了,第三张完全是另一个人。

这就是换 IP 的真正难点------跨图一致性。第 1 张图里的你,和第 5 张图里的你,必须是同一个人。这是所有 AI 生图的共同痛点。

纯靠文字描述,一致性最多六成。我摸索出的解法是「双保险」:

  1. 角色 DNA :把固定特征写死成一份文档(my-avatar-dna.md)------细黑框眼镜、寸头、浓眉、双眼皮、椭圆偏长脸、黑卫衣。每张图都带着它,关键特征不许漂移。
  2. 参考图 :先用文字+照片生成一张满意的「标准底片」(avatar-base.png),之后每张新图都把它作为参考图喂回去(图生图),让模型「照着画」而不是「凭空画」。

底层逻辑一句话:别指望模型记住你的脸,要给它一张底片照着抄。

四、改造过程:三轮迭代才像

整个过程是真实的三轮迭代,很有代表性:

v1(纯文字描述) :只用文字描述「寸头浓眉单眼皮圆脸黑卫衣」。出来是个 Q 版小人,但圆脸、单眼皮、不戴眼镜------跟我本人差很远。教训:文字描述对「像不像」几乎无能为力。

v2(喂真实照片 + 修正特征) :我把自己的几张照片作为参考图喂进去,并修正描述(其实是双眼皮、椭圆脸、要戴眼镜 )。这一版戴上眼镜后,神韵一下就对了

v3(调表情):v2 表情太严肃面瘫,我把描述改成「放松、带自信微笑、眼神有神」,重新生成。这一版既有亲和力又不失稳重,定稿。

五、实际效果

这是最终定稿的 IP 形象,以及它在文章场景里出镜的效果:

左边是参考照片,右边三个是做不同动作(写方案/看文件/点赞)的 Q 版形象------脸始终是同一张。这张图本身就是「跨图一致」最直观的证明。

后来又换了一个画质更高的模型,从真实照片重新生成了一版铅笔手绘风的形象,细节更细腻:

关键点在于:换一个动作、换一个场景,形象依然是我。比如让它「站在白板旁圈选 A2」,它还是那个戴眼镜、寸头、黑卫衣的我,只是换了个动作。这就是一致性双保险(DNA + 参考图)起作用了。

六、封装成 skill

最后我把它固化成 skill 的一部分,约定很简单:

  • 叙事、拟人化、需要「人」出镜的图 → 用 IP 形象(图生图,喂 avatar-base.png)
  • 纯结构、数据、信息图 → 不用形象(文生图)

这样写文章时,AI 会自己判断这张图要不要让「我」出镜,要就带着底片画。

七、写在最后

做这个形象,最大的收获不是一张卡通头像,而是搞清楚了一件事:

AI 生图的「像」,不靠描述,靠参考。 你想让它画一个固定的人,就得给它一张固定的底片,再配上写死的特征清单。文字会漂移,底片不会。

对个人创作者来说,这个 Q 版 IP 就是你的视觉资产------它出现在你每一篇文章里,慢慢变成读者认得的「你」。

下一篇预告:形象和生图都有了,但「图文介绍」还需要更系统的打法。下一篇讲我怎么改造一个信息图 skill,让文章配图既有脸、又有结构。


如果这篇对你有用,欢迎关注 看「AI 工具人 PM 实战」系列更新;你做个人 IP 形象时踩过什么坑,评论 聊聊;觉得有用就收藏备用。