
试过 AI 生图的人,大概都熟悉这种感觉:出的是"图",但不是"配图"。
比例不合平台、风格每张一变、中文标注乱码、标题位被画满。每张图都像开盲盒,改一次 prompt 碰一次运气。
我的判断很直接:问题不在 prompt 话术。"能画"和"能用"是两件事,中间隔着一层工程------平台规则、风格预设、质检闭环。这层东西最近被我做成了一个开源 skill,叫 social-illustrator,MIT 协议:github.com/show7/social-illustrator。这篇把它讲透,带你装好、跑通、避开坑。
仓库里有什么
先说清它不是什么:不是提示词合集。仓库里是一条完整流水线:
- 六个风格预设:手绘(默认)、蜡笔童趣、极简线条、扁平插画、国风水墨、工程方格铅笔;
- 平台尺寸表:什么平台用什么比例,一路写到像素下限这种硬坑;
- prompt 组装器:风格段中文、结构槽英文,填充顺序固定;
- QA 闭环:失败信号→修正动作成对出现,最多重试 2 次;
- IP 录入流程:录入自己的形象,张张一致;
- 零依赖生图后端 image_gen.py:Python 标准库就能跑,填个 key 开箱即用。
skill 管策略和质检,后端管生成,两层分开。换生图模型,方法论不动。

安装三步,然后说一句话
- 仓库放进 Claude Code 的 skills 目录,或 symlink 进去;
cp .env.example .env,填任意一个生图 API key------支持火山 Ark、通义万相、OpenAI、Gemini 四种 provider,填多个会按顺序自动降级;- 贴正文,说一句话。
比如:"给这篇笔记画个小红书封面。"
就够了。它自己推断平台(小红书→3:4)、风格(默认手绘),出策略、生成、QA、交付路径。想先看策略,说"先看策略"。
再两个实例:"这篇公众号文章做个封面,再配两张内文图"------封面 2.35:1、内文 16:9,自动定;"换蜡笔童趣风重画"------风格切换就是一句话。
真正值钱的,是写进规则的坑
这一节是"玩过"和"能用"的分界线。每一条都是 skill 里的硬规则:
像素下限。 生图 API 有硬下限:总像素 ≥369 万。小红书常用的 1242×1656 会被直接拒绝。skill 内置达标尺寸表(3:4 用 1728×2304);要低于下限的发布尺寸,就同比例达标生成后精确缩放------只缩放,不裁切。

默认不让模型画字。 中文极易乱码,hex 色值甚至会被当文字画进画面。所以默认画面无字,标题、序号交排版阶段叠加;真要手写批注感,2-5 条、每条 ≤8 字的短标注。
QA 不是摆设。 "画面太满""看不出顺序""中文乱码""比例反了",失败信号一一对应修正动作,最多重试 2 次;仍不过,告知原因,给"接受/简化构图"两个选择,不假装通过。
进阶:风格和 IP 都能长出来
要的风格不在表里?复制任意风格文件,保持八段式结构(风格 DNA、留白指令、标注策略、风格适配、色板、绝对不要、QA 检查项、迭代规则),再在注册表加一行,就沉淀成新预设。仓库 README 里那四张工程方格铅笔配图,就是这么从一份规格沉淀成第 6 个预设的。
IP 录入有门禁:第一轮只出方案------id、气质、3-6 个视觉锚点(比如"白猫·内耳暖橘·绿格纹三角巾"),你确认之前一张图都不画。确认后,说"用小白猫画"锚点自动注入,QA 逐项检查防走形。

边界摆前面
logo 设计、照片修图、纯艺术创作,不触发。生成成本随 provider,--max-cost 能给预算设上限,预检不过它会减张数并说明原因。
也有人会说:模型进化这么快,今天的坑,下一代模型可能原生就解决了,这层工程岂不是白做?我同意具体参数会过期------所以尺寸表、provider 可用性都标了实测时间。但"可用"需要平台规则、风格统一和质检,这件事不会过期。变的只是形态。
AI 工具的可复用形态,从来不是一句神仙 prompt,而是把 know-how 封装成拿起来就能用的 skill。