大家好,我是吾鳴。专注于分享提升工作与生活效率的工具,持续关注AI的前沿动向。
这阵子,我做了一个设计图片的Skill,它的名字叫做gen-ai-image。它的作用可以让Agent根据不同的需求,去使用像Nano Banana Pro、Nano Banana 2、Nano Banana 2 Lite和GPT Image 2等这些前沿顶尖的图片大模型来生成图片,你只要配置好自己的API Token,描述你想要的图片画面,简述你的想法,Agent便会吭哧吭哧去做提示词整理、模型调用、任务提交、等待任务结果和下载结果这系列流程。
在做完这个Skill,我想给它制作一张发布海报,这张海报我是用来发布到我的社交媒体账号上用的,我希望它的尺寸是9:16,画面需要有一点儿科技感,却不能满屏都是芯片、代码和宇宙星空这些技术元素,标题需要直接生成在海报里面,整体看起来需要是一个立马就能用上的宣传海报。
以前遇到这样类似的生图需求,我都需要在网上先找一圈图,看看哪些与自己想要的比较符合,然后再编写绘图提示词。
这次我决定就用我做的这个Skill,让它自己给自己制作一张宣传海报。

我只说了一句话
我给Agent的需求是:
arduino
为 gen-ai-image 设计一张Skill发布海报,用于社交媒体网络发布,要有科技感,排版简洁,且要有高级感。
这次我没有去指定某个生图大模型,也没有自己去指定生图比例、尺寸等参数。
我只是把几个关键点给说清楚了:
- 海报是给gen-ai-image这个skill设计的宣传海报,这是任务目的。
- 海报是用于社交媒体网络发布,这是它的实际用途。
- 整体是需要科技感、高级感且排版需要简洁,这是一些附加的要求。
剩下的事情都交给Agent去处理。

生成之前,先预览
在真正进行生图之前需要先看一篇完整的预览,这一点我觉得非常有必要。
Skill不会一接收到需求之后,就立马开始直接生成图片,它会把这次生成使用哪个生图大模型、图片比例、尺寸、绘图提示词和预计消耗的积分都给你提前展示出来。
也就是说,在真正开始生图之前,我可以确认这几个问题:
- 图片的比例,是不是我需求的?
- 海报中的文案有没有写错?
- 画面的主体符不符合要求?
- 用的什么模型、消耗多少积分?
确认没有问题之后,再让它提交任务去生成图片。
对于制作海报来说,这一步骤很重要,因为在制作海报的时候,经常会需要有产品名称、功能点和固定的文案,如果输入的文案错了,或者是使用了错误的模型,生成之后才发现,那么相当浪费了一次绘图的额度。

这一次,文字也直接让模型生成
之前我做"自媒体封面图生成专家"时,采用的是另外的一种方式,就是AI只是生成底图,图文中的文案内容让程序给填充上去。
但是这次的gen-ai-image这个Skill不一样,它是把完整的绘图提示词直接扔给图片大模型来生成,所以这次海报中出现的"设计生图Skill"、"把生图交给Agent"等这些文案,都是在绘图提示词中有做声明的,让文案和画面一起生成。
因为我要的并不只是一张好看的图片,而是一张完整的宣传海报,需要有产品名称、功能点介绍,要有一些能让人看懂的卖点,也需要有明确的视觉重点。
所以,在真正的生图之前,Agent给你预览的提示词,你就可以通过提示词描述的画面,来判断提示词是否有把你的绘图需求给描述清楚。
比如我希望标题可以更加醒目,那可以补充:
"设计生图Skill" 使用大号中文字体,位于画面的中央上方,占据明显的视觉位置。
如果我希望副标题不要做显眼包,那可以加上:
"把生图交给Agent"使用较小号字体,放在标题下方,保持清晰,但是不要喧宾夺主。
这些要求都可以直接交给Agent,让它整理到绘图提示词中。

生图不满意,不要只说"再来一张"
图片生成以后,我主要会看下面这几件事:
- 标题是不是足够的清晰
- 别人能不能一眼就看明白这是一张"设计生图Skill"的发布海报
- 画面中有没有把重点放在了"Agent帮你生图"这件事情上
- 整体的画风气质符不符合"设计生图"这么件事
如果第一版,你觉得技术感太重了,像是做芯片或者是云计算产品的,那么你可以说:
减少芯片、代码和机械元素,画面更偏创意设计与图像生成,不要赛博朋克风格。
如果画面虽然好看,但是标题不够突出,也可以继续进行调整:
提高标题区域的对比度,标题背景保持干净,避免装饰元素遮挡文字。
如果是海报整个画面中央的主体元素太小了,那么就补充:
中央悬浮卡片占画面主要区域,清晰表现一张图片正在被生成。
以前绘图单单凭运气,多抽几次,总会有一次好的?但是实际上,生成的图片结果能否越来越接近预期,是取决于你能不能将你不满意的地方说的具体,但前提是你用的生图模型需要给力。
这也是Agent生图流程里面比较大的一个亮点,它可以帮你把你模糊不清的修改意见,变成一个可以直接执行的完整提示词。

用自己的Skill做自己的海报,才算一次真实的测试
我觉得这次最有意思的地方,不是AI有生成了一张多么多么好看的图,而是我用gen-ai-image这个Skill,为它自己制作了一张发布海报。
如果一个设计生图的Skill,连自己的宣传海报都没法制作出来,那么它再怎么去介绍模型、参数和能力,都会显得非常的空洞。
但是反过来,如果你只需要将你模糊的想法描述出来,Agent便可以帮助你去整理提示词,并且把你的想法一步步的指引变成可落地的提示词,那么它在日常的工作中便可以实际的排上用场了。
这个Skill比较适合的场景:
- 制作新产品、Skill、工具或插件的发布海报。
- 自媒体运营,需要生成素材配图等。
- 模糊想法,需要Agent帮助理清,整理提示词。
- 不想每次都去研究模型参数、提示词、图片尺寸的人。
- 已经在使用Agent,希望可以把生图接进工作流。
- 希望可以使用一线生图模型Nano Banana 和 GPT Image的人。
这次我使用一句需求,便做完了一张gen-ai-image的skill发布海报。
下一次,也许下一次可以试试将你的产品介绍、活动主体以及创意想法,发给它,让它帮助你把想法都通通变成可视化的图片。
好了,本文分享就到这里。如果觉得有收获,来个一键三连,这是对吾鸣持续输出的最大动力。