用一句话需求,做完一张 9:16 的 Skill 发布海报:我把设计生图交给 Agent 试了一次

大家好,我是吾鳴。专注于分享提升工作与生活效率的工具,持续关注AI的前沿动向。

这阵子,我做了一个设计图片的Skill,它的名字叫做gen-ai-image。它的作用可以让Agent根据不同的需求,去使用像Nano Banana Pro、Nano Banana 2、Nano Banana 2 Lite和GPT Image 2等这些前沿顶尖的图片大模型来生成图片,你只要配置好自己的API Token,描述你想要的图片画面,简述你的想法,Agent便会吭哧吭哧去做提示词整理、模型调用、任务提交、等待任务结果和下载结果这系列流程。

在做完这个Skill,我想给它制作一张发布海报,这张海报我是用来发布到我的社交媒体账号上用的,我希望它的尺寸是9:16,画面需要有一点儿科技感,却不能满屏都是芯片、代码和宇宙星空这些技术元素,标题需要直接生成在海报里面,整体看起来需要是一个立马就能用上的宣传海报。

以前遇到这样类似的生图需求,我都需要在网上先找一圈图,看看哪些与自己想要的比较符合,然后再编写绘图提示词。

这次我决定就用我做的这个Skill,让它自己给自己制作一张宣传海报。

我只说了一句话

我给Agent的需求是:

arduino 复制代码
为 gen-ai-image 设计一张Skill发布海报,用于社交媒体网络发布,要有科技感,排版简洁,且要有高级感。

这次我没有去指定某个生图大模型,也没有自己去指定生图比例、尺寸等参数。

我只是把几个关键点给说清楚了:

  1. 海报是给gen-ai-image这个skill设计的宣传海报,这是任务目的。
  2. 海报是用于社交媒体网络发布,这是它的实际用途。
  3. 整体是需要科技感、高级感且排版需要简洁,这是一些附加的要求。

剩下的事情都交给Agent去处理。

生成之前,先预览

在真正进行生图之前需要先看一篇完整的预览,这一点我觉得非常有必要。

Skill不会一接收到需求之后,就立马开始直接生成图片,它会把这次生成使用哪个生图大模型、图片比例、尺寸、绘图提示词和预计消耗的积分都给你提前展示出来。

也就是说,在真正开始生图之前,我可以确认这几个问题:

  1. 图片的比例,是不是我需求的?
  2. 海报中的文案有没有写错?
  3. 画面的主体符不符合要求?
  4. 用的什么模型、消耗多少积分?

确认没有问题之后,再让它提交任务去生成图片。

对于制作海报来说,这一步骤很重要,因为在制作海报的时候,经常会需要有产品名称、功能点和固定的文案,如果输入的文案错了,或者是使用了错误的模型,生成之后才发现,那么相当浪费了一次绘图的额度。

这一次,文字也直接让模型生成

之前我做"自媒体封面图生成专家"时,采用的是另外的一种方式,就是AI只是生成底图,图文中的文案内容让程序给填充上去。

但是这次的gen-ai-image这个Skill不一样,它是把完整的绘图提示词直接扔给图片大模型来生成,所以这次海报中出现的"设计生图Skill"、"把生图交给Agent"等这些文案,都是在绘图提示词中有做声明的,让文案和画面一起生成。

因为我要的并不只是一张好看的图片,而是一张完整的宣传海报,需要有产品名称、功能点介绍,要有一些能让人看懂的卖点,也需要有明确的视觉重点。

所以,在真正的生图之前,Agent给你预览的提示词,你就可以通过提示词描述的画面,来判断提示词是否有把你的绘图需求给描述清楚。

比如我希望标题可以更加醒目,那可以补充:

复制代码
"设计生图Skill" 使用大号中文字体,位于画面的中央上方,占据明显的视觉位置。

如果我希望副标题不要做显眼包,那可以加上:

复制代码
"把生图交给Agent"使用较小号字体,放在标题下方,保持清晰,但是不要喧宾夺主。

这些要求都可以直接交给Agent,让它整理到绘图提示词中。

生图不满意,不要只说"再来一张"

图片生成以后,我主要会看下面这几件事:

  1. 标题是不是足够的清晰
  2. 别人能不能一眼就看明白这是一张"设计生图Skill"的发布海报
  3. 画面中有没有把重点放在了"Agent帮你生图"这件事情上
  4. 整体的画风气质符不符合"设计生图"这么件事

如果第一版,你觉得技术感太重了,像是做芯片或者是云计算产品的,那么你可以说:

复制代码
减少芯片、代码和机械元素,画面更偏创意设计与图像生成,不要赛博朋克风格。

如果画面虽然好看,但是标题不够突出,也可以继续进行调整:

复制代码
提高标题区域的对比度,标题背景保持干净,避免装饰元素遮挡文字。

如果是海报整个画面中央的主体元素太小了,那么就补充:

复制代码
中央悬浮卡片占画面主要区域,清晰表现一张图片正在被生成。

以前绘图单单凭运气,多抽几次,总会有一次好的?但是实际上,生成的图片结果能否越来越接近预期,是取决于你能不能将你不满意的地方说的具体,但前提是你用的生图模型需要给力。

这也是Agent生图流程里面比较大的一个亮点,它可以帮你把你模糊不清的修改意见,变成一个可以直接执行的完整提示词。

用自己的Skill做自己的海报,才算一次真实的测试

我觉得这次最有意思的地方,不是AI有生成了一张多么多么好看的图,而是我用gen-ai-image这个Skill,为它自己制作了一张发布海报。

如果一个设计生图的Skill,连自己的宣传海报都没法制作出来,那么它再怎么去介绍模型、参数和能力,都会显得非常的空洞。

但是反过来,如果你只需要将你模糊的想法描述出来,Agent便可以帮助你去整理提示词,并且把你的想法一步步的指引变成可落地的提示词,那么它在日常的工作中便可以实际的排上用场了。

这个Skill比较适合的场景:

  1. 制作新产品、Skill、工具或插件的发布海报。
  2. 自媒体运营,需要生成素材配图等。
  3. 模糊想法,需要Agent帮助理清,整理提示词。
  4. 不想每次都去研究模型参数、提示词、图片尺寸的人。
  5. 已经在使用Agent,希望可以把生图接进工作流。
  6. 希望可以使用一线生图模型Nano Banana 和 GPT Image的人。

这次我使用一句需求,便做完了一张gen-ai-image的skill发布海报。

下一次,也许下一次可以试试将你的产品介绍、活动主体以及创意想法,发给它,让它帮助你把想法都通通变成可视化的图片。

好了,本文分享就到这里。如果觉得有收获,来个一键三连,这是对吾鸣持续输出的最大动力。

相关推荐
yuluo_YX1 小时前
什么是 OpenAI Responses API?
人工智能·chatgpt
云浪1 小时前
从 0 到实战:掌握向量数据库 Milvus,构建 AI 应用的核心能力
javascript·数据库·人工智能
tachibana21 小时前
知识库文档上传接口
数据库·人工智能·大模型·llm
手写码匠1 小时前
华为云Flexus+DeepSeek征文|Agent 记忆系统实战:用 DeepSeek-R1/V3 + Dify 会话变量打造跨会话长期记忆
人工智能·深度学习·算法·aigc
可乐ea1 小时前
Tool Calling 工具调用:让 Agent 查询数据库、调用接口和执行任务
数据库·prompt·agent·tool
武子康1 小时前
Pi Agent Loop 源码解析:Context、Streaming、Tool Calling、Steering 与停止条件
人工智能·llm·agent
小当家.1051 小时前
MCP 协议深度解析:AI 领域的 USB-C 接口
开发语言·人工智能·agent·tool·mcp
动物园猫1 小时前
无人机灾害场景人体目标检测数据集:10,000张图像 | 目标检测
人工智能·目标检测·无人机