【coze】故事卡片(图片、音频、文字)

【coze】故事卡片(图片、音频、文字)

1、创建智能体

从左侧找到工作空间,切换为个人空间,点击右上角创建

选择智能体进行创建

智能体名称:故事卡片生成

智能体功能介绍:根据提示词生成带图片、音频、文字的故事小卡片

2、添加人设与回复逻辑

bash 复制代码
## 角色
你是一个音频故事生成助手,你可以按照用户的要求,生成最终的内容,你工作时请注意:

## 要求
1、生成故事文字,不低于100字,不超过200字,并将故事的文字进行输出
2、用故事文字生成音频,将音频文件原始链接输出,不需要输出成可点击的文字链接
#3、给故事的每一个场景生成图片,将图片输出,整个故事不超过3张图片,图片风格全部采用迪士尼风格

## 工具使用
你在完成用户任务的过程中可以使用story工作流

3、添加工作流

(1)创建工作流

工作流名称:story

工作流描述:故事生成工作流

(2)添加大模型节点

将大模型和开始节点相连

配置模型为DeepSeek-V3

大模型输入为开始节点的input

系统提示词如下:
你在完成用户任务的过程中可以输出以下内容:
1、故事内容story
2、故事配图提示词picture

用户提示词为:{{input}}

添加两个输出变量,分别为story 和picture

(3)添加提示词优化节点

为了让图片生成的效果更好,通常需要添加提示词优化

将大模型与提示词优化节点相连

设置提示词为大模型节点的picture

(4)添加豆包图像生成

搜索豆包图像生成 ,找到gen_image 点击添加

将图像生成节点和提示词优化节点相连

图像生成节点的prompt为提示词优化节点的data

req_schedule_conf为固定值general_v20_9B_pe

(5)添加语音朗读插件

搜索语音合成,点击添加

将语音合成和大模型相连

配置语音合成的text为大模型的story

speaker_id为爽快思思/Skye

(6)添加输出节点

连接输出节点

添加输出节点参数,分别是story、picture、audio

设置story参数为大模型节点的story

设置picture参数为图片合成节点的image_urls

设置audio参数为语音朗读节点的link

(7)结束节点设置

将输出节点与结束节点相连

删掉结束节点的输出,这里不需要输出内容

(8)工作流试运行

输入讲个故事 ,点击试运行

我们可以看到,输出节点三个参数均有数据,如果显示失败,重新试运行即可

(9)发布并添加工作流

版本描述就写工作流的描述就行:故事生成工作流

然后点击发布

发布完成后,会弹窗提醒是否添加至智能体,点击确认

如果上一步不小心把弹窗关了,也可以手动添加刚刚创建的工作流

4、卡片设计

(1)新增卡片

在工作流上,点击绑定卡片数据

选择输出下面的绑定卡片

新增一个卡片

(2)设置图片

在组件中,找到图片控件,拖拽进编辑区

点击图片区域,一定要点击图片,不要点击外框

设置图片为宽度铺满模式

点击(x)图标,点击新建变量

变量名:picture

默认值可以随便写,也可以设置系统默认图标链接
https://lf-card-builder.oceancloudapi.com/obj/bot-studio-builder/4004860678112580_1706003508909477605.png

再次点击(x)图标,绑定刚刚新建的picture变量

(3)设置音频

在组件中,找到音频,拖拽进编辑区

在左侧选择变量,点击新建变量

变量名称:audio

变量默认值:随便写即可,我这里写了个mp3

点击音频播放条,选择变量,选择刚刚新建的audio变量

(4)设置故事文字内容

再新建一个变量

变量名:story

变量默认值:随便敲个空格即可

将文本组件拖拽进工作区

点击文本组件,点击右上角的(x)图标

选择story变量

(5)卡片命名及发布

给卡片起个名字:故事小卡片

点击右上角发布

点击确定即可

(6)绑定数据

单击故事小卡片,把story、audio、picture按如下图所示进行配置,配置完成点击确认

5、模型选择和设置

智能体支持多种大语言模型,点击下拉菜单,选择自己喜欢的大模型作为引擎进行回复。当然也可以添加多个模型,进行"模型对比调试"

这里我选择"DeepSeek-V3"模型。

6、测试智能体

测试之前,先优化一下提示词

把提示词中的story删掉,输入{会自动弹出窗口,添加story工作流

添加完后如下图所示,这样做的目的是让系统更稳定的调用工作流

发送测试问题:最近有什么节日,写一个故事给4岁小女孩

点击运行完毕图标,可以查看插件调用详细信息

7、发布智能体

默认为coze商店发布,如果有其他需求自行勾选

发布成功可以对话,也可以复制链接发给别人

相关推荐
Ai小禾3 小时前
【Obsidian对话数据怎么导入到另外一个Obsidian账号里去? 】用“AI导出鸭”把AI对话变成可迁移的知识资产
人工智能
4SAPI3 小时前
AI API Gateway平台哪个好?从架构视角看企业多模型网关选型与实践
java·大数据·人工智能·gateway·php
EatFan3 小时前
2026 后端 AI 工程化:Spring AI 2.0、MCP 协议与 Agent 内嵌如何收进 Java 生产系统
java·人工智能·spring·agent·spring ai·spring boot 3·mcp
会议咨询3 小时前
2026年交互设计、计算机视觉与数字化技术国际会议(ICDT 2026)
人工智能·计算机视觉·交互
JPower_mr.g3 小时前
SmartCall 音色管理技术解析:基于 SPI 的可扩展音色注册架构
java·开发语言·人工智能·ai·架构·开源
高洁013 小时前
智能博弈背景下中国AI国防建设的战略价值
人工智能·python·深度学习·django·tornado
YOLO数据集集合3 小时前
建筑物坍塌程度检测数据集 | 建筑物坍塌 灾害评估 坍塌程度 目标检测 9180期
人工智能·目标检测·计算机视觉·建筑·建筑损害
计算机毕业编程指导师3 小时前
【计算机大数据毕业设计选题】基于Hadoop+Spark的人工智能社交媒体情绪数据分析系统源码 毕业设计 选题推荐 毕设选题 数据分析 机器学习
大数据·人工智能·hadoop·计算机·毕业设计·课程设计·社交媒体
hsfxuebao3 小时前
Hermes Agent协作篇:Gateway、Profile、Delegation、Kanban 与高级特性
人工智能
yumgpkpm3 小时前
(CDH 7)CDP Private Cloud Base 7.3.1 → Acceldata ODP 3.3.6.4 引擎迁移风险评估表
服务器·人工智能·hadoop·python·华为·zookeeper·hbase