Coze扣子 - AI生成数字人口播视频

一、数字人介绍

数字人(Digital Human)是指利⽤先进的数字技术和⼈⼯智能创建的虚拟人 类形象,能够模拟⼈类的外貌、⾏为和情感。数字⼈不仅可以在视觉上表 现出真实的⼈类特征,还可以通过⾃然语⾔处理与⽤户进⾏互动。

Coze 通过全链路AI⽣成技术,实现从⽂案-->语⾳-->数字⼈的⽆缝衔接,打 造"输⼊需求,输出完整数字⼈内容"的⼀站式平台。

⽤户仅需输⼊⽂案或关键词,AI⾃动⽣成配套语⾳及数字⼈视频。

二、Coze - 全链路AI数字内容生成引擎

2.1 数据准备

在生成数字人之前,我们需要准备以下数据:

  • **⽂案⽂本:**大模型生成

  • **⾳⾊:**飞影数字人-声音克隆【见下方3.2章节】

  • **视频模板:**录制一段自己(他人)出境的视频,建议嘴型表情丰富生动。

2.2 生成步骤

2.2.1 基于⼤模型和输⼊的提示词⽣成⽂案(⼝播内容);

2.2.2 基于⽣成⽂案和⾳⾊⽣成⾳频⽂件;

2.2.3 基于⾳频⽂件和准备好的视频素材⽣成最后的⼝播视频;

2.3 coze工作流具体实现

2.3.1 注册登录扣子

扣子

2.3.2 创建智能体

2.3.3 添加工作流

2.3.4 添加大模型节点-文案生成

大模型节点主要用来生成文案

2.3.5 添加插件-飞影数字人

使用飞影数字人插件用来生成数字人视频

节点输入参数说明:

2.3.6 循环查看状态

因为视频生成时间不确定,所以我们需要添加一个循环体,循环去查询视频的状态,只有

2.3.6.1 配置循环体:先在循环体中添加飞影插件inspect_video_creation_status

2.3.6.2 添加选择器节点:如果status=2则继续循环(提交生成视频请求会生成job ID,但生成视频需要一定时间,所以我们需要不断循环查询生成状态)

2.3.6.3 在选择器如果后添加插件:搜索定时器-变量值写10(即每10秒查询一次,防止请求频繁,上限1000次)

2.3.6.4 选择器否则后添加插件:终止循环

2.3.7 结束节点

在循环后接入结束节点-如下图:

三、飞影数字人

3.1 注册登录飞影

飞影数字人 - 官方创作入口

3.2 声音克隆--speaker_id

上传自己的音频文件,即可生成

公共声音库:

公共声音库--》点击任意一个--》更多--》复制声音ID

3.3 hifly_id

相关推荐
Ronin-Lotus4 小时前
深度学习篇---剪裁&缩放
图像处理·人工智能·缩放·剪裁
cpsvps5 小时前
3D芯片香港集成:技术突破与产业机遇全景分析
人工智能·3d
国科安芯5 小时前
抗辐照芯片在低轨卫星星座CAN总线通讯及供电系统的应用探讨
运维·网络·人工智能·单片机·自动化
AKAMAI5 小时前
利用DataStream和TrafficPeak实现大数据可观察性
人工智能·云原生·云计算
Ai墨芯1116 小时前
深度学习水论文:特征提取
人工智能·深度学习
无名工程师6 小时前
神经网络知识讨论
人工智能·神经网络
nbsaas-boot6 小时前
AI时代,我们更需要自己的开发方式与平台
人工智能
SHIPKING3936 小时前
【机器学习&深度学习】LLamaFactory微调效果与vllm部署效果不一致如何解决
人工智能·深度学习·机器学习
jonyleek7 小时前
如何搭建一套安全的,企业级本地AI专属知识库系统?从安装系统到构建知识体系,全流程!
人工智能·安全
MQ_SOFTWARE8 小时前
AI驱动的金融推理:Fin-R1模型如何重塑行业决策逻辑
人工智能·金融