Coze扣子 - AI生成数字人口播视频

一、数字人介绍

数字人(Digital Human)是指利⽤先进的数字技术和⼈⼯智能创建的虚拟人 类形象,能够模拟⼈类的外貌、⾏为和情感。数字⼈不仅可以在视觉上表 现出真实的⼈类特征,还可以通过⾃然语⾔处理与⽤户进⾏互动。

Coze 通过全链路AI⽣成技术,实现从⽂案-->语⾳-->数字⼈的⽆缝衔接,打 造"输⼊需求,输出完整数字⼈内容"的⼀站式平台。

⽤户仅需输⼊⽂案或关键词,AI⾃动⽣成配套语⾳及数字⼈视频。

二、Coze - 全链路AI数字内容生成引擎

2.1 数据准备

在生成数字人之前,我们需要准备以下数据:

  • **⽂案⽂本:**大模型生成

  • **⾳⾊:**飞影数字人-声音克隆【见下方3.2章节】

  • **视频模板:**录制一段自己(他人)出境的视频,建议嘴型表情丰富生动。

2.2 生成步骤

2.2.1 基于⼤模型和输⼊的提示词⽣成⽂案(⼝播内容);

2.2.2 基于⽣成⽂案和⾳⾊⽣成⾳频⽂件;

2.2.3 基于⾳频⽂件和准备好的视频素材⽣成最后的⼝播视频;

2.3 coze工作流具体实现

2.3.1 注册登录扣子

扣子

2.3.2 创建智能体

2.3.3 添加工作流

2.3.4 添加大模型节点-文案生成

大模型节点主要用来生成文案

2.3.5 添加插件-飞影数字人

使用飞影数字人插件用来生成数字人视频

节点输入参数说明:

2.3.6 循环查看状态

因为视频生成时间不确定,所以我们需要添加一个循环体,循环去查询视频的状态,只有

2.3.6.1 配置循环体:先在循环体中添加飞影插件inspect_video_creation_status

2.3.6.2 添加选择器节点:如果status=2则继续循环(提交生成视频请求会生成job ID,但生成视频需要一定时间,所以我们需要不断循环查询生成状态)

2.3.6.3 在选择器如果后添加插件:搜索定时器-变量值写10(即每10秒查询一次,防止请求频繁,上限1000次)

2.3.6.4 选择器否则后添加插件:终止循环

2.3.7 结束节点

在循环后接入结束节点-如下图:

三、飞影数字人

3.1 注册登录飞影

飞影数字人 - 官方创作入口

3.2 声音克隆--speaker_id

上传自己的音频文件,即可生成

公共声音库:

公共声音库--》点击任意一个--》更多--》复制声音ID

3.3 hifly_id

相关推荐
机器之心11 分钟前
刚刚,苹果基础模型团队负责人庞若鸣被Meta挖走!加入超级智能团队、年薪千万美元
人工智能
G.E.N.1 小时前
开源!RAG竞技场(2):标准RAG算法
大数据·人工智能·深度学习·神经网络·算法·llm·rag
西西弗Sisyphus1 小时前
如果让计算机理解人类语言- Word2Vec(Word to Vector,2013)
人工智能·word·word2vec
前端双越老师1 小时前
30 行代码 langChain.js 开发你的第一个 Agent
人工智能·node.js·agent
东坡肘子2 小时前
高温与奇怪的天象 | 肘子的 Swift 周报 #092
人工智能·swiftui·swift
KaneLogger2 小时前
视频转文字,别再反复拖进度条了
前端·javascript·人工智能
度假的小鱼2 小时前
从 “人工编码“ 到 “AI 协同“:大模型如何重塑软件开发的效率与范式
人工智能
zm-v-159304339863 小时前
ArcGIS 水文分析升级:基于深度学习的流域洪水演进过程模拟
人工智能·深度学习·arcgis
拓端研究室4 小时前
视频讲解|核密度估计朴素贝叶斯:业务数据分类—从理论到实践
人工智能·分类·数据挖掘