Coze扣子 - AI生成数字人口播视频

一、数字人介绍

数字人(Digital Human)是指利⽤先进的数字技术和⼈⼯智能创建的虚拟人 类形象,能够模拟⼈类的外貌、⾏为和情感。数字⼈不仅可以在视觉上表 现出真实的⼈类特征,还可以通过⾃然语⾔处理与⽤户进⾏互动。

Coze 通过全链路AI⽣成技术,实现从⽂案-->语⾳-->数字⼈的⽆缝衔接,打 造"输⼊需求,输出完整数字⼈内容"的⼀站式平台。

⽤户仅需输⼊⽂案或关键词,AI⾃动⽣成配套语⾳及数字⼈视频。

二、Coze - 全链路AI数字内容生成引擎

2.1 数据准备

在生成数字人之前,我们需要准备以下数据:

  • **⽂案⽂本:**大模型生成

  • **⾳⾊:**飞影数字人-声音克隆【见下方3.2章节】

  • **视频模板:**录制一段自己(他人)出境的视频,建议嘴型表情丰富生动。

2.2 生成步骤

2.2.1 基于⼤模型和输⼊的提示词⽣成⽂案(⼝播内容);

2.2.2 基于⽣成⽂案和⾳⾊⽣成⾳频⽂件;

2.2.3 基于⾳频⽂件和准备好的视频素材⽣成最后的⼝播视频;

2.3 coze工作流具体实现

2.3.1 注册登录扣子

扣子

2.3.2 创建智能体

2.3.3 添加工作流

2.3.4 添加大模型节点-文案生成

大模型节点主要用来生成文案

2.3.5 添加插件-飞影数字人

使用飞影数字人插件用来生成数字人视频

节点输入参数说明:

2.3.6 循环查看状态

因为视频生成时间不确定,所以我们需要添加一个循环体,循环去查询视频的状态,只有

2.3.6.1 配置循环体:先在循环体中添加飞影插件inspect_video_creation_status

2.3.6.2 添加选择器节点:如果status=2则继续循环(提交生成视频请求会生成job ID,但生成视频需要一定时间,所以我们需要不断循环查询生成状态)

2.3.6.3 在选择器如果后添加插件:搜索定时器-变量值写10(即每10秒查询一次,防止请求频繁,上限1000次)

2.3.6.4 选择器否则后添加插件:终止循环

2.3.7 结束节点

在循环后接入结束节点-如下图:

三、飞影数字人

3.1 注册登录飞影

飞影数字人 - 官方创作入口

3.2 声音克隆--speaker_id

上传自己的音频文件,即可生成

公共声音库:

公共声音库--》点击任意一个--》更多--》复制声音ID

3.3 hifly_id

相关推荐
catchadmin1 小时前
PHP 快速集成 ChatGPT 用 AI 让你的应用更聪明
人工智能·后端·chatgpt·php
编程武士5 小时前
从50ms到30ms:YOLOv10部署中图像预处理的性能优化实践
人工智能·python·yolo·性能优化
max5006005 小时前
基于Meta Llama的二语习得学习者行为预测计算模型
人工智能·算法·机器学习·分类·数据挖掘·llama
月疯6 小时前
OPENCV摄像头读取视频
人工智能·opencv·音视频
极客天成ScaleFlash6 小时前
极客天成让统一存储从云原生‘进化’到 AI 原生: 不是版本升级,而是基因重组
人工智能·云原生
王哥儿聊AI6 小时前
Lynx:新一代个性化视频生成模型,单图即可生成视频,重新定义身份一致性与视觉质量
人工智能·算法·安全·机器学习·音视频·软件工程
_pinnacle_7 小时前
打开神经网络的黑箱(三) 卷积神经网络(CNN)的模型逻辑
人工智能·神经网络·cnn·黑箱·卷积网络
Ada's7 小时前
深度学习在自动驾驶上应用(二)
人工智能·深度学习·自动驾驶
张较瘦_7 小时前
[论文阅读] 人工智能 + 软件工程 | 从“人工扒日志”到“AI自动诊断”:LogCoT框架的3大核心创新
论文阅读·人工智能·软件工程
lisw058 小时前
连接蓝牙时“无媒体信号”怎么办?
人工智能·机器学习·微服务