川普真会说中文?连嘴型都同步,VideoReTalking AI数字人下载介绍

你能想到这种画面吗?霉霉在节目中用普通话接受采访,特朗普在老家用中文脱口秀,蔡明老师操着一口流利的英文调侃潘长江老师..

这听起来似乎很魔幻,可如今全部由VideoReTalking实现了

你只需要传入一个视频文件和音频文件,它会生成一个新的视频,在这个视频里,不仅人物的嘴型会与音频同步,就连表情也会随着声音的起伏发生变化,而整个过程都在没有用户干预的情况下按顺序处理

工作流程

1、表情引导:给定一个会说话的头像视频,使用表情编辑网络根据相同的表情模板修改每一帧的表情,从而生成具有规范表情的视频

2、口型同步:将规范表情视频与给定的音频一起输入口型同步网络以生成口型同步视频

3、面部增强:通过身份感知面部增强网络和后期处理提高合成面部的照片真实感

VideoReTalking最新中文版

百度网盘: https://pan.baidu.com/s/1AWJ6M69TFVZDcWYEdJn_dg?pwd=r3g8

VideoReTalking使用起来非常简单,只需要3步

1、在下载资源的根目录找到examples\face文件夹,选择其中的视频文件

2、选择examples\audio文件夹下的音频文件

3、点击"开始"按钮

在控制台中,可以查看当前的处理进度,程序执行完毕会输出信息outfile: results/output.mp4

注意事项

①上传的视频中只能有一张人脸且每帧都要有人脸,人脸要求清晰可识别、不宜过大

②FaceDet进度到100%,控制台不接着打印信息是正常现象,需要等待一段时间

③视频处理速度和GPU有关,这里推荐gtx1060以上显卡

相关推荐
william_yangshun2 分钟前
【AI Agent 实战】cindy 中文版:开箱即用的开源 AI 代理上手指南
人工智能·开源
我命由我123456 分钟前
人脸识别 - 人脸识别选帧
java·人工智能·python·算法·安全·java-ee·人脸识别
Ai-_Man12 分钟前
豆包收藏夹能批量导出吗?从底层逻辑拆解「AI导出鸭」如何解构这一技术难题
人工智能·ai·小程序
速易达网络14 分钟前
宇树机器人具身智能研发的全技术栈
人工智能
ReleaseU15 分钟前
PTC 模式深度实战:测试驱动开发的 Agent 化
人工智能·大模型
m0_6380796224 分钟前
2026年AI论文写作辅助工具技术对比与使用观察
大数据·人工智能
商业数据派30 分钟前
日赚近1亿的网易,这个季度栽在了拼多多身上
大数据·人工智能
甲维斯32 分钟前
DeepSeek还是“睁眼瞎” ,最新视觉模型测试!
人工智能
悟天特斯32 分钟前
智慧楼宇边缘计算实战:从端侧自治到云边协同的算力下沉架构
人工智能·物联网·架构·边缘计算
long3161 小时前
封装(Encapsulation)
java·人工智能·ai·ai编程