实时数字人——DH_LIVE

前两天亲手搭建了实时对话数字人VideoChat,今天来搭建下DH_LIVE。

DH_LIVE一个实时数字人解决方案,从输入文字到数字人对口型说话用时2-3秒。

今天就来实际操作下dh_live的搭建过程。

首先贴上git地址:https://github.com/kleinlee/DH_live

然后又找到了个带webui的开源地址:https://github.com/v3ucn/DH_live_webui 含一键启动脚本。

1、先来看下自己本地的环境配置:

系统:win10

显卡:rtx 2060 super

2、创建 环境

复制代码
conda create -n dhlive python==3.10

3、创建好后激活环境,进入到项目目录

复制代码
conda activate dhlive

4、安装环境

复制代码
pip install -r requirements.txt

5、安装比较顺利,直接安装成功了,接着来试着启动下

复制代码
python api.py

报错了。如图:

这种比较好解决,直接 pip install pydub 即可。

6、接着再次执行 第五步,又报错,如图:

复制代码
pip install torchaudio

7、继续执行第五步,还报错

这是ffmpeg没有配置环境变量,配置下即可。

我的电脑--》右键--》属性--》高级系统设置--》环境变量--》系统变量--》path--》新建--》添加ffmpeg的bin路径保存即可。后台回复"ffmpeg"可获取ffmpeg文件

配置好后重启打开窗口执行ffmpeg

看到输出即为配置成功。

8、接着再执行第五步,又报错

复制代码
pip install edge_tts

9、接着执行第五步,终于成功了

经实测,效果还不错,就是口型有点不太对应。从输入到说话的间隔要看文本长度。

后台回复"DH_LIVE"可获取到一键启动的项目文件,包含checkpoints模型文件。

相关推荐
默_笙4 天前
🍙 给每个请求过安检:FastAPI 是怎么把校验写进类型注解的
python
qq_426003964 天前
启动playwright录制codegen生成自动化测试脚本
python·自动化
虎头金猫4 天前
4K 视频总卡在公网带宽?用 N1 + OpenList 把网盘播放链路重新理顺
运维·服务器·网络·python·容器·beautifulsoup·pandas
长沙三为智能科技4 天前
家政小程序开发从0到上线:五阶段交付流程与验收清单
python
伞伞悦读4 天前
【第38期】Python 模块与包详解:import、from、模块搜索路径、包结构和 __init__
开发语言·python
只睡四小时4 天前
Canvas 弹道联机实战:700 行 + 固定时间步长
python·websocket·html5·游戏开发·canvas
奇思妙想聪明勤奋的小羊4 天前
DeepAgents第5章:子Agent 与上下文隔离—让 Agent学会委派
人工智能·python·学习·语言模型
lpfasd1234 天前
2026年第38周GitHub趋势周报
python·科技·github
IZero074 天前
Jev 与 Laya
python·语言模型
程序猿编码4 天前
告别改源码适配模型:纯 C++ 可配置 LLM 推理引擎,全格式全结构兼容
c++·大模型·llm·推理引擎