ChatTTS超强的真人AI语音助手下载使用教程

简介

ChatTTS是专门为对话场景设计的文本转语音模型,支持多人同时对话,适用的场景非常丰富,比如LLM助手对话任务视频配音声音克隆等。同时支持英文和中文两种语言。最大的模型使用了10万小时以上的中英文数据进行训练,功能非常的强大。

文本转语音(TTS)在生活中的应用非常的广泛,比如有声小说、语音导航,视频配音和智能家居控制等。

今天给大家推荐一个超强的TTS文本转语音应用,适用于自然、对话式文本转语音,特别适用于大型语言模型助手的对话任务,以及诸如对话式音频和视频配音等,并且可以免费使用。

教程

1. 下载项目源码

点击进入 chatTTS开源项目地址https://github.com/2noise/ChatTTS

解压zip文件,安装python sdk python下载地址

2. 安装项目依赖

cmd控制面板 进入项目根目录,创建python虚拟环境

  • 执行命令,创建一个名为.venv的虚拟环境:
bash 复制代码
python -m venv .venv
  • 执行后会在项目根目录下生成一个.venv文件夹

  • 执行安装项目依赖命令,下载安装项目所需要的环境依赖

bash 复制代码
pip install --upgrade -r requirements.txt
  • 等待下载安装完成

快速启动

确保在执行以下命令时,处于项目根目录下。

启动 WebUI 可视化界面,执行以下命令:

bash 复制代码
python examples/web/webui.py
  • 下次启动只用在项目根目录下执行这个命令即可
  • 首次启动会从https://huggingface.co下载AI语音模型,需要科学上网,过程需要大约20分z左右。

使用教程

启动完成后,会在浏览器里自动打开本地网址。

文生音频

在输入文本框内输入你要生成的语音的文字

选择你想要的音色

点击生成

会在输出音频框内显示生成的音频,点击下载图标,可以下载音频。

声音克隆

在采集音频这个上传一段你想要克隆的人物的声音视频,不要出现其他人物的声音和其他杂音,时长一分钟左右即可。

上传完,在音频代码里面会有你克隆声音的向量代码,复制粘贴,

把复制的人物语音向量代码粘贴到说话人嵌入里面

然后和文生音频的步骤一样,输入你要合成的文字,点击生成按钮即可获得,某个人得克隆音频。

相关文章推荐

《使用 Xinference 部署本地模型》
《Fastgpt接入Whisper本地模型实现语音输入》
《部署和接入使用重排模型bge-reranker》
《部署接入 M3E和chatglm2-m3e文本向量模型》
《Fastgpt 无法启动或启动后无法正常使用的讨论(启动失败、用户未注册等问题这里)》
《vllm推理服务兼容openai服务API》
《解决vllm推理框架内在开启多显卡时报错问题》

相关推荐
数据与人工智能律师2 分钟前
数字迷雾中的安全锚点:解码匿名化与假名化的法律边界与商业价值
大数据·网络·人工智能·云计算·区块链
chenchihwen3 分钟前
大模型应用班-第2课 DeepSeek使用与提示词工程课程重点 学习ollama 安装 用deepseek-r1:1.5b 分析PDF 内容
人工智能·学习
说私域11 分钟前
公域流量向私域流量转化策略研究——基于开源AI智能客服、AI智能名片与S2B2C商城小程序的融合应用
人工智能·小程序
Java樱木25 分钟前
AI 编程工具 Trae 重要的升级。。。
人工智能
AntBlack30 分钟前
从小不学好 ,影刀 + ddddocr 实现图片验证码认证自动化
后端·python·计算机视觉
凪卄121344 分钟前
图像预处理 二
人工智能·python·深度学习·计算机视觉·pycharm
巫婆理发2221 小时前
强化学习(第三课第三周)
python·机器学习·深度神经网络
AI赋能1 小时前
自动驾驶训练-tub详解
人工智能·深度学习·自动驾驶
seasonsyy1 小时前
1.安装anaconda详细步骤(含安装截图)
python·深度学习·环境配置
deephub1 小时前
AI代理性能提升实战:LangChain+LangGraph内存管理与上下文优化完整指南
人工智能·深度学习·神经网络·langchain·大语言模型·rag