GPT-SoVITS-文本转语音(你的声音不再是唯一)

本文将要介绍GPT-SoVITS的安装和使用方法

首先感谢花儿不哭大佬带来的RVC声音克隆

花儿不哭:

花儿不哭的个人空间-花儿不哭个人主页-哔哩哔哩视频 (bilibili.com)

GPT-SoVITS下载地址

GitHub - RVC-Boss/GPT-SoVITS: 1 min voice data can also be used to train a good TTS model! (few shot voice cloning)

GPT-SoVITS与RVC同为花儿不哭大佬的产品

RVC:可利用语音转语音,对于变声器方面强于GPT-SoVITS

RVC-AI声音克隆-你的声音不再是唯一-CSDN博客
GPT-SoVITS:可使用文本转语音(也可使用RVC)

这个条件与RVC所需条件一样:本文件需要Python环境,请先配置好Python环境

学习过RVC,知道RVC只需要一个

注意:此时GPT-SoVITS所需weights有两个文件夹(weights为训练生成的文件)

解析完成后,打开下方文件

静静等待,此时会跳转浏览器(注:程序台不可以退出)

使用文本转语音,就要利用以下三个

训练格式化工具:为我们训练模型的地方,与RVC类似

微调训练:则是我们训练过后的文件,进行声音的调整

推理:则是我们文本转语音的地方

训练完成,获取训练文件(保存至weights文件夹),在对该位置打钩,静静等待

选择训练文件,提供参考音频与音频的文本(纯声音,最好无背景音乐)

然后输入你所需要的文本,合成语音,就可以获得你想要的语音

相关推荐
huang5791471 分钟前
基于滑动窗口的流式数据算法优化思路3
算法
锋行天下9 分钟前
LangGraph 模拟简单的多模型编排
人工智能
Ulyanov13 分钟前
AudioVision Pro:基于 PySide6 + sounddevice 的实时音频可视化播放器设计
python·算法·音视频
中年阿甘18 分钟前
对AI结对编程的反思
人工智能·结对编程
用户7217465882623 分钟前
64个音色、¥1/万字符、语音输出贵5倍:TTS/ASR/Omni四层链路的参数细节与两个真实报错
人工智能
土司大王26 分钟前
LeetCode hot100——74.搜索二维矩阵:Java 二分模板
java·算法·leetcode
秦哈哈26 分钟前
【Hello Agents】学习笔记(二)
笔记·学习·microsoft
人工智能AI技术27 分钟前
给LLM装上长期记忆!用Milvus向量数据库解决AI金鱼记忆问题
人工智能
Evand J35 分钟前
【MATLAB例程,图像滤波降噪12】加权中值滑动窗口滤波(WMF)图像降噪,包含滤波质量评价。附代码下载链接
开发语言·图像处理·人工智能·计算机视觉·matlab·滑动窗口·滤波
tyler_download38 分钟前
揉扁搓圆transformer架构:NAG优化器算法详解
深度学习·算法·transformer