如何使用GPT-SoVITSS生成各种角色的语言

百度网盘 请输入提取码

项目来自b站UP主花儿不哭

一,先除去背景声音------------人生伴奏出去背景声音

1.下载后,按下面路径打开,打开文件beta,打开go-webui程序

回车,然后稍等一下,等待网页打开

2.勾选如下,稍等一下,又会打开新界面

3.将需要去除背景音乐的文件拖入以下位置

我这是拖入后的

转换后

4.回到文件夹,按以下路径打开

这个就是除掉人声的音乐文件了,打开听听,下面一个是除掉背景音乐的文件

最后,我们把想要的音频,放到我们想要存放的文件夹,记住位置

二,音频数据处理------

1.回到开始的界面,取选我们之前人声分离是否开启UVR5-WebUI这个

2.输入根目录

复制粘贴,我们处理后的音频路径及音频本身命名

2.输出根目录

按以下图片序号顺序来

找到我们的含上面输出路径的输出目录

4.得到以下路径,顺便复制

5.粘贴如下

粘贴到输入文件夹路径即可,序号2,可以直接用达摩,这个比较快

6.asr_

找到该文件夹,打开后,可以发现是后缀为.list的文件

7.我的是记事本打开,打开后就没有.list后缀了,但我们后面需要后缀,你可以在属性里看后缀

转记事本,可以看到对应的文本

8.接着,如下

9.粘贴至如下,勾选开启打标WebUI,然后稍等一下,会打开新的界面

10.如下新界面,我们可以翻译一下

11.把yes勾选上,点击合成音频,可以拼在一起

12.点击保存文件

13.然后关闭界面

回到一开始界面,取选打标

三,训练模型

1.滑到上面,点击这个

2,再此使用以下位置的路径,复制

3.按如下操作,随你取名,并粘贴路径

4.找到我们这里的路径,复制

5.粘贴到如下

6.直接一键三连,其他的你也可以随便操作一下,等待执行结束

7.回到开始的目录,找到logs文件点击

8.得到如下文件

9,一键三连结束后,选择微调训练

10.保持默认即可

按顺序点击,下面两个训练,可以在终端cmd里看进度,等待训练完成

检测找到这两个训练完成的模型,点开检测一下文件

四,生成想要的语音

1.打开推理,勾选如下,然后等待打开新界面

2.刷新模型路径

GPT模型列表,找到自己命名的模型,选择数值最大的

SoVITS模型列表,找到自己命名的模型,选择数值最大的

3.上传之前对应切割好的音频

找到其文件夹位置,拖入如下

4.输入这个语言里对应的文本

我们先到这个路径用记事本打开,复制一下文本

粘贴到如下,语种中文

5.输入你想要的语音文本,合成,播放,尝试一下

6.下载即可

完成,感谢观看

相关推荐
葡萄城技术团队15 小时前
从提示词到Skill:AI生成测试用例的技术演进之路
ai
leoZ23115 小时前
本地跑大模型实战(七):llama.cpp 性能调优,让推理更快更省
java·人工智能·spring·生成对抗网络·语言模型·自然语言处理·llama
To_OC15 小时前
我把《天龙八部》塞进向量数据库后,终于搞懂了 RAG 到底是个啥
人工智能·llm·agent
蜡台15 小时前
AI Agent(智能体)入门基础教程
人工智能
傻啦嘿哟15 小时前
某短视频平台视频爬虫实战:抓取推荐流视频信息,绕过反爬的3种技巧
开发语言·爬虫·python
Akir.weiwen16 小时前
Token 层差异:从颜色值到语义状态的三层跃迁
人工智能·设计规范
迷迭香yy16 小时前
集合竞价数据挖掘实战:用Python构建开盘信号识别系统
人工智能·python·数据挖掘
大模型momo16 小时前
Spring AI 实战:多 Agent 协作实战 —— 分工拆解复杂旅游行程任务
人工智能·spring·ai·agent·旅游
小程故事多_8016 小时前
从A2C、TRPO、PPO到GRPO,强化学习策略梯度算法完整演进与大模型落地实战解析
人工智能·算法
风曦Kisaki17 小时前
Kubernetes(K8s)笔记Day06: 持久化存储(emptyDir,hostPath,NFS),PV 和 PVC,StorageClass存储类
linux·运维·笔记·云原生·容器·kubernetes