【超详细教程】GPT-SoVITs从零开始训练声音克隆教程（主要以云端AutoDL部署为例）

2024-01-29 16:44

文章标签 部署训练教程详细从零开始主要 gpt 克隆声音为例云端 autodl sovits

本文主要是介绍【超详细教程】GPT-SoVITs从零开始训练声音克隆教程（主要以云端AutoDL部署为例），希望对大家解决编程问题提供一定的参考价值，需要的开发者们随着小编来一起学习吧！

目录

一、前言

二、GPT-SoVITs使用教程

2.1、Windows一键启动

2.2、AutoDL云端部署

2.3、人声伴奏分离

2.4、语音切割

2.5、打标训练数据

2.6、数据集预处理

2.7、训练音频数据

2.8、推理模型

三、总结

一、前言

近日，RVC变声器的创始人（GitHub昵称为RVC-Boss）与AI音色转换技术专家Rcell合作，共同开发并开源了一款创新的跨语言音色克隆工具——GPT-SoVITS。这个项目在互联网上迅速获得了广泛关注和好评，众多业界大佬和知名博主都对其给予了推荐。自项目上线以来，短短两天内，它在GitHub上的Star数就达到了1.4k，而现在这个数字已经飙升至6.5k。

GPT-SoVITS的开发历时半年，期间RVC-Boss和Rcell面临了诸多挑战。这款工具不仅具有低成本和易用性的特点，而且在音色克隆领域展现出了新颖的技术创新。

项目地址：https://github.com/RVC-Boss/GPT-SoVITS

二、GPT-SoVITs使用教程

2.1、Windows一键启动

首先下载软件包，解压后双击打开“go-webui.bat”即可。

GPT-SoVITs安装包下载

2.2、AutoDL云端部署

首先打开AutoDL网页，注册登录后进入到“算力市场”，选择一个性价比高的显卡，CUDA版本需要大于11.8，这里我选择RTX3090显卡为示例。

接着来到创建实例界面，点击“社区镜像”，输入“GPT-SoVITs”，选择最新的镜像文件，比如我这里的v2.1版本，然后点击“立即创建”即可。

来到容器实例界面，点击刚刚创建好的容器，点击“JupyterLab”进入终端操作界面。

点击第二个选项框，进入使用界面，拉到最下面，运行前两个命令，选择命令框点击运行即可。

最后打开下方图片链接即可打开GPT-SoVITs界面啦~

2.3、人声伴奏分离

首先准备一段1分钟以上的音频文件，必须是同一个人说话的声音喔，点击开启UVR5-WebUI，回到AutoDL的终端操作界面，查看命令行中的链接，点击进入WebUI界面。

来到人声分离WebUI界面，上传1分钟以上的音频文件进行声音分离，选择好模型，选择好导出的文件格式，点击“转换”即可，转换好的文件位于output/uvr5_opt。

转换好后，记得关闭UVR5-WebUI，这样可释放一些内存。

2.4、语音切割

第一步，上传刚刚分离好的音频文件，填写好音频输入文件路径，这里跟着我填写input就可以了，点击开启语音切割。

接着进行开启离线批量ASR，填写好输出文件夹的路径，然后点击左边的“开启离线批量ASR”按钮。

然后填写好打标数据文件路径，点击开启打标WebUI，返回到AutoDL终端操作界面，查看命令行输出，点击下方链接即可进入到打标数据界面。

2.5、打标训练数据

点击播放▶️按钮，试听一下对应文本是否正确，如果不正确进行文本的修改，这一页整理好数据后，点击“Save File”和“Submit Text”这两个按钮，接着点击“Next Index”下一页，重复以上的步骤进行校对。

全部校对完毕后，返回WebUI界面，关闭打标WebUI

2.6、数据集预处理

点击“1-GPT-SoVITS-TTS”，来到训练操作界面，更改实验名字，可随意命名，然后填写好文本标注文件和训练集音频文件路径，这里跟我的一模一样就可以了。

接着分别点击这四个按钮即可。

2.7、训练音频数据

然后来到了微调训练数据这个界面，保持默认参数不变，也可以自行调整参数的，点击开启SOVITS训练和开启GPT训练。

2.8、推理模型

来到1C-推理，首先点击刷新模型路径，才能出现刚刚训练好的模型。

接下来选择刚刚训练好的模型文件，然后开启TTS推理WebUI

查看AutoDL的终端界面，找到最后一行的网页链接，点击这个链接即可到TTS推理的界面。

首先上传一段几秒的参考音频，填写参考音频的所输出的语音文本，然后再填写需要合成的文本，点击合成语音，一会儿就会出现了输出的语音音频文件了，点击试听，效果确实很惊艳！！！

三、总结

GPT-SoVITS是一款支持多语言的先进技术，融合了声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)以及文本标注等多种辅助工具。令人印象深刻的是，它仅需一分钟的训练数据，就能对模型进行微调，显著提升语音的相似度和真实感。整体而言，GPT-SoVITS提供了一种极为出色的体验。期待其在未来的应用范围能不断扩大，而且在更新迭代过程中能实现更加完善和优化。

这篇关于【超详细教程】GPT-SoVITs从零开始训练声音克隆教程（主要以云端AutoDL部署为例）的文章就介绍到这儿，希望我们推荐的文章对编程师们有所帮助！

http://www.chinasem.cn/article/657549。 23002807@qq.com

相关文章

Python对接支付宝支付之使用AliPay实现的详细操作指南

Python对接支付宝支付之使用AliPay实现的详细操作指南

《Python对接支付宝支付之使用AliPay实现的详细操作指南》支付宝没有提供PythonSDK,但是强大的github就有提供python-alipay-sdk,封装里很多复杂操作,使用这个我们就... 目录一、引言二、准备工作2.1 支付宝开放平台入驻与应用创建2.2 密钥生成与配置2.3 安装ali

阅读更多...

2025版mysql8.0.41 winx64 手动安装详细教程

2025版mysql8.0.41 winx64 手动安装详细教程

《2025版mysql8.0.41winx64手动安装详细教程》本文指导Windows系统下MySQL安装配置,包含解压、设置环境变量、my.ini配置、初始化密码获取、服务安装与手动启动等步骤,... 目录一、下载安装包二、配置环境变量三、安装配置四、启动 mysql 服务，修改密码一、下载安装包安装地

阅读更多...

在macOS上安装jenv管理JDK版本的详细步骤

在macOS上安装jenv管理JDK版本的详细步骤

《在macOS上安装jenv管理JDK版本的详细步骤》jEnv是一个命令行工具,正如它的官网所宣称的那样,它是来让你忘记怎么配置JAVA_HOME环境变量的神队友,：本文主要介绍在macOS上安装... 目录前言安装 jenv添加 JDK 版本到 jenv切换 JDK 版本总结前言China编程在开发 Java

阅读更多...

Spring Boot Actuator应用监控与管理的详细步骤

Spring Boot Actuator应用监控与管理的详细步骤

《SpringBootActuator应用监控与管理的详细步骤》SpringBootActuator是SpringBoot的监控工具,提供健康检查、性能指标、日志管理等核心功能,支持自定义和扩展端... 目录一、 Spring Boot Actuator 概述二、集成 Spring Boot Actuat

阅读更多...

电脑提示d3dx11_43.dll缺失怎么办? DLL文件丢失的多种修复教程

电脑提示d3dx11_43.dll缺失怎么办? DLL文件丢失的多种修复教程

《电脑提示d3dx11_43.dll缺失怎么办?DLL文件丢失的多种修复教程》在使用电脑玩游戏或运行某些图形处理软件时，有时会遇到系统提示“d3dx11_43.dll缺失”的错误，下面我们就来分享超... 在计算机使用过程中，我们可能会遇到一些错误提示，其中之一就是缺失某个dll文件。其中，d3dx11_4

阅读更多...

Linux下在线安装启动VNC教程

Linux下在线安装启动VNC教程

《Linux下在线安装启动VNC教程》本文指导在CentOS7上在线安装VNC,包含安装、配置密码、启动/停止、清理重启步骤及注意事项,强调需安装VNC桌面以避免黑屏,并解决端口冲突和目录权限问题... 目录描述安装VNC安装 VNC 桌面可能遇到的问题总结描js述linux中的VNC就类似于Window

阅读更多...

如何在Java Spring实现异步执行(详细篇)

如何在Java Spring实现异步执行(详细篇)

《如何在JavaSpring实现异步执行(详细篇)》Spring框架通过@Async、Executor等实现异步执行,提升系统性能与响应速度,支持自定义线程池管理并发,本文给大家介绍如何在Sprin... 目录前言1. 使用 @Async 实现异步执行1.1 启用异步执行支持1.2 创建异步方法1.3 调用

阅读更多...

Go语言编译环境设置教程

Go语言编译环境设置教程

《Go语言编译环境设置教程》Go语言支持高并发（goroutine）、自动垃圾回收,编译为跨平台二进制文件,云原生兼容且社区活跃,开发便捷,内置测试与vet工具辅助检测错误,依赖模块化管理,提升开发效... 目录Go语言优势下载 Go 配置编译环境配置 GOPROXYIDE 设置（VS Code）一些基本

阅读更多...

Spring Boot 与微服务入门实战详细总结

Spring Boot 与微服务入门实战详细总结

《SpringBoot与微服务入门实战详细总结》本文讲解SpringBoot框架的核心特性如快速构建、自动配置、零XML与微服务架构的定义、演进及优缺点,涵盖开发环境准备和HelloWorld实战... 目录一、Spring Boot 核心概述二、微服务架构详解1. 微服务的定义与演进2. 微服务的优缺点三

阅读更多...

SpringBoot改造MCP服务器的详细说明(StreamableHTTP 类型)

SpringBoot改造MCP服务器的详细说明(StreamableHTTP 类型)

《SpringBoot改造MCP服务器的详细说明(StreamableHTTP类型)》本文介绍了SpringBoot如何实现MCPStreamableHTTP服务器,并且使用CherryStudio... 目录SpringBoot改造MCP服务器（StreamableHTTP）1 项目说明2 使用说明2.1

阅读更多...