GPT-SoVITS:定义新一代声音克隆技术
技术突破
零样本文本到语音(TTS):即便仅有5秒的声音样本,GPT-SoVITS也能进行文本到语音的转换。
少样本TTS:提供一分钟的声音样本后,系统可以生成更加自然和真实的声音克隆。
多语言转换:这项技术可以将英语、日语和中文的文本都转换为那个特定的克隆声音。
易用的Web界面:为技术新手设计的用户界面,使得操作声音克隆变得简单直观。
详细部署指南
Windows 用户:
下载预打包的GPT-SoVITS文件。
解压并双击 go-webui.bat 文件启动WebUI。
Linux 用户:
conda create -n GPTSoVits python=3.9conda activate GPTSoVits
2.运行安装脚本:
2.安装Xcode command-line tools:
3.安装FFmpeg:
brew install ffmpeg 或 conda install ffmpeg
4.创建并激活环境,安装必要的包:
conda create -n GPTSoVits python=3.9conda activate GPTSoVitspip3 install --pre torch torchaudio --index-url https://download.pytorch.org/whl/nightly/cpupip install -r requirements.txt
使用体验
由于有些小伙伴网络问题,导致下载不了,这里我已经整理到网盘了。
链接地址:https://www.songshuhezi.com/index_open/gpt_sovits.html
扫描下方二维码,购买《AIGC商业变现课程》 送ChatGPT独享账号!
课程包含超多AI前沿玩法,帮助大家熟练掌握AI!