目前最火的文本转语音工具:ChatTTS演示 | 本地免安装|任何人都可以用
ChatTTS是专门为对话场景设计的文本转语音模型,例如LLM助手对话任务。它支持英文和中文两种语言。最大的模型使用了10万小时以上的中英文数据进行训练。在HuggingFace中开源的版本为4万小时训练且未SFT的版本.
视频中介绍了一种不用在本地安装任何软件,就可以在浏览器里体验ChatTTS的使用的办法,就是使用GitHub的codespace,撸GitHub羊毛。
GitHub Codespaces 是一个托管在云端的开发环境,让你可以从任何设备上进行编码。你可以自定义 GitHub Codespaces 项目的配置,通过将配置文件提交到你的代码库中,从而为所有项目用户创建可重复使用的 Codespaces 配置1。这些云端开发环境可以使用 Visual Studio Code 进行编码,预先安装依赖、库,甚至是 Visual Studio Code 的扩展和设置2。无论你是想在 iPad 上编码,还是在其他设备上,GitHub Codespaces 都能满足你的需求。不用担心设备性能是否足够,因为 Codespaces 是在云端运行的
示例代码:
import ChatTTS
from IPython.display import Audiochat = ChatTTS.Chat()
chat.load_models(compile=False) # Set to True for better performancetexts = ["本文件中的信息仅供学术交流使用。其目的是用于教育和研究,不得用于任何商业或法律目的。作者不保证信息的准确性、完整性或可靠性。本文件中使用的信息和数据,仅用于学术研究目的。这些数据来自公开可用的来源,作者不对数据的所有权或版权提出任何主张",]
wavs = chat.infer(texts, )
Audio(wavs[0], rate=24_000, autoplay=True)