从 ChatTTS 官方 GitHub README 翻译整理的快速上手指南。
ChatTTS 是一个专为对话场景设计的文本转语音(TTS)模型。它由 2noise 团队开源,主要面向 LLM 助手等对话式应用,能够生成自然、富有表现力的语音。
git clone https://github.com/2noise/ChatTTS
cd ChatTTS
方式一:直接安装
pip install --upgrade -r requirements.txt
方式二:使用 Conda(推荐)
conda create -n chattts python=3.11
conda activate chattts
pip install -r requirements.txt
可选:安装 vLLM(仅 Linux)
pip install safetensors vllm
以下是一个简单的使用示例,生成一段中文语音:
import ChatTTS
import torch
import torchaudio
# 初始化模型
chat = ChatTTS.Chat()
chat.load_models()
# 准备文本
texts = ["你好,欢迎使用 ChatTTS 语音合成系统。", "这是一个简单的示例。"]
# 生成语音
wavs = chat.infer(texts, use_decoder=True)
# 保存音频
for i, wav in enumerate(wavs):
torchaudio.save(f"output_{i}.wav", wav, 24000)
运行说明:
注意:模型仅用于学术研究,采用 CC BY-NC 4.0 协议,禁止商业用途。代码采用 AGPLv3+ 协议。
翻译整理自 GitHub README,原文:https://github.com/2noise/ChatTTS