📁 开源语音音频工具 (12 个工具)
W
WhisperX
开源语音音频
在 Whisper 基础上加入对齐与说话人分离的开源转录工具。
I
IndexTTS
开源语音音频
开源零样本工业级中文语音合成,对标自然度。
P
Parler-TTS
开源语音音频
HuggingFace 开源的由文本描述控制风格的语音合成。
V
VITS
开源语音音频
端到端语音合成经典开源模型,质量与效率兼顾。
R
RVC
开源语音音频
开源 Retrieval-based 语音转换,常用于翻唱与配音。
F
Fish Speech
开源语音音频
Fish Audio 开源的基于 VQ 声码器的语音合成,质量高。
O
OpenVoice
开源语音音频
MyShell 开源的即时音色克隆语音合成模型。
C
CosyVoice
开源语音音频
阿里 FunAudioLLM 开源的多语言语音生成,支持音色克隆。
C
ChatTTS
开源语音音频
开源对话级中文语音合成,自然流畅适合 LLM 配音。
B
Bark
开源语音音频
Suno 开源的神经网络语音生成,可生成带语气与音乐的语音。
C
Coqui TTS
开源语音音频
开源语音合成工具包,支持多说话人与多种声学模型。
W
Whisper
开源语音音频
OpenAI 开源的通用语音识别模型,多语言转录能力强。
