coqui-ai/TTS vs QwenAudio/CosyVoice
基于当前公开核验快照比较 coqui-ai/TTS 与 QwenAudio/CosyVoice 的定位、License、部署方式、适用场景、限制和原始来源。
coqui-ai/TTS
coqui-ai/tts 是一个用于文本转语音生成的深度学习工具包,提供覆盖 1100 种以上语言的预训练模型,并具备模型训练与声音克隆能力。用户可通过命令行、Python 库或自带 Web 服务器在本地进行语音合成与开发。
- License
- MPL-2.0
- 部署
- 查看项目说明
- 适用场景
- 语音音频
- 更新时间
- 2026-07-16T18:07:19Z
QwenAudio/CosyVoice
CosyVoice 是一个多语言大型语音生成模型,提供零样本语音克隆和文本到语音合成功能。该模型覆盖 9 种常用语言及 18 种以上的中文方言/口音,并支持延迟低至 150ms 的双向流式推理。
- License
- Apache-2.0
- 部署
- 查看项目说明
- 适用场景
- 语音音频
- 更新时间
- 2026-07-24T23:16:26Z
如何选择
先按必须满足的部署、License 和使用场景排除不合适选项,再打开各自详情核对限制与直接证据。