文档中的推理示例加载 k2-fsa/OmniVoice 预训练模型;权重可通过 Hugging Face 或文档所述的镜像端点下载,离线环境应提前准备。
核验依据
GitHub 项目简介: High-Quality Voice Cloning TTS for 600+ Languages
README: OmniVoice is a state-of-the-art massively multilingual zero-shot text-to-speech (TTS) model supporting over 600 languages. Built on a novel diffusion language model-style architec…
README: - **600+ Languages Supported**: The broadest language coverage among zero-shot TTS models ([full list](docs/languages.md)). - **Voice Cloning**: State-of-the-art voice cloning qua…