CosyVoice
阿里 FunAudioLLM 多语言语音生成大模型,提供推理、训练和部署全栈能力,支持跨语种合成和声音克隆。
🎯适用场景:多语言语音合成、声音克隆、实时语音交互
#语音合成#voice-cloning#tts#multi-lingual
📊 仓库数据
Stars22,870
Forks2,631
语言Python
更新2026/8/24
📈 Stars 变化 ↑3 天 +34· 统计区间 8/21 13:15 → 8/24 03:32(3 天)
✅ 优点
- •多语言支持(中文、英语、日语、韩语、粤语)
- •提供推理、训练、部署全栈能力
- •支持细粒度控制和声音克隆
⚠️ 限制
- •训练需要较大 GPU 资源
- •跨语言迁移效果依赖训练数据质量
