Qwen2.5-Omni
阿里通义团队开源的端到端多模态模型,支持理解文本、音频、视觉、视频,并执行实时语音生成。
🎯适用场景:多模态理解和生成的端到端推理,支持实时语音交互
#qwen#multimodal#omni-modal#end-to-end#speech-generation
📥 收录于 2026/6/12
📊 仓库数据
Stars4,047
Forks323
语言Jupyter Notebook
更新2026/7/24
📈 Stars 变化 ↑11 小时 +1· 统计区间 7/24 12:26 → 7/24 23:22(11 小时)
✅ 优点
- •开源项目,社区活跃
- •Stars 数量充足,社区活跃
⚠️ 限制
- •项目较新,长期稳定性待观察
- •文档和社区支持仍在完善中
