Moondream
M87 Labs 出品的微型视觉语言模型,9,969 stars。专为边缘设备设计,可在树莓派等资源受限环境运行,支持图像理解、视觉问答、OCR 和物体检测。混合架构(transformer + 循环组件),2026-04 仍在推送更新。
🎯适用场景:在资源受限设备(手机/嵌入式/树莓派)上部署视觉语言理解能力
#vision-language-model#edge-ai#on-device#image-understanding#vqa#ocr#object-detection
📊 仓库数据
Stars9,969
Forks850
语言Python
协议Apache-2.0
上线2023/12/1
更新2026/8/16
✅ 优点
- •微型模型可在边缘设备运行(树莓派级别)
- •支持多种视觉任务(VQA/OCR/检测)
- •混合架构效率高于纯 transformer
- •9,969 stars 社区活跃
- •Apache-2.0 许可证
⚠️ 限制
- •最近推送 2026-04-20,维护节奏放缓
- •边缘设备精度受限于模型规模
- •需要量化部署以获得最佳性能
