YOLOv5

YOLOv5 目标检测,57,248+ stars。Ultralytics 出品的实时目标检测模型,以速度和精度著称,支持多种模型规模(Nano 到 XLarge),广泛应用于工业视觉、安防监控等场景

🎯适用场景:多模态内容理解与生成

#目标检测#计算机视觉#实时推理#Ultralytics

📥 收录于 2026/4/20

📊 仓库数据

Stars57,565
Forks17,473
语言Python
上线2020/5/18
更新2026/6/28

📈 Stars 变化 6 小时 -1· 统计区间 6/28 18:12 → 6/29 00:15(6 小时)

优点

  • 推理速度极快
  • 模型尺寸可选灵活部署
  • 训练和部署工具完善
  • 工业级稳定可靠

⚠️ 限制

  • 复杂场景小目标检测精度有限
  • 需要标注数据训练
  • 已被 YOLOv8/v10 等后续版本替代

🔗 相关工具

OpenCV

开源89k+3

github.com/opencv/opencv

开源计算机视觉库,87,181+ stars。全球最广泛使用的计算机视觉库,提供 2500+ 优化算法,涵盖图像处理、目标检测、人脸识别、相机标定等领域。支持 C++、Python、Java,是 AI 视觉应用的基石。

🎯多模态内容理解与生成

#计算机视觉#图像处理#目标检测#开源
语言C++
🍴 Forks56,659
📅 上线2012/5/1
🔄 更新2026/6/28
📥 收录2026/4/21

Ultralytics

开源59k+10

github.com/ultralytics/ultralytics

YOLO 系列目标检测框架,56,193+ stars。业界最先进的目标检测框架,支持 YOLOv8/v11 等最新模型,提供检测、分割、姿态估计、旋转框检测等任务,API 简洁易用

🎯多模态内容理解与生成

#目标检测#YOLO#计算机视觉#深度学习
语言Python
🍴 Forks11,280
📅 上线2022/9/12
🔄 更新2026/6/29
📥 收录2026/4/20

Roboflow Supervision

开源45k+6

github.com/roboflow/supervision

可复用的计算机视觉工具库,39.7K+ stars。提供目标检测、实例分割、图像分类等 CV 任务的评估指标和可视化工具,兼容 YOLO、SAM 等主流模型

🎯多模态内容理解与生成

#计算机视觉#目标检测#实例分割#评估指标
语言Python
🍴 Forks4,007
🔄 更新2026/6/29
📥 收录2026/5/28

kornia

开源11k

github.com/kornia/kornia

几何计算机视觉库,11K+ stars。面向空间 AI 的几何计算机视觉库,提供 OpenCV 风格的 PyTorch 原生计算机视觉操作

🎯多模态内容理解与生成

#人工智能#计算机视觉#深度学习#hacktoberfest+1
语言Python
🍴 Forks1,192
🔄 更新2026/6/28
📥 收录2026/5/7

PaddleOCR

开源84k+30

github.com/PaddlePaddle/PaddleOCR

百度开源的多语言 OCR 工具,75,995+ stars。支持 80+ 语言识别,提供超轻量级中文 OCR 模型(仅几 MB),可部署于服务器、移动端和嵌入式设备,是工业级 OCR 方案的首选

🎯多模态内容理解与生成

#OCR#多语言#轻量级#工业级
语言Python
🍴 Forks10,904
📅 上线2020/5/8
🔄 更新2026/6/29
📥 收录2026/4/20

Tesseract OCR

开源75k+8

github.com/tesseract-ocr/tesseract

开源 OCR 引擎,73,620+ stars。由 HP 开发、Google 维护的顶级文字识别引擎,支持 100+ 语言,可识别图片、PDF、扫描件中的文字。结合 LSTM 神经网络实现高精度 OCR,是 AI 文档处理的基础设施。

🎯多模态内容理解与生成

#OCR#文字识别#文档处理#多语言
语言C++
🍴 Forks10,675
📅 上线2015/1/1
🔄 更新2026/6/28
📥 收录2026/4/21