DeepSeek-OCR-2
DeepSeek 开源的 3B 参数视觉语言 OCR 模型,采用创新的 Visual Causal Flow 架构,模拟人类阅读文档的因果视觉流,突破传统 raster scan 的局限。专为文档理解和文本提取设计,支持多栏布局和嵌套表格。Apache-2.0 许可。
🎯适用场景:文档 OCR 和文本提取,特别是多栏布局、嵌套表格等复杂文档结构
#ocr#vision-language#document-understanding#causal-flow#deepseek#3b-params
📊 仓库数据
Stars3,315
Forks285
语言Python
协议Apache-2.0
上线2026/1/27
更新2026/2/3
✅ 优点
- •Visual Causal Flow 创新架构
- •3B 参数轻量高效
- •专为文档理解优化
- •Apache-2.0 许可
- •权重在 HuggingFace 开放
⚠️ 限制
- •最后更新 2026-02-03(6 个月前)
- •仅 3B 参数,复杂场景可能受限
- •需要 GPU 推理
