Context7
LLM 文档上下文引擎,53,227+ stars。自动获取和整理最新文档上下文,为 LLM 提供精确的技术参考信息,减少幻觉并提高回答质量
🎯适用场景:知识库问答与 RAG 检索
📊 仓库数据
📈 Stars 变化 ↑6 小时 +7· 统计区间 7/10 06:09 → 7/10 12:08(6 小时)
✅ 优点
- •自动获取最新文档
- •减少 LLM 幻觉
- •支持多框架文档
- •集成简单
⚠️ 限制
- •依赖外部文档源质量
- •某些文档抓取可能不完整
- •需要网络访问
🔗 相关工具
Google LangExtract
github.com/google/langextract
Google 开源的结构化信息提取库,使用 LLM 从非结构化文本中提取结构化信息,支持精确溯源和交互式可视化,36K+ stars
🎯从文档中提取结构化数据
PixelRAG
github.com/StarTrail-org/PixelRAG
像素级原生视觉搜索引擎,终结传统网页解析,用多模态 VLM 直接理解页面像素内容,实现可扩展的视觉原生检索。
🎯用视觉理解能力替代传统网页解析,实现像素级内容检索
MarkItDown
github.com/microsoft/markitdown
微软开源的通用文件转 Markdown 工具,支持 PDF、Word、PPT、Excel、HTML、音频、图片 OCR 等数十种格式转换,专为 LLM 和 RAG 数据预处理设计,插件系统可扩展,MIT 协议
🎯多模态内容理解与生成
Supabase
github.com/supabase/supabase
Postgres 开发平台,101,199+ stars。开源 Firebase 替代方案,内置向量数据库支持 pgvector,是构建 AI 应用(RAG、Agent)的理想后端基础设施。提供实时数据库、认证、存储、Edge Functions 等全栈能力。
🎯LLM 应用快速开发
China Textbook
github.com/TapXWorld/ChinaTextbook
收录所有小初高、大学 PDF 教材(GitHub 69k 星),覆盖中国完整教育体系,是 AI 教育应用和知识库构建的重要数据源
🎯中文 PDF 教材数据集、教育领域知识库构建
AFFiNE
github.com/toeverything/affine
开源、本地优先、隐私友好的 Notion 和 Miro 替代品,集知识库、文档、白板、数据库于一体的全功能工作空间
🎯个人/团队知识库搭建、文档管理、白板协作、替代 Notion
