ExecuTorch

开源LLM 运行时4.7k

PyTorch 端侧 AI 推理引擎,4.6K+ stars。覆盖移动设备、嵌入式和边缘端的 PyTorch 端侧推理方案,支持模型量化、编译和优化部署

🎯适用场景:将 PyTorch 模型编译部署到手机与嵌入式设备的端侧推理

#端侧 AI#PyTorch#嵌入式#移动端

📥 收录于 2026/5/27

📊 仓库数据

Stars4,659
Forks1,004
语言Python
更新2026/5/26

优点

  • PyTorch 官方端侧方案,导出路径清晰
  • 支持量化与多硬件后端
  • 覆盖移动/嵌入式/边缘场景
  • 与 PyTorch 训练生态一致

⚠️ 限制

  • 部分算子与模型仍处在快速迭代
  • 复杂模型编译失败需手动拆分
  • 文档与示例仍在完善中
  • 与 MNN/TFLite 等需做方案对比

🔗 相关工具

MNN

开源15k

github.com/alibaba/MNN

阿里巴巴端侧 AI 推理引擎,15K+ stars。轻量高效的移动端和边缘端推理引擎,支持 LLM 端侧部署,在 ARM、RISC-V 等平台上提供极致性能

🎯手机、IoT 等设备上的轻量模型与 LLM 端侧推理部署

#端侧 AI#推理引擎#嵌入式#LLM
语言C++
🍴 Forks2,319
🔄 更新2026/5/25
📥 收录2026/5/27

Ollama

开源172k↑+28

github.com/ollama/ollama

本地运行开源大语言模型的最简方案,支持 Llama、Qwen、DeepSeek 等主流模型,一键安装、自动下载模型、提供 OpenAI 兼容 API,是 AI 开发者本地部署的首选工具

🎯生产环境模型推理服务

#本地部署#开源模型#API
语言Go
🍴 Forks16,296
📅 上线2023/6/26
🔄 更新2026/5/26
📥 收录2026/4/13

gpt4free

开源66k↑+2

github.com/xtekky/gpt4free

多模型免费访问平台,66,037+ stars。提供多种大语言模型的免费访问接口,包括 GPT-4、Claude、Gemini 等主流模型的聚合调用方案

🎯本地模型运行与推理服务

#免费模型#API聚合#多模型#开源
语言Python
🍴 Forks13,585
📅 上线2023/3/29
🔄 更新2026/5/26
📥 收录2026/4/20

LocalAI

开源46k↑+4

github.com/mudler/LocalAI

开源本地 AI 引擎,45,607+ stars。完全兼容 OpenAI API 的本地 AI 推理引擎,支持 LLM、语音识别、图像生成等多种模型,数据完全本地处理保护隐私

🎯生产环境模型推理服务、多模态内容理解与生成

#本地部署#隐私保护#OpenAI 兼容#多模型
语言Go
🍴 Forks4,103
📅 上线2023/3/18
🔄 更新2026/5/26
📥 收录2026/4/20

Kronos

开源26k↑+94

github.com/shiyu-coder/Kronos

面向金融市场的 Foundation Model,将金融市场语言建模为序列预测问题。支持金融时间序列分析、市场趋势预测和量化交易策略生成。由 shiyu-coder 团队开发,GitHub 20K+ 星,周增 3200+ 星,是金融 AI 领域增长最快的项目之一。采用类 Transformer 架构处理结构化金融数据,可对接主流交易 API。

🎯金融时间序列预测、量化交易策略生成、市场趋势分析

#金融 AI#时间序列预测#量化交易#Foundation Model+1
语言Python
🍴 Forks4,581
📅 上线2025/10/8
🔄 更新2026/5/26
📥 收录2026/4/21

omlx

开源15k↑+23

github.com/jundot/omlx

Apple Silicon 专用 LLM 推理服务器,支持连续批处理和 SSD 缓存,从 macOS 菜单栏管理。为 Mac 用户提供了一键式 LLM 本地部署方案,14K+ stars

🎯本地模型运行与推理服务

#Apple Silicon#本地推理#macOS#SSD 缓存
语言Python
🍴 Forks1,284
🔄 更新2026/5/26
📥 收录2026/5/19