FastFlowLM
AMD 官方的 Ryzen AI NPU 本地 LLM 推理运行时(Ollama 风格但专为 NPU 优化)。支持所有 XDNA2 NPU 的 Ryzen AI 芯片(Strix、Strix Halo、Kraken、Gorgon Point),17 MB 轻量运行时,安装 20 秒内完成,无需 GPU/CPU 负载,上下文窗口最高 256K。AMD 2026 年 7 月收购 FastFlowLM 团队并将其并入 ROCm 组织
🎯适用场景:AMD Ryzen AI PC 上的本地 LLM 推理,替代 Ollama 的 NPU 优化方案
#NPU#本地推理#AMD#Ollama 替代#端侧推理
📊 仓库数据
Stars1,735
Forks138
语言C++
上线2025/6/17
更新2026/8/14
✅ 优点
- •AMD 官方维护(ROCm 组织)
- •NPU-first,GPU-free 推理
- •17 MB 轻量运行时安装极快
- •支持 256K 上下文窗口
⚠️ 限制
- •仅支持 AMD Ryzen AI(XDNA2)芯片
- •1735 stars 社区规模较小
- •生态与文档仍在完善
