KTransformers
kvcache-ai 开源的异构 LLM 推理与微调框架。通过 CPU-GPU 异构计算实现消费级硬件运行前沿大模型。支持 DeepSeek V4 Flash、GLM 5.2、MiniMax M3 等模型,KT kernel 提供高性能推理和 SFT。
🎯适用场景:在消费级硬件上通过异构计算运行前沿大模型推理和微调
#inference#fine-tuning#heterogeneous#cpu-gpu#kt-kernel#llm
📊 仓库数据
Stars19,141
Forks1,499
语言Python
协议Apache-2.0
上线2024/7/26
更新2026/8/2
✅ 优点
- •CPU-GPU 异构推理
- •消费级硬件可运行前沿模型
- •广泛模型支持
- •CLI 工具
⚠️ 限制
- •配置复杂度较高
- •AMD 平台性能待优化
- •文档分散
