Neural Compressor
Intel 开源的低比特量化与模型压缩工具,支持 INT8/FP8/INT4 等多种量化格式,兼容 PyTorch、TensorFlow 和 ONNX Runtime。
🎯适用场景:模型量化压缩——将大模型压缩为低精度格式,在保持精度的同时大幅减少显存和推理延迟。
#开源#python#量化
📥 收录于 2026/6/9
📊 仓库数据
Stars2,684
Forks318
语言Python
更新2026/7/23
✅ 优点
- •Intel 官方维护,工业级可靠性
- •支持多种量化格式(INT8/FP8/INT4 等)
- •兼容主流深度学习框架
⚠️ 限制
- •部分高级功能依赖 Intel 硬件
- •文档较复杂,上手有一定学习成本
