Lorax
多 LoRA 推理服务器,可扩展至数千个微调大语言模型,显著降低部署多个微调模型的成本。
🎯适用场景:部署大量微调模型——一台服务器同时服务上千个 LoRA 微调模型,大幅节省显存和部署成本。
#开源#python
📥 收录于 2026/6/9
📊 仓库数据
Stars3,820
Forks325
语言Python
更新2026/7/23
✅ 优点
- •支持数千个 LoRA 适配器同时部署
- •动态加载/卸载,资源利用率高
- •由 Predibase 团队维护,工业级可靠性
⚠️ 限制
- •仅支持 LoRA 微调模型
- •社区文档相对较少
