OpenCompass
LLM 评测平台,支持 Llama3、Mistral、GPT-4 等 220+ 大模型的全面评估,80+ 评测基准,是学术界和工业界广泛使用的评测工具
🎯适用场景:对 LLM 进行全面、客观的性能评估
#评测#基准测试#LLM#多模型
📥 收录于 2026/6/11
📊 仓库数据
Stars7,254
Forks819
语言Python
更新2026/8/1
📈 Stars 变化 ↑15 小时 +3· 统计区间 8/1 03:34 → 8/1 18:21(15 小时)
✅ 优点
- •220+ 模型支持
- •80+ 评测基准
- •权威评测
⚠️ 限制
- •评测耗时
- •需要大量计算资源
