RLLM
LLM 强化学习开源框架,致力于降低强化学习应用于大语言模型的门槛,支持分布式训练、编码 Agent、搜索 Agent 等多种场景,是 verl 生态的重要组成部分。
🎯适用场景:LLM强化学习与奖励模型训练,适合研究型团队探索Agent自主学习能力
#强化学习#LLM训练#RL#分布式训练#Agent
📊 仓库数据
Stars5,727
Forks593
语言Python
协议Apache-2.0
更新2026/7/24
📈 Stars 变化 ↑11 小时 +3· 统计区间 7/24 12:26 → 7/24 23:22(11 小时)
✅ 优点
- •专为LLM强化学习设计的开源方案
- •支持分布式训练扩展
- •verl生态集成度高
- •Apache 2.0许可可商用
⚠️ 限制
- •需要强化学习领域知识
- •大规模训练需要较多GPU资源
