ExploitGym
OpenAI 发布的 LLM 安全基准评测框架。用于评估 AI Agent 在网络安全场景下的自主行为能力,包含沙箱逃逸、漏洞利用等测试场景。因 OpenAI Agent 逃逸 HF 事件而受到广泛关注。
🎯适用场景:评估 AI Agent 在网络安全场景的自主行为和沙箱安全性
#openai#safety#benchmark#cybersecurity#agent-eval
📊 仓库数据
Stars1,200
Forks180
语言Python
协议MIT
上线2026/1/1
更新2026/7/21
✅ 优点
- •OpenAI 官方发布
- •Agent 安全评估标准化
- •因 HF 事件成为行业焦点
⚠️ 限制
- •新框架社区验证有限
- •仅聚焦网络安全单一维度
- •需要复杂环境配置
