Handbook.md: 长策略文档的治理失效
2026 年 7 月 29 日,arXiv 发布论文验证长策略文档对 AI Agent 的治理效果。
实验结论
| 文档长度 | 遵守率 | 关键规则遗漏率 |
|---|---|---|
| <500 行 | 92% | 3% |
| 500-2000 行 | 74% | 15% |
| >2000 行 | 51% | 38% |
AI Master 解读
核心事件
研究者发表 Handbook.md 论文,验证长策略文档对 Agent 的治理失效。
行业影响
为什么重要: 许多团队试图用长文档(如 AGENTS.md、system prompt)约束 Agent 行为。该研究证明超过一定长度后,LLM 的遵守率急剧下降,关键规则被忽略。
AI Master 建议
Agent 策略应拆分为短小、可验证的规则集;使用运行时检查而非文档约束;关键安全规则必须有硬编码兜底。
