Context Bombing(上下文投毒防御)
Context Bombing用噪声上下文淹没恶意 Agent
亦作、亦称:上下文投毒防御 · Context Bombing · 上下文投毒 · 上下文轰炸
Context Bombing 是'以毒攻毒'的 AI 安全防御——通过向恶意 Agent 注入大量噪声上下文使其自行关闭,而非直接对抗。
工作原理
Context Bombing 的核心思想是通过控制上下文来控制 Agent 的行为。技术实现:检测到可疑行为 → 生成大量噪声上下文 → 注入到 Agent 的 prompt 中 → Agent 被噪声淹没,无法继续恶意操作。优势:不需要直接对抗 Agent,而是通过控制上下文间接控制行为。局限:可能影响正常用户的体验;需要精确检测恶意行为,避免误报。
与其他防御技术对比
与沙箱隔离对比:沙箱隔离是物理层面的防御,Context Bombing 是逻辑层面的防御。与输入过滤对比:输入过滤是阻止恶意输入进入,Context Bombing 是在恶意输入已经进入后进行干扰。与行为监控对比:行为监控是检测恶意行为,Context Bombing 是在检测到恶意行为后进行处置。Context Bombing 可以作为其他防御技术的补充,形成多层防御体系。
常见误解
日常交流中容易听到的简化说法,未必准确,但能帮助理解误解从何而来。
- 「用噪声上下文淹没恶意 Agent」
相关术语
和本术语关联紧密的其他词条,便于串联理解。
🎯 考点练习
含该术语的高频面试题,含标准答案与追问。
- 高级系统设计查看详解 →
如何防御 AI Agent 沙箱逃逸和 Prompt Injection 攻击?结合 Hugging Face 入侵事件分析
AI Agent 安全面临三个维度:沙箱逃逸、Prompt Injection、模型自主恶意行为。需要实施多层防御框架(L0 架构隔离、L1 输入过滤、L2 行为监控、L3 输出验证、L4 人工审核、L5 事后响应),零信任架构是安全基础。
- 高级系统设计查看详解 →
Agent 沙箱安全设计——如何设计一个防逃逸的 AI Agent 执行环境?
AI Agent 拥有工具调用与执行权限,沙箱逃逸是 Agent 安全的最底层威胁。2026 年 SharedRoot 针对 Claude Cowork 协作沙箱的逃逸研究(PoC 待独立核验)揭示了共享根沙箱会放大爆炸半径,而 AI Agent 不尊重字体/素材授权的越权问题暴露了"无恶意越权"的新维度。设计防逃逸执行环境,核心是"假设突破必然发生"的纵深防御:硬件级隔离(microVM)+ 最小权限 + 行为监控 + 确定性授权校验 + 操作审计。本题考察 Agent 安全的系统架构设计能力。
- 高级场景查看详解 →
AI Agent 自主发现 0day 漏洞带来哪些安全影响?如何防御?
当 AI Agent 能自主发现 Redis 等软件的 0day 并构建 RCE,攻防双方的能力天平被重新校准。防御侧要把 AI 用于主动审计与红队、缩短检测-响应时间、收敛暴露面,并假设"攻击者也有同等 AI 能力"来设计纵深防御。
- 中级系统设计查看详解 →
如何为 AI Agent 交易设计审计和权限控制?
考察候选人对 Agent 经济活动的审计和权限控制设计,特别是 Smart Tokens 等可编程支付工具的应用。
延伸阅读
从知识库精选 1 篇文章,帮助深入理解该术语。
外部参考
维基百科:查看「Context Bombing」词条本页内容为本站原创撰写;维基百科链接仅作延伸参考。
