vLLM v0.26.0 安全补丁:修复 4 个 CVE,含跨用户数据泄露和 SSRF
vLLM v0.26.0 修复 4 个安全漏洞:CVE-2026-73558(act_and_mul_kernel 整数溢出导致批量推理跨用户数据泄露,CVSS 5.3)、CVE-2026-73560(MiMoV2 多模态处理器绕过 MediaConnector 的 SSRF + 任意文件读取,CVSS 6.5)、CVE-2026-73559(无界补全提示列表导致 DoS,CVSS 6.5)、CVE-2026-71486(derender 端点资源耗尽)。所有漏洞已在 v0.26.0 修复。
vLLM v0.26.0 安全补丁
vLLM 推理引擎 v0.26.0 批量修复 4 个安全漏洞,涉及跨用户数据泄露、SSRF、DoS 和资源耗尽,是该项目迄今规模最大的一次安全集中修复。
事件背景
vLLM 是当前部署量最大的开源 LLM 推理引擎之一,被大量多租户推理服务、模型网关和 Agent 平台采用。本次 4 个漏洞由安全研究者通过 GitHub Security Advisories 私有披露流程提交,覆盖从底层 CUDA kernel 到上层 HTTP 端点的多个攻击面。vLLM 团队在 v0.26.0 中集中修复并同步发布安全公告,建议所有生产部署立即升级。
漏洞详情
| CVE | 类型 | CVSS | 描述 |
|---|---|---|---|
| CVE-2026-73558 | 数据泄露 | 5.3 | act_and_mul_kernel 整数溢出导致批量推理跨用户数据泄露 |
| CVE-2026-73560 | SSRF | 6.5 | MiMoV2 多模态处理器绕过 MediaConnector,可读取任意文件 |
| CVE-2026-73559 | DoS | 6.5 | 无界补全提示列表导致资源耗尽 |
| CVE-2026-71486 | 资源耗尽 | - | derender 端点接受调用者提供的 GenerateResponse 对象导致资源耗尽 |
关键风险点
- 跨用户数据泄露:多租户推理场景下,一个用户的输出可能包含另一用户的数据,根因是 act_and_mul_kernel 的整数溢出
- SSRF + 文件读取:多模态处理器的 MediaConnector 绕过可访问任意本地文件,MiMoV2 用户尤其需要关注
- DoS 攻击面:无界列表和 derender 端点可被利用耗尽服务资源
影响范围
- CVE-2026-73558:所有使用批量推理的多租户部署
- CVE-2026-73560:使用 MiMoV2 多模态处理器的部署
- CVE-2026-73559:所有暴露补全 API 的部署
- CVE-2026-71486:暴露 derender 端点的部署
修复建议
- 立即升级到 v0.26.0
- 审查多租户部署的隔离策略
- 禁用或限制 derender 端点
- 关注 MiMoV2 多模态处理的安全加固
AI Master 解读
核心事件
vLLM v0.26.0 修复 4 个安全漏洞,包括跨用户数据泄露和 SSRF。
行业影响
为什么重要: vLLM 是主流 LLM 推理引擎,批量推理场景下的跨用户数据泄露直接影响多租户部署安全。CVE-2026-73558 的根因是 act_and_mul_kernel 的整数溢出,这类底层内核漏洞在推理引擎中较为罕见。SSRF 漏洞允许攻击者通过多模态输入读取服务器任意文件。
影响分析:
| CVE | 类型 | CVSS | 影响 |
|---|---|---|---|
| CVE-2026-73558 | 跨用户数据泄露 | 5.3 | 批量推理场景 |
| CVE-2026-73560 | SSRF + 文件读取 | 6.5 | MiMoV2 多模态 |
| CVE-2026-73559 | DoS | 6.5 | 补全提示列表 |
| CVE-2026-71486 | 资源耗尽 | - | derender 端点 |
风险边界: 低版本用户需立即升级;多租户部署尤其需要关注 CVE-2026-73558;MiMoV2 用户需关注 CVE-2026-73560;derender 端点暴露面需评估。
AI Master 建议
立即升级到 v0.26.0;审查多租户部署的隔离策略;禁用或限制 derender 端点;关注 MiMoV2 多模态处理的安全加固。 **来源:** GitHub Security Advisories **链接:** https://github.com/vllm-project/vllm/security/advisories/GHSA-7m6h-x95x-82q5
