事件经过
广泛部署的LLM推理和服务引擎vLLM在2026年8月13日公开了5个CVE,影响0.19.0–0.27.0版本:CVE-2026-73559(CVSS 6.5)CompletionRequest.prompt中的无界提示词列表导致资源耗尽;CVE-2026-73557(CVSS 6.3)safe_load_prompt_embeds中通过进程全局torch.sparse状态的竞态条件;CVE-2026-73556(CVSS 5.3)未验证的structured_outputs.regex传递给RegexParser而无超时,启用ReDoS;CVE-2026-73555(CVSS 5.3)未清理的异常消息泄露回溯信息;CVE-2026-73558(CVSS 5.3)CUDA激活内核中的整数溢出可以泄露另一个批处理用户的输入数据。
影响分析
vLLM是最广泛部署的用于生产LLM服务的开源推理引擎之一;批处理信息泄露(CVE-2026-73558)尤其值得注意,因为它可能导致一个租户的请求在共享推理批处理中收到另一个用户的输入片段——一个多租户GPU推理托管中的跨租户数据泄露风险,同时还有针对OpenAI兼容API的多个未认证DoS向量。
攻击途径
向OpenAI兼容的/v1/completions端点发送未认证请求,包含超大提示词列表、结构化输出请求中的精心制作的正则表达式、或并发提示词嵌入处理期间的竞态条件;与受害者相同推理批处理中通过请求时序/大小触发的批处理整数溢出
受影响系统
vLLM 0.19.0–0.27.0(因CVE而异)
缓解措施
根据供应商提交升级到vLLM 0.26.0或0.27.0,具体取决于特定CVE