취약점  ·  2026-09-13

vLLM — NanoNemotronVL 비디오 처리의 무제한 오디오 추출을 통한 제어되지 않은 리소스 소비

취약점Medium 영향도GlobalCVE-2026-90554
vLLM 버전 >=0.10.2 그리고 <0.28.0은 NanoNemotronVL 모델에 대한 비디오 입력에서 오디오를 추출할 때 오디오 디코드 크기 또는 지속 시간 제한을 적용하지 않습니다. nano_nemotron_vl.py에서 _extract_audio_from_videos는 max_duration_s 또는 max_decode_bytes 매개변수를 전달하지 않고 load_audio_pyav(BytesIO(video_bytes))를 호출하므로 공격자가 서버가 오디오 디코딩 중에 기가바이트 메모리를 할당하도록 강제하는 작고 고도로 압축된 비디오를 공급하여 서비스 거부를 초래할 수 있습니다.
낮은 노력의 작은 페이로드 요청이 공유 멀티모달 추론 서버의 메모리를 소진할 수 있으며, 해당 vLLM 인스턴스의 모든 사용자의 가용성을 방해합니다 — AI 추론 인프라에 대한 일반적인 증폭 DoS이며 일반 API 액세스를 넘어 인증 우회가 필요하지 않습니다.
인증된 클라이언트가 작고 고도로 압축된 비디오 파일을 멀티모달 엔드포인트에 제출합니다. 오디오 추출 경로가 크기/지속 시간 제한 없이 디코딩하여 기가바이트 규모의 메모리 할당 및 서버 충돌을 초래합니다.
vLLM >=0.10.2, <0.28.0 (NanoNemotronVL 모델 지원)
vLLM 0.28.0 이상으로 업그레이드하면, NanoNemotronVL 오디오 추출 경로에 max_duration_s/max_decode_bytes 제한이 적용됩니다.
vLLM GitHub Security Advisory GHSA-936p-m5pv-vvjfNVD
라이브 피드에서 보기 AI 보안 및 거버넌스 관련 소식을 더 살펴보세요 — 매일 아침 업데이트.
피드 열기 →