Apa yang terjadi
Validation-bound mismatch antara tokenizer vocabulary length dan model output logits width dalam vLLM memungkinkan crafted token IDs untuk corrupt internal GPU sampling state.
Mengapa penting
Meski rated low severity, ini mempengaruhi widely-used vLLM engine's core sampling logic; precision dari catalogued CVE ini worth tracking bahkan pada low individual blast radius.
Vektor serangan
SamplingParams._validate_allowed_token_ids() memvalidasi supplied token IDs terhadap tokenizer length dibanding model's actual output logits width, memungkinkan out-of-range token IDs untuk pass validation dan corrupt LogitBiasState / GPU logits state.
Sistem yang terdampak
vLLM < 0.29.0
Mitigasi
Upgrade ke vLLM 0.29.0 atau lebih baru.