PT-2026-99322 · Vllm · Vllm

·

CVE-2026-100651

·

Publicado

2026-09-26

·

Atualizado

2026-09-26

CVSS v4.0

7.1

Alta

VetorAV:N/AC:L/AT:N/PR:L/UI:N/VC:N/VI:N/VA:H/SC:N/SI:N/SA:N
Nome do Software Vulnerável e Versões Afetadas vLLM versões anteriores a 0.29.0
Description O software falha ao aplicar a validação de comprimento do prompt do decodificador no endpoint de serviço desagregado '/inference/v1/generate'. Quando uma requisição inclui um payload multimodal 'features', o sistema constrói um EngineInput multimodal usando token ids fornecidos pelo chamador sem verificá-los em relação ao model config.max model len. Para processadores multimodais específicos que definem skip prompt length check como verdadeiro, como Nemotron Parse, Whisper e FireRedLID, a função InputProcessor. validate prompt len() retorna imediatamente. Isso permite que um prompt excessivamente longo seja processado como um EngineCoreRequest, o que causa a falha do worker e a negação de serviço quando o lote de entrada é copiado para uma linha NumPy de largura fixa.
Recommendations Atualizar para a versão 0.29.0.

Exploit

Correção

DoS

Resource Exhaustion

Encontrou algum problema na descrição? Tem algo a acrescentar? Fique à vontade para nos escrever 👾

Enumeração de Fraquezas

Identificadores relacionados

CVE-2026-100651
GHSA-3MQX-F33V-VGP9

Produtos afetados

Vllm