PT-2026-99322 · Vllm · Vllm
CVSS v4.0
7.1
Alta
| Vetor | AV:N/AC:L/AT:N/PR:L/UI:N/VC:N/VI:N/VA:H/SC:N/SI:N/SA:N |
Nome do Software Vulnerável e Versões Afetadas
vLLM versões anteriores a 0.29.0
Description
O software falha ao aplicar a validação de comprimento do prompt do decodificador no endpoint de serviço desagregado '/inference/v1/generate'. Quando uma requisição inclui um payload multimodal 'features', o sistema constrói um EngineInput multimodal usando
token ids fornecidos pelo chamador sem verificá-los em relação ao model config.max model len. Para processadores multimodais específicos que definem skip prompt length check como verdadeiro, como Nemotron Parse, Whisper e FireRedLID, a função InputProcessor. validate prompt len() retorna imediatamente. Isso permite que um prompt excessivamente longo seja processado como um EngineCoreRequest, o que causa a falha do worker e a negação de serviço quando o lote de entrada é copiado para uma linha NumPy de largura fixa.Recommendations
Atualizar para a versão 0.29.0.
Exploit
Correção
DoS
Resource Exhaustion
Encontrou algum problema na descrição? Tem algo a acrescentar? Fique à vontade para nos escrever 👾
Enumeração de Fraquezas
Identificadores relacionados
Produtos afetados
Vllm