PT-2026-93891 · Vllm · Vllm
CVE-2026-69147
·
Publicado
2026-09-16
·
Atualizado
2026-10-01
CVSS v3.1
6.5
Média
| Vetor | AV:N/AC:L/PR:L/UI:N/S:U/C:N/I:N/A:H |
Nome do Software Vulnerável e Versões Afetadas
vLLM versões anteriores a 0.28.0
Descrição
Existe um problema onde o mecanismo falha ao orçar adequadamente a memória da GPU quando um usuário especifica um decodificador de GPU no momento da requisição. Especificamente, os corpos de requisição para Chat Completions e Responses podem definir
media io kwargs.video.video backend como pynvvideocodec. A função MediaConnector.fetch video() encaminha essa escolha para o VideoMediaIO, permitindo o uso do backend PyNvVideoCodec mesmo que a configuração de inicialização tenha selecionado um decodificador de software.Como a lógica
reserve mm ipc gpu memory() aloca memória do decodificador apenas com base na configuração estática, o backend selecionado na requisição pode criar um contexto CUDA, superfícies de decodificação e alocações de quadros decodificados que não foram contabilizadas no orçamento de KV-cache do mecanismo. Um invasor que envie requisições de vídeo para uma implantação com PyNvVideoCodec instalado pode esgotar a memória compartilhada da GPU, resultando em falhas de requisição, travamentos do worker ou negação de serviço.Recomendações
Atualize o vLLM para a versão 0.28.0 ou posterior.
Como mitigação temporária, restrinja o uso do parâmetro
video backend dentro de media io kwargs para evitar que usuários selecionem pynvvideocodec, a menos que ele tenha sido explicitamente configurado na inicialização.Exploit
Correção
Allocation of Resources Without Limits
Resource Exhaustion
Encontrou algum problema na descrição? Tem algo a acrescentar? Fique à vontade para nos escrever 👾
Identificadores relacionados
Produtos afetados
Vllm