Kernelclint

#6040de 57,577
48.7CVSS total
Vulnerabilidades · 8
Baixa
1
Média
5
Alta
2
PT-2026-106264
6.5
2026-10-05
Vllm · Vllm · CVE-2026-105754
**Nome do Software Vulnerável e Versões Afetadas** vLLM versões anteriores a 0.30.0 **Description** No caminho de escala desagregada (disaggregated scale-out), o endpoint `/inference/v1/generate` não valida nem vincula o estado multimodal fornecido pelo chamador ao contrato do renderizador do modelo ativo. Isso permite que um invasor autenticado envie dados forjados através do objeto `features`, afetando especificamente os campos `kwargs data`, `mm hashes` e `mm placeholders`. Esta falha pode levar a vários resultados críticos: - Negação de Serviço (DoS): A forja de geometria de grade, tipos de campo ou o fornecimento de comprimentos de placeholder não positivos podem causar a falha fatal do processo EngineCore compartilhado, resultando na interrupção total do serviço para todos os locatários. - Envenenamento e Divulgação de Cache: Como os `mm hashes` (usados como chaves de cache) não estão vinculados ao payload real, um invasor que conheça ou consiga induzir o hash de conteúdo de uma vítima pode envenenar ou recuperar o estado do cache do codificador entre requisições. - Perda de Integridade: A exclusão de máscaras de placeholder esparsas durante a reprodução de renderização para geração pode alterar a semântica de transporte para modelos que dependem dessas máscaras. **Recommendations** Atualize o vLLM para a versão 0.30.0 ou posterior. Como mitigação temporária, restrinja o acesso ao endpoint `/inference/v1/generate` apenas a serviços internos confiáveis para evitar que usuários autenticados não autorizados enviem payloads multimodais forjados.
PT-2026-106269
6.5
2026-10-05
Vllm · Vllm · CVE-2026-105757
**Nome do Software Vulnerável e Versões Afetadas** vLLM versões anteriores a 0.30.0 **Description** Falhas em requisições de saída estruturada podem ignorar a validação de escopo da requisição e atingir o caminho de erro fatal do `EngineCore`, permitindo que requisições comuns de geração restrita encerrem o motor compartilhado e causem a negação de serviço para todos os locatários simultâneos e subsequentes. Isso ocorre devido à ausência de um limite de exceção por requisição no processamento de gramática e tokens de saída estruturada. Os detalhes técnicos incluem três caminhos de falha distintos: 1. Uma incompatibilidade de backend no `StructuredOutputManager` pode fazer com que uma exceção de compilação de gramática seja relançada durante a promoção do escalonador, derrubando o motor. Isso afeta o backend padrão `auto`. 2. No modo de decodificação especulativa `ngram gpu`, valores de preenchimento `-1` podem ser passados para a função `validate tokens()` no backend `guidance`. O correspondente nativo não consegue converter esse valor negativo para um tipo de token sem sinal, disparando um `OverflowError` fatal. 3. O frontend em Rust pode aceitar strings vazias em `structured outputs.json` ou `structured outputs.grammar` que o frontend em Python rejeitaria, permitindo que esses valores vazios cheguem ao motor e marquem o `EngineCore` como morto. **Recommendations** Atualize o vLLM para a versão 0.30.0. Como mitigação temporária, evite usar o backend `guidance` em combinação com a decodificação especulativa `ngram gpu`. Restrinja o uso do frontend em Rust ou garanta que os parâmetros `structured outputs.json` e `structured outputs.grammar` não sejam enviados como strings vazias.