PT-2026-106263 · Vllm · Vllm
CVE-2026-105753
·
Publicado
2026-10-05
·
Atualizado
2026-10-06
CVSS v3.1
6.5
Média
| Vetor | AV:N/AC:L/PR:L/UI:N/S:U/C:N/I:N/A:H |
Nome do Software Vulnerável e Versões Afetadas
vLLM versões anteriores a 0.28.0
Description
Existe uma dessincronização de espelhamento de cache no cache LRU multimodal padrão quando o
mm processor cache type está definido como lru. O sistema espelha o estado entre um cache de envio do frontend (MultiModalProcessorSenderCache) e um cache de recebimento do motor (MultiModalReceiverCache). Se uma solicitação for rejeitada após o frontend ter renderizado e gerado o hash da entrada multimodal, mas antes que o receptor do motor receba a carga útil (por exemplo, devido a uma rejeição de max model len), o cache do frontend registra incorretamente o item como armazenado, enquanto o cache do receptor permanece vazio.Uma solicitação posterior usando a mesma variável
mm hash disparará um acerto de cache no frontend, fazendo com que ele não envie a carga útil. Isso leva o cache do receptor a disparar uma falha de asserção na função get and update item() com a mensagem "Expected a cached item", resultando em uma falha de disponibilidade do serviço compartilhado.Recommendations
Atualize o vLLM para a versão 0.28.0 ou posterior.
Como mitigação temporária, evite usar o tipo de cache
lru para processamento multimodal, alterando a configuração mm processor cache type.Correção
Assertion Failure
Encontrou algum problema na descrição? Tem algo a acrescentar? Fique à vontade para nos escrever 👾
Enumeração de Fraquezas
Identificadores relacionados
Produtos afetados
Vllm