LATIDIA · Ciberseguridad
La similitud no es válida: defender los cachés semánticos de LLM contra el envenenamiento
arXiv:2609.35908v1 Anuncio Tipo: nuevo Resumen: Las cachés semánticas reducen los costos de servicio de LLM al reutilizar respuestas generadas previamente para consultas semánticamente similares. Sin embargo, la recuperación se basa únicamente en la incrustación de similitudes.
WhatsApp ↗Telegram ↗
La noticia
arXiv:2609.35908v1 Announce Type: new Abstract: Semantic caches reduce LLM serving costs by reusing previously generated answers for semantically similar queries. However, retrieval is based solely on embedding similarity between the incoming query and cached queries. This design enables cache poisoning: an attacker can cache a malicious response under a query with high cosine similarity to benign requests. The vulnerability stems from a gap between retrieval similarity and answer validity. From an information-bottleneck perspective, query embeddings can lose information needed to distinguish valid from invalid cache hits, which limits any matching algorithm that uses only these embeddings. We propose a novel defense that recovers this necessary information from the raw text