Dans l'actualité
Utility Under Attack: Agent Memory Poisoning and the Limits of Content Screening and Provenance Ranking
arXiv cs.AI · Publié le · 3 min de lecture
En 30 secondes
- Ce qui s'est passé
- Poisoning just 1.2% of an AI agent's stored memory with false statements drops accuracy from 85% to 30%, and content screening fails to detect it.
- Pourquoi ça compte
- Relevant for engineers building systems with persistent memory or retrieval-augmented generation that store and reuse information across sessions.
- Vigilance
- Current defenses like content screening and provenance weighting either fail completely or force unusable tradeoffs between blocking poison and allowing legitimate untrusted sources.
Écouter ce résumé
- agent
- retriever
- prompt
- prompt injection
- eval
Les patterns derrière cette actualité
Chacun explique le fonctionnement de la technique, quand elle vaut son coût et où elle casse.
The Agent Architect
Un pattern, un compromis, une panne de production racontée. Un brief hebdomadaire court pour ceux qui construisent des systèmes agentiques.
Un email par semaine, désinscription en un clic. Votre adresse ne sert qu'à envoyer le brief.