À propos du projet
OWASP Agent Memory Guard (AMG) est un projet OWASP Incubator officiellement reconnu qui assure une défense à l'exécution contre l'empoisonnement de la mémoire dans les agents IA. Il traite la catégorie de menace OWASP ASI06 (Memory & Context Poisoning) en se plaçant entre un agent et son magasin de mémoire, en filtrant chaque opération d'écriture via un pipeline de détecteurs et un moteur de politiques déclaratif.
La bibliothèque offre plusieurs capacités principales : des lignes de base d'intégrité SHA-256 pour signaler toute altération de clés immuables ; des détecteurs intégrés pour l'injection de prompt, la fuite de secrets/données personnelles, les modifications de clés protégées, les anomalies de taille et les boucles d'auto-renforcement ; des politiques définies en YAML qui associent les constats à des actions telles que allow, redact, quarantine ou block ; une forensique SecurityEvent structurée avec des instantanés ponctuels pour la restauration ; et un suivi de provenance par classe de source pour la corrélation SIEM.
AMG est livré avec des intégrations pour LangChain (y compris un GuardedChatMessageHistory et un package middleware pour protéger les entrées, sorties et sorties d'outils du modèle), OpenAI Agents SDK, AutoGen, mem0 et CrewAI. Il s'exécute localement sans clés API ni appels externes, avec une latence médiane rapportée de 59 microsecondes.
Le projet inclut également l'Agent Memory Security Benchmark (AMSB), un tableau de bord neutre vis-à-vis des frameworks qui évalue tout système de mémoire sur l'ensemble du cycle de vie de l'empoisonnement, y compris la survie des charges utiles aux réinitialisations de contexte. AMG se soumet lui-même à l'évaluation via le même adaptateur et le même corpus que les autres entrées.
Les résultats de benchmark publiés contre 55 charges utiles d'attaques réelles montrent un taux de détection de 92,5 %, une précision de 100 %, un taux de faux positifs de 0 % et un score F1 de 0,961 sur quatre catégories de menaces : injection de prompt, altération de clés protégées, fuite de données sensibles et anomalies de taille.
Le projet est sous licence Apache-2.0, créé et dirigé par Vaishnavi Gudur avec Anshul Rajkumar comme co-responsable, et est référencé dans la mitigation MITRE ATLAS Memory Hardening comme implémentation open source de contrôles de durcissement de la mémoire.
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.