Eine präparierte Nachricht genügt: Persistente KI-Agenten können dazu gebracht werden, falsche Fakten dauerhaft in ihrem Gedächtnis zu speichern und in späteren Sitzungen als Wahrheit zu behandeln. Die Angriffstechnik MemGhost zeigt, wie real dieses Risiko bereits ist.
Wie eine E-Mail das KI-Gedächtnis vergiftet

Persistente KI-Agenten unterscheiden sich von gewöhnlichen Chatbots durch ein Gedächtnis. Sie merken sich Vorlieben, Kontakte oder wiederkehrende Aufgaben und laden diese Informationen bei jeder neuen Sitzung erneut in den Modellkontext. Genau darin liegt ihr praktischer Nutzen und zugleich ein neues Risiko: Erhalten solche Assistenten Zugriff auf E-Mails, Kalender oder lokale Dateien, kann fremder, nicht vertrauenswürdiger Inhalt in einen dauerhaft vertrauten Datenbestand gelangen und dort bleiben, lange nachdem die ursprüngliche Nachricht gelöscht wurde.
Wie weit dieses Risiko bereits reicht, zeigt die Anfang Juli 2026 auf arXiv veröffentlichte Studie „When Claws Remember but Do Not Tell“. Sie beschreibt eine als Stealth Memory Injection bezeichnete Angriffsklasse und liefert mit dem Werkzeug MemGhost den ersten belastbaren Nachweis, dass ein einziger E-Mail-Payload genügt, um das Langzeitgedächtnis eines KI-Agenten gezielt und unbemerkt zu manipulieren.

Nur für Mitglieder
Dieser Beitrag ist nur für Abonnenten sichtbar
Du brauchst das it-daily Plus-Abo, um auf diesen Inhalt zuzugreifen.
Alle Fachartikel, Analysen und Recherchen
Digitales Archiv: Magazine, E-Paper und Studien
Monatlich kündbar









