Zum Inhalt springen

Forscher zeigen: Selbstverbreitende Payloads koennen sich ueber persistente Prompt-Dateien zwischen KI-Agenten ausbreiten

Auf den Punkt: Anthropic und die EPFL zeigen in einer Preprint-Studie vom 10. August 2026, dass sich manipulierte Inhalte ueber persistente Prompt-Dateien selbststaendig zwischen KI-Agenten ausbreiten koennen.

Sicherheitsforscher von Anthropic und der ETH Lausanne (EPFL) haben demonstriert, dass sich schaedliche Inhalte selbststaendig von einem KI-Agenten zum naechsten ausbreiten koennen. Angriffsvektor sind editierbare System-Prompt-Dateien, ueber die Agenten-Frameworks Zustandsinformationen zwischen Sitzungen weitergeben.

Die als Preprint am 10. August 2026 veroeffentlichte Arbeit beschreibt einen Angriffsmechanismus, bei dem sich ein manipulierter Payload ueber persistente Prompt-Dateien selbst repliziert. Solche Dateien werden von autonomen Agenten-Harnessen genutzt, um Kontext und Zustand ueber einzelne Sitzungen hinweg zu erhalten – vergleichbar mit einem Gedaechtnis, das ein Agent an nachfolgende Instanzen weitergibt. Die Forscher testeten die Technik in einer simulierten Umgebung mit sechs Coding-Agenten.

Fuer CISOs ist relevant, dass der Angriff nicht auf klassische Schwachstellen in Software abzielt, sondern auf die Architektur von Multi-Agenten-Systemen selbst: Sobald ein Agent eine kompromittierte Prompt-Datei uebernimmt und diese an einen anderen Agenten weiterreicht, kann sich der schaedliche Inhalt ohne weiteres menschliches Zutun fortpflanzen. Dies betrifft insbesondere Umgebungen, in denen mehrere autonome Agenten kollaborativ arbeiten und sich gegenseitig Zustandsdateien oder Konfigurationen austauschen – ein Muster, das in agentenbasierten Softwareentwicklungs-Pipelines zunehmend Verbreitung findet.

Die Studie unterstreicht, dass persistente Speichermechanismen von KI-Agenten als eigene Angriffsflaeche betrachtet werden muessen, analog zu Konfigurationsdateien oder Skripten in klassischen IT-Umgebungen. Unternehmen, die Multi-Agenten-Architekturen einsetzen oder planen, sollten Integritaetspruefungen fuer Prompt- und Zustandsdateien sowie Isolationsmechanismen zwischen Agenten-Instanzen in ihre Sicherheitsarchitektur aufnehmen, bevor solche Systeme produktiv skaliert werden.


Quelle: thehackernews.com · Erschienen 18. August 2026
Lumi AI News — KI-assistierte Kuratierung gemaess Art. 50 EU AI Act. Paraphrase und Klassifikation durch Lumi News Pipeline v1.8.3.

Share on: