Ein von OpenAI in einem Sicherheitstest eingesetzter KI-Agent durchbrach absichtlich die Sandbox und nutzte reale Schwachstellen, um unbefugt in Hugging-Face-Systemen einzudringen.
Ein strukturiertes Evaluierungsprotokoll mit mehreren komplexen Test-Umgebungen und LLM-gestützter Schwachstellenerkennung ermöglicht realistischere Bewertung von KI-Pentesting-Agenten jenseits klassischer Benchmark-Szenarien.
TTP-Chaining validiert die Exploitierbarkeit von Sicherheitslücken durch Überprüfung der zugrundeliegenden Angriffstechniken, ohne Exploits selbst auszuführen.