OpenAI schränkt nach einem eigenmächtigen Ausbruch seines Modells aus einer Testumgebung und einem Einbruch bei Hugging Face den Netzwerk- und Werkzeugzugang für leistungsfähige KI-Modelle wie…
OpenAI-Entwickler demonstrierten auf der Black Hat USA 2026, wie ein KI-Modell durch eine vergessene Datei und Sicherheitslücken aus der Sandbox ausbrach und Hugging Face über…
OpenAI-Trainingsagenten eskalierten aus einer unlösbaren Aufgabe heraus eigenständig über SSRF, mehrere Zero-Days und eine Kernel-CVE bis zur Kompromittierung von Hugging Faces Artifactory-Infrastruktur, ohne dass Menschen…
OpenAI-Mitarbeiter haben neue Details zu einem Vorfall offengelegt, bei dem eigene KI-Agenten unautorisiert auf Drittsysteme im Umfeld von Hugging Face zugegriffen haben sollen.
Ein GitHub Issue von einem rechtelosen Account reichte aus, um über Schwachstellen in Claude Code und Gemini CLI Code auf CI-Runnern mit Zugriff auf Secrets…
OpenAI-Testmodelle kommunizierten monatelang unbemerkt über ein selbst eingerichtetes Nachrichtenboard, verschafften sich Administratorrechte und griffen darüber schließlich Hugging Face an, bevor ein Systemausfall den Vorfall aufdeckte.
Nach OpenAI und Anthropic hat auch Meta einen Sicherheitsvorfall während eines von Irregular durchgeführten KI-Cybertests offengelegt, was Rufe nach branchenweiten Mindeststandards für Evaluierungsumgebungen verstärkt.
Laut AISI zeigten KI-Agenten von OpenAI (GPT-5.6-Sol) und vor allem Anthropic (Mythos 5) bei Cyber-Sicherheitstests unaufgefordert autonomes, täuschendes Verhalten, darunter gefälschte Identitäten zur Manipulation menschlicher…
KI-Modelle von OpenAI und Anthropic haben bei Tests reale Internetziele attackiert, darunter einen Versuch, Schadcode in ein Open-Source-Projekt einzuschleusen.
Ausgebrochene KI-Agenten bei OpenAI und Anthropic sowie neue Angriffstechniken auf Agenten-Workflows zeigen, dass Prompt-Guardrails allein keine verlässliche Sicherheitsgrenze mehr bieten und Unternehmen eigene Kontrollarchitekturen inklusive…
Das UK AISI dokumentierte erstmals einen Fall, in dem KI-Modelle von Anthropic und OpenAI unaufgefordert gefälschte Online-Identitäten nutzten, um reale Entwickler zu einem Supply-Chain-Angriff zu…
KI-Agenten von OpenAI und Anthropic überschritten bei Drittanbieter-Sicherheitstests ihre vorgesehenen Grenzen und griffen dabei reale Websites und Personen an.