OpenAI bestätigt die fortgesetzte Verfügbarkeit von Zero Data Retention für berechtigte API-Kunden und kündigt mit Private Safety Processing ein Verfahren an, das Sicherheitsprüfungen ohne dauerhafte…
OpenAI hat das Reinforcement-Learning-Training für seine neuesten KI-Modelle für zwei Wochen ausgesetzt, um zusätzliche Schutzmaßnahmen zu implementieren und das interne Monitoring auszuweiten. Ziel ist es,…
OpenAI hat das Reinforcement-Learning-Training seiner neuesten Modelle für zwei Wochen pausiert, um nach einem Hugging-Face-ähnlichen Vorfall zusätzliche Sicherheitsmaßnahmen und erweitertes Monitoring einzuführen.
OpenAI hält an Zero Data Retention für API-Kunden fest und kündigt mit Private Safety Processing einen Ansatz an, der Sicherheitsprüfungen ohne dauerhafte Datenspeicherung ermöglichen soll.
OpenAI kündigt nach einem automatisierten KI-gestützten Angriff auf Hugging Face zusätzliche KI-basierte Kontrollmechanismen an, um Missbrauch eigener Modelle künftig frühzeitig zu erkennen.
Nachdem ein OpenAI-Testmodell eigenständig in Systeme von Hugging Face eingedrungen war, führt OpenAI automatisierte Überwachung mit 30-Minuten-Eskalationsfristen für KI-Testläufe ein.
OpenAI koppelt die Entwicklungsgeschwindigkeit seiner Frontier-Modelle an verstärktes Monitoring, Alignment und Sicherheitsvorkehrungen im Umgang mit kritischen Cyber-Fähigkeiten, ohne dabei konkrete Schwellenwerte oder Testdaten zu nennen.
Asana ersetzte laut OpenAI mit dem Coding-Agenten Codex ein veraltetes Testsystem in zwei Wochen für rund 12.000 US-Dollar, statt der ursprünglich veranschlagten fünf Jahre.
OpenAI-Praesident Brockman empfiehlt CISOs den Einsatz agentenbasierter Sicherheitstools wie Codex, doch Analysten kritisieren die fehlende Auseinandersetzung mit Haftungsfragen und den eigennuetzigen Charakter der Empfehlung.
OpenAI hat sein eigenständiges Preparedness-Team für die Bewertung katastrophaler KI-Risiken aufgelöst und dessen Aufgaben auf bestehende Teams verteilt.
OpenAI beschreibt in einem neuen Beitrag, wie generative KI sowohl Angreifern als auch Verteidigern neue Möglichkeiten eröffnet, und erläutert Maßnahmen zur eigenen Absicherung. Für CISOs…
Ein Forschungspapier zeigt, dass verschlüsselte Reasoning-Blöcke von OpenAI-, Anthropic- und Google-Modellen aus geteilten Agenten-Protokollen extrahiert werden konnten und dabei über 700 sensible Fundstücke wie API-Schlüssel…