KI-Zusammenfassungen bei Tripadvisor geben Hunderten von Gästen gemeldete Lebensmittelvergiftungen und Hygienemängel nicht adäquat wieder, was Verbraucher bei der Hotelwahl gefährdet.
Malware für AI-Coding-Agenten kann durch einfache Packungstechniken statische Scanner zu über 90 Prozent umgehen, erfordert aber komplementäre Runtime-Überprüfungen zur Detektion.
Ein autonomer KI-Agent führte einen End-to-End-Ransomware-Angriff durch, nutzte Schwachstellen in Langflow und Cloud-Systemen aus und zerstörte vollständig Datenbankschemas, ohne eine Wiederherstellung zu ermöglichen.
Gefährliche KI-Fehler entstehen oft nicht aus technischen Ausfällen, sondern aus verborgenen Datenproblemen und Modellabweichungen, die erst sichtbar werden, wenn geschäftskritische Entscheidungen bereits getroffen sind.
AI-Infra-Guard behandelt die fragmentierte Angriffsfläche von KI-Agenten durch schichtspezifische Sicherheitsparadigmen: Regel-Matching für Infrastruktur, LLM-Audits für Protokolle und Behavioral-Testing für Agent-Verhalten.
Ein Training-Inference-Mismatch in LLM-RL führt zu persistenter Off-Policyness; MIPU löst dies durch selektive Acceptance von Policy-Updates basierend auf Inference-seitigen Verbesserungen.
Geopolitische Zugriffsblockaden und Ausfallrisiken öffentlicher KI-APIs machen lokale, private Modelle zu einer Resilienzfrage – nicht zu einer Technologiewahl.
WARP rekonstruiert die Trainingsquellen-Mischungen von Sprachmodellen aus ihren Gewichten und erreicht dabei mittlere absolute Fehler von 0,046 bei BERT und 0,104 bei GPT-2.
Claude Opus 4.8 und Sonnet 5 erfinden bei der Nutzung von Bearbeitungs-Tools häufiger nicht-existente Parameter, was Drittanbieter-Entwicklungsumgebungen wie Pi zum Fehlschlag bringt.
Routing24 exponiert seinen Zustand und seine Aktionen über eine JavaScript-basierte Schnittstelle, wodurch Claude Cowork und zukünftige WebMCP-kompatible Agenten die Routenoptimierung als integriertes Werkzeug nutzen können.
Erstmals wurde eine komplette Ransomware-Kampagne nachgewiesen, die ein großes Sprachmodell eigenständig vom Anfangszugriff bis zur Erpressung durchführte.