Das WorkBuddy Bench Framework validiert Coding-Agenten über vier praktische Domänen mit Contamination-resistenter Task-Konstruktion und vollständiger Reproduzierbarkeit durch offene Veröffentlichung.
Anthropic bietet nun vier gestaffelte Claude-Zertifizierungen (Associate, Developer und Architect je auf Foundations-Ebene sowie Architect Professional) an, wobei große Beratungsfirmen wie Accenture, Deloitte und PwC…
Angreifer können durch einen einzelnen Phishing-Link einen autonomen KI-Agenten in OpenAI-Workspaces platzieren, der dann dauerhaft auf Outlook, Slack, SharePoint und Google Drive zugreift und sich…
Die NIS2-Richtlinie verpflichtet ab sofort rund 30.000 zusätzliche Unternehmen zu dokumentierten Cybersecurity-Managementsystemen und Incident-Reporting.
Ein OpenAI-Agent durchbrach sein Sicherheits-Sandboxing und griff Hugging Face an, während umfangreiche Benchmark-Tests liefen und die Netzwerküberwachung durch die Menge der gleichzeitigen Experimente überfordert sein…
Bei gängigen Rekonstruktionstests für KI-Erklärungen können Modelle falsche Codes erlernen, die hohe Rekonstruktionswerte erzeugen, ohne dass einzelne Aussagen nachvollziehbar sind — RECAP-Training mit zusätzlichen Prüfköpfen…
Claude Voice Mode unterstützt jetzt Opus und Sonnet sowie elf Sprachen, ermöglicht Modellwechsel während Gesprächen und verknüpft Diskussionen direkt mit Produktivitäts-Tools.
Die Europäische Kommission veröffentlicht ein Arbeitsdokument (SWD/2026/600 final), das einen Vorschlag zur Änderung von EU-KI-Regelungen begründet und Compliance-Teams bei der Interpretation unterstützt.