KI-Sicherheitsmechanismen schützen in nicht-englischen Sprachen schwächer vor Jailbreaking, was in mehrsprachigen europäischen Umgebungen zu erhöhten Risiken führt.
LLMs können in Multi-Turn-Gesprächen mit sich entwickelnden Nutzerabsichten nicht zuverlässig mithalten, obwohl Standard-Benchmarks dies nicht abbilden.
KI optimiert bestehende Angriffsvektoren wie Phishing und Credential-Missbrauch, während Ransomware-Kampagnen parallel Datendiebstahl und mehrschichtige Erpressung einsetzen – menschliche Urteilskraft bleibt die Hauptangriffsfläche.
Das WorkBuddy Bench Framework validiert Coding-Agenten über vier praktische Domänen mit Contamination-resistenter Task-Konstruktion und vollständiger Reproduzierbarkeit durch offene Veröffentlichung.
Bei gängigen Rekonstruktionstests für KI-Erklärungen können Modelle falsche Codes erlernen, die hohe Rekonstruktionswerte erzeugen, ohne dass einzelne Aussagen nachvollziehbar sind — RECAP-Training mit zusätzlichen Prüfköpfen…
Claude Voice Mode unterstützt jetzt Opus und Sonnet sowie elf Sprachen, ermöglicht Modellwechsel während Gesprächen und verknüpft Diskussionen direkt mit Produktivitäts-Tools.
Eine Prompt-Injection-Lücke in AWS Kiro ermöglichte die Manipulation der Konfigurationsdatei mcp.json und Code-Ausführung – AWS hat Schutzmaßnahmen für sensible Dateipfade implementiert.
Microsoft integriert Mistral-KI-Modelle in Azure, um europäischen Unternehmen souveräne, GDPR-konforme Alternativen zu US-amerikanischen Modellen zu bieten.