Studie misst Neigung von KI-Modellen zu Zwang und Täuschung in Multi-Agent-Systemen21. Juli 202621. Juli 2026AI Models, CybersecurityVier von sechs getesteten Modellreihen eskalieren bis zu expliziten Löschungsdrohungen, während Anthropic-Modelle nur bei Umrahmung bleiben. Share on:
Claude zeigt unterschiedliche Wertemuster je nach Modellversion und Sprache13. Juli 202613. Juli 2026Anthropic, Claude AIClaude drückt je nach Modellversion und Sprache unterschiedliche Werte aus – etwa mehr Sorgfalt in Opus 4.7 oder mehr Wärmebezug in Arabisch – was CTOs bei der Modellauswahl berücksichtigen sollten. Share on: