LLMs können durch gezielte Prompt-Attacken zu Datenlecks gezwungen werden, geben Trainingsdaten in alltäglichen Nutzungsszenarien jedoch nur mit niedriger Wahrscheinlichkeit preis.
Anthropic schlägt ein koordiniertes Moratorium für die Entwicklung hochleistungsfähiger KI-Modelle vor, um das Risiko selbstverbessernder Systeme zu minimieren.
KI-Nutzung am Arbeitsplatz führt zu kognitiver Kapitulation, bei der Mitarbeiter die kritische Überprüfung aufgeben und fehlerhafte maschinelle Ergebnisse unkritisch akzeptieren.