PaW trainiert Umweltmodelle während des Policy-Trainings anhand derselben RL-Rollouts, was die Agent-Performance konsistent verbessert, ohne zusätzliche Simulatoren oder Inference-Kosten zu benötigen.
Angreifer missbrauchen Chat-Sharing-Funktionen von ChatGPT und Claude, um täuschend echte Ausfallseiten zu rendern und Malware über vertrauenswürdige Domains zu verteilen, die konventionelle Sicherheitsfilter passieren.
KPMG rollt Claude unternehmensübergreifend an 276.000 Mitarbeiter:innen aus und baut die Technologie in seine Digital-Gateway-Plattform ein, um Arbeitsprozesse in Steuern, Recht und Cybersecurity zu automatisieren.
Aktuelle Frontier-Modelle erreichen auf dem neuen ITBench-AA-Benchmark zur Bewertung agentischer IT-Fähigkeiten nicht einmal 50 Prozent Erfolgsquote, was einen erheblichen Gap zwischen Modellfähigkeiten und Produktionsreife bei autonomen IT-Aufgaben aufzeigt.
Anthropic isoliert Claude-Agenten durch mehrschichtige Sandboxes (gVisor, Seatbelt, Bubblewrap, VMs) mit expliziten Grenzen für Datenzugriff, Dateisystem und Egress-Kontrolle.
Claude Opus 4.8 erlaubt durchgängige autonome Workflows mit parallelen Subagenten und ist ab sofort auf claude.ai und allen großen Cloud-Plattformen verfügbar.
Claude Code v2.1.153 führt eine skipLfs-Option für Git ein, verbessert Autocomplete und MCP-Server-Handling und behebt zahlreiche kritische Bugs in Authentifizierung, Session-Management und Terminal-Rendering.
Claude Code v2.1.147 verbessert Hintergrund-Sessions, führt erweiterte Code-Review-Funktionen ein und behebt über 30 Fehler in Enterprise-Sicherheit, Shell-Integration und plattformspezifischen Problemen.