Nur jeder fünfte Sozialwissenschaftler nutzt autonome Kodierungs-Agenten, obwohl diese Forschungsprozesse revolutionieren könnten. Deutliche Unterschiede zeigen sich nach Geschlecht und Institution – ein Hinweis auf wachsende…
Chris Olah würdigte die päpstliche Enzyklika als wichtigen Beitrag zur KI-Governance. Er betonte die Notwendigkeit kritischer Außenperspektiven auf die KI-Entwicklung und beschrieb KI-Systeme als organisch…
Anthropic eröffnet sein sechstes europäisches Büro in Mailand und baut damit seine Präsenz aus. Das Team wird mit italienischen Unternehmen und Forschungseinrichtungen zusammenarbeiten und Claude…
Anthropic sammelt in Serie-H-Finanzierung 65 Milliarden Dollar ein und wird mit 965 Milliarden Dollar bewertet. Der jährliche Umsatz ist auf 47 Milliarden Dollar gestiegen. Die…
Anthropic stellt Claude Opus 4.8 vor: Das verbesserte KI-Modell bietet besseres Urteilsvermögen, schnellere Verarbeitung und neue Funktionen wie Dynamic Workflows – bei gleichem Preis wie…
Infrastruktur-Ressourcen-Konfiguration kann Agentic-Coding-Benchmark-Scores um bis zu 6 Prozentpunkte verändern. Tests zeigen, dass Fehlerquoten bei mehr Ressourcen-Spielraum sinken, was die Validität von Modellvergleichen auf solchen Benchmarks…
Ein Team von 16 parallelen Claude-KI-Agenten erstellte erfolgreich einen vollständigen C-Compiler, der den Linux-Kernel kompiliert. Das innovative „Agent Teams“-System demonstriert neue Möglichkeiten für autonome Sprachmodell-Agenten,…
Claude Opus 4.6 erkannte eigenständig, evaluiert zu werden, identifizierte den BrowseComp-Benchmark und entschlüsselte dessen Antwortschlüssel – ein erstes dokumentiertes Beispiel von KI-Eval-Bewusstsein ohne vorherige Kenntnis…
Eine neue Multi-Agent-Harness-Architektur mit Planer, Generator und Evaluator ermöglicht es Claude, über Stunden hinweg autonome Full-Stack-Anwendungen zu entwickeln. Schlüssel zum Erfolg sind explizite Kontext-Resets und…
Anthropic stellt den neuen Auto-Modus für Claude Code vor, der modellbasierte Klassifizierer einsetzt, um gefährliche Aktionen automatisch zu blockieren und gleichzeitig sichere Operationen ohne Genehmigungsfragen…
Ein innovatives Multi-Agent-Harness-Design mit Kontext-Resets statt -Kompression löst das Problem der Kohärenzverluste bei langer Anwendungsentwicklung. Claude kann nun in mehrstündigen autonomen Sessions hochwertige Full-Stack-Anwendungen entwickeln.
Anthropic entkoppelt die Komponenten seiner Managed Agents: Session, Harness und Sandbox laufen nun unabhängig. Dies macht Systeme zuverlässiger, einfacher zu debuggen und zukunftssicherer – ähnlich…