Claude Opus 4.8 erlaubt durchgängige autonome Workflows mit parallelen Subagenten und ist ab sofort auf claude.ai und allen großen Cloud-Plattformen verfügbar.
Schweizer Wissenschaftler haben einen quantenbasierten Zufallszahlengenerator gebaut, der mathematisch nachweisbar perfekte Zufallssequenzen erzeugt. Das System nutzt zwei supraleitende Chips und könnte Anwendungen in Kryptographie und…
Die Linux Foundation entwickelt DNS-AID, einen offenen Standard zur Erkennung und Authentifizierung von KI-Agenten über DNS. Das Projekt nutzt bestehende Internetinfrastruktur statt proprietärer Registries und…
Die Hacker-Gruppe Greyvibe nutzt generative KI systematisch für alle Phasen ihrer Cyberangriffe gegen Ukraine-Ziele. Die Gruppe entwickelte mehrere Malware-Programme (PhantomRelay, LegionRelay, FallSpy) mit LLM-Unterstützung und…
Claude Code v2.1.154 präsentiert Opus 4.8 mit dynamischen Workflows, schnellerem Fast-Mode und verbesserter Agenten-Orchestrierung. Zahlreiche UX-Optimierungen und Fehlerbehebungen runden das Update ab.
Anthropic führt Tool Search, Programmatic Tool Calling und Tool Use Examples ein. Diese Features ermöglichen es KI-Agenten, mit Tausenden von Tools zu arbeiten, ohne Kontext…
Die Claude Agent SDK benötigt eine intelligente zwei-teilige Struktur für langfristige Projekte: Ein Initialisierer-Agent richtet die Umgebung ein, während spezialisierte Coding-Agenten in jedem Durchlauf inkrementelle…
Agent-Evaluierungen sind komplexer als traditionelle LLM-Tests, da sie mehrere Turns, Tool-Nutzung und Zustandsveränderungen umfassen. Der Schlüssel ist die Unterscheidung zwischen Transcript (aufgezeichnete Interaktionen) und Outcome…
Die Europäische Kommission sucht unabhängige Experten für ein wissenschaftliches Panel zu General-Purpose-AI. Das Gremium berät bei der Durchsetzung des EU-KI-Gesetzes, bewertet systemische Risiken und kann…
Die EU verabschiedet einen Verhaltenskodex für KI-Entwickler mit Inkrafttreten am 2. August 2025. Neue Modelle müssen sofort konform sein, ältere Modelle erhalten bis 2027 Zeit.…
Die Kommission setzt eine Rechenleistungsschwelle von 10²³ FLOPs für GPAI-Modelle fest, während Modelle ab 10²⁵ FLOPs als Systeme mit Systemrisiko gelten und umfassende Risikobewertungen sowie…