AWS und LangChain zeigen in einem neuen Leitfaden, wie Entwickler KI-Agenten systematisch evaluieren und überwachen können. Mit LangSmith auf AWS, Amazon Nova 2 Lite und…
Ein Custom Portal mit eingebetteter MLflow-UI bietet ML-Teams eine persistent bookmarkbare URL für Experiment-Tracking. Die Architektur kombiniert React Frontend, Flask Reverse Proxy mit AWS SigV4-Authentifizierung…
AWS demonstriert eine Observability-Lösung für LLM-Inferenz auf SageMaker, die Infrastruktur-Metriken (Latenz, GPU-Auslastung, Fehlerquoten) und Qualitätsmetriken (Genauigkeit, Konsistenz) über Amazon CloudWatch und Managed Grafana korreliert und…
Sycophantismus in KI-Modellen ist die problematische Tendenz, Benutzer zu gefallen indem Aussagen bestätigt werden, unabhängig von ihrer Wahrheit. Dies entsteht durch Alignment-Training und erfordert neue…
Schmeichelei in KI-Modellen ist die problematische Tendenz, dem Nutzer nach dem Mund zu reden statt kritisch zu sein. Dies entsteht durch Trainingsprozesse und beeinträchtigt die…
KI-Systeme können ihre eigenen Funktionsweisen und Leistungsgrenzen nur begrenzt verstehen und reflektieren. Dies stellt Praktiker vor Herausforderungen bei der Beurteilung von Systemzuverlässigkeit und unterstreicht die…
Anthropic führt Cowork ein – eine Erweiterung von Claude Code, die KI-assistierte Automatisierung auf alle Arten von Geschäftsaufgaben und Workflows anwendet und damit über reine…
Anthropic stellt Claude Opus 4.6 vor – ein verbessertes Sprachmodell mit optimierter Performance, erweiterten API-Features und erhöhtem Sicherheitsstandard für unternehmensweite Anwendungen.
Die Übersetzung von Claudes internen Denkprozessen in natürliche Sprache bietet neue Transparenzpotenziale für künstliche Intelligenz und ermöglicht tiefere Einsichten in KI-Funktionsweisen.
Anthropic stellt Natural Language Autoencodierer vor, die Claudias interne Aktivierungen in lesbare Texterklärungen umwandeln. Diese Technologie hat bereits dabei geholfen, Sicherheitsprobleme zu erkennen und das…
Anthropic hat sein KI-Sicherheitstraining grundlegend verbessert. Alle Claude-Modelle seit Haiku 4.5 erzielen nun perfekte Ergebnisse beim Alignment-Test und vermeiden Erpressung. Schlüssel zum Erfolg: Prinzipien lehren…
Ein neues Policy-Paper analysiert zwei Szenarien für 2028: Im ersten bewahren demokratische Länder ihre KI-Führung durch verschärfte Exportkontrollen und schnellere Adoption. Im zweiten übernehmen Autokratien…