Kimi K3 ist ein Mixture-of-Experts-Modell mit 104 Milliarden aktiven Parametern, das Open-Weights-Modelle einer neuen Leistungsklasse zugeordnet und komplette Infrastruktur-Tools für großskalige Agententraining freigegeben hat.
Google trainiert KI-Modelle mit Bildern, Audio und Videos aus seinen Suchdiensten, wobei die Datenspeicherung an bestehende Nutzer-Aktivitätseinstellungen gekoppelt ist.
Claude ist ab sofort als produktives Angebot über Microsoft Foundry auf Azure verfügbar und integriert sich in bestehende Azure-Prozesse für Authentifizierung und Abrechnung.
Ein Framework zum Vorhersagen von Agent-Benchmark-Scores aus günstigen Einzeltests erreicht 85-prozentige Ranking-Genauigkeit bei unter 1 % der Evaluierungskosten.
CausalMix nutzt kausale Modellierung statt statischer Annahmen, um optimale Daten-Mischverhältnisse zu finden, die über unterschiedliche Datenpoolgrößen und Modellskalen generalisieren.
OpenAI stellt GPT-5.6 Sol bereit, das speziell für Schwachstellenerkennung optimiert ist und mit deutlich weniger Tokens Konkurrenzleistungen erreicht.
Check Point nutzt spezialisierte OpenAI-Modelle, um KI als festen Bestandteil seiner Sicherheitsplattform einzubauen und der KI-gestützten Bedrohungslandschaft zu begegnen.
Claude Opus 4.7 führt komplexe Robotik-Aufgaben ohne menschliche Assistenz 37-mal schneller durch als menschliche Teams ein Jahr zuvor und schreibt Code, der zumeist beim ersten Versuch funktioniert.
GLM-5.2 rangiert als führendes offenes Sprachmodell auf dem Artificial-Analysis-Index mit einem Score von 51 und belegt Platz 2 im Code-Arena-WebDev-Leaderboard, produziert aber signifikant mehr Output-Tokens als Konkurrenzmodelle.