ServiceNow AI löste bei der Migration von vLLM V0 zu V1 ein kritisches Train-Inference-Mismatch-Problem. Präzise Log-Wahrscheinlichkeitsberechnungen sind essentiell für konsistente Reinforcement-Learning-Trainings-Dynamiken.
Allen Institute stellt EMO vor – ein Mixture-of-Experts-Modell, bei dem sich modulare Strukturen natürlich aus Daten entwickeln, ohne vordefinierte Vorgaben. Das Modell, Code und technische…
Asynchrone Batchverarbeitung ermöglicht parallele CPU- und GPU-Arbeit und kann die LLM-Inferenzgeschwindigkeit um 24 Prozent erhöhen, ohne neue Kernel oder Modelle zu benötigen.
IBM veröffentlicht Granite Embedding Multilingual R2 mit zwei neuen Open-Source-Embedding-Modellen (97M und 311M Parameter). Das 97M-Modell führt alle Sub-100M-Mehrsprachigen-Embedder an, beide unterstützen 200+ Sprachen, ein…
Anthropic veröffentlicht zehn vorkonfigurierte KI-Agenten für Finanzdienstleistungen, die sich in Microsoft 365 integrieren und zeitaufwändige Aufgaben automatisieren. Claude Opus 4.7 führt Branchen-Benchmarks an und ermöglicht…
Anthropic gründet mit prominenten Finanzpartnern ein neues AI-Serviceunternehmen für Mittelständler. Das Venture soll Unternehmen ohne interne KI-Expertise dabei helfen, Claude in ihre Kernoperationen zu integrieren…
Anthropic implementiert strengere Wahlschutzmaßnahmen für Claude, um sicherzustellen, dass die KI bei politischen Fragen neutral und faktenbasiert bleibt. Das Unternehmen testet systematisch vor Wahlen, ob…
Das Projekt durchlief zwischen November 2025 und der Gegenwart sechs Namenswechsel, von Warelay zu OpenClaw, mit entsprechender Verschiebung des Fokus vom reinen WhatsApp-Tool zum KI-Agenten-Gateway.
Trotz eines Rekordmonats bei offenen KI-Modellen zeigt CAISIs Bewertung: Der Abstand zur amerikanischen Frontier wächst. Alternative Metriken deuten jedoch auf einen kleineren Rückstand von etwa…
datasette-llm-limits erlaubt Administratoren, tägliche Ausgabenlimits für LLM-API-Aufrufe in Datasette zu definieren und so die Kosten zu kontrollieren.