Google entwickelt neue Methode zur LLM-Beschleunigung auf TPUs mit diffusions-inspiriertem Ansatz – dreifache Speedup durch parallele Token-Vorhersage statt sequenziellem Bottleneck.
Google führt Subagenten für Gemini CLI ein: spezialisierte KI-Agenten, die komplexe Aufgaben parallel bearbeiten und die Hauptsession effizienter machen.
Google-Forscher erzielen eine 3x schnellere LLM-Inferenz auf TPUs durch Diffusions-Style Speculative Decoding. Die neue Methode ersetzt sequenzielle durch parallele Token-Vorhersagen und überwindet damit den bisherigen…
Gemini CLI unterstützt nun spezialisierte Subagents, die komplexe Aufgaben parallel bearbeiten. Jeder Subagent hat eigene Tools und Kontextfenster, was die Hauptsitzung schneller und effizienter macht.
ADK Go 1.0 ermöglicht sichere, nachverfolgbare Multi-Agent-Systeme in Go durch OpenTelemetry-Integration, Plugin-Architektur und Human-in-the-Loop-Genehmigungen.
Googles neues Gemini Embedding 2 vereinigt Text, Bilder, Video, Audio und Dokumente in einem Embedding-Modell. Mit Unterstützung für über 100 Sprachen und der Verarbeitung mehrerer…
Google verbessert die Google Pay API mit neuen Funktionen für handelsinitiierte Zahlungen, ermöglicht bessere Kontrolle über Abonnements, aufgeschobene Zahlungen und automatische Aufladungen sowie erhöhte Transparenz…
Google startet Gemini Embedding 2, das erste multimodale Einbettungsmodell, das Text, Bilder, Videos, Audio und Dokumente in einem einheitlichen Raum verbindet. Die Lösung unterstützt über…
Google Pay API erhält neue Funktionen für von Händlern initiierte Transaktionen. Die Updates ermöglichen explizite Festlegung von Zahlungsbedingungen für Abonnements und aufgeschobene Zahlungen und bieten…
Beim Google Cloud AI Agent Bake-Off lernten Entwickler: Autonome KI-Agenten in der Produktion brauchen systematische Engineering-Disziplin, nicht nur gutes Prompt-Engineering. Prototypen und Produktion sind verschiedene…