Google hat die neuen Sprachmodelle Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking vorgestellt, die für Echtzeit-Audiodialoge und Voice Agents optimiert sind. Diese Modelle sind ab sofort über die Gemini API und Google AI Studio verfügbar und sollen schrittweise in Google-Diensten integriert werden.
Das Basismodell Gemini 3.8 Live unterstützt 97 Sprachen und kann Text-, Bild-, Audio- und Videoeingaben verarbeiten. Die Extended-Thinking-Variante ist für komplexe Aufgaben mit mehrstufigem Reasoning konzipiert und ermöglicht asynchrone Funktionsaufrufe während der Konversation.