Gemini 3.8 & 3.8 Live Extended Thinking
Gemini 3.8 Live und 3.8 Live Extended Thinking sind Echtzeit-Sprach- und multimodale Dialogmodelle, die für paralleles Denken, Hintergrund-Tool-Aufrufe und interaktive Live-Sprach-Workflows entwickelt wurden.
Gemini 3.8 Live und 3.8 Live Extended Thinking sind Echtzeit-Sprach- und multimodale Dialogmodelle, die für paralleles Denken, Hintergrund-Tool-Aufrufe und interaktive Live-Sprach-Workflows entwickelt wurden.
Funktion und offizielle Positionierung des Produkts
Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking sind Dialogmodelle, die für Sprachinteraktionen in Nahezu-Echtzeit, visuelles Grounding und mehrstufiges Schlussfolgern konzipiert sind.
Gemini 3.8 Live konzentriert sich auf skalierbare Konversationsintelligenz mit automatischer Umschaltung zwischen 97 Sprachen, während 3.8 Live Extended Thinking simultanes paralleles Schlussfolgern, frühe verbale Signale und kontinuierliche Hintergrundberichte bietet.
Durch offizielle Quellen belegte Anwendungsfälle
Dynamische Begleitung von Onboarding-Sitzungen für Mitarbeitende durch Beantwortung von Fragen unter Nutzung von visuellem Echtzeit-Kontext.
Koordination mehrstufiger Buchungen und Ausführung von Hintergrund-Funktionsaufrufen, ohne das laufende gesprochene Gespräch zu unterbrechen.
Umwandlung handgezeichneter visueller Skizzen und gesprochener Anweisungen in funktionale React-Komponenten.
Gemini 3.8 Live Extended Thinking verhindert Unterbrechungen in Sprach-Workflows, indem es gleichzeitig schlussfolgert und spricht. Anstatt den Dialog während der Verarbeitung komplexer Anfragen anzuhalten, setzt das Modell Konversationssignale wie verbale Bestätigungen und Fortschrittserzählungen ein.
Dank der Hintergrundausführung können beide Modelle asynchron API-Aufrufe tätigen, externe Tools ausführen und mehrstufige Aktionen abwickeln. Die gesprochene Interaktion wird nahtlos fortgesetzt, während die zugrunde liegenden Aufgaben im Hintergrund abgeschlossen werden.
Prüfungen mit eigenen Inhalten und Arbeitsabläufen
Welche Quellen wann geprüft wurden
Antworten auf Basis des quellengeprüften Produkteintrags
Es schlussfolgert und spricht gleichzeitig, wobei es natürliche verbale Bestätigungen und Live-Fortschrittserzählungen nutzt, um die Unterhaltung im Fluss zu halten, während mehrstufige Aufgaben ablaufen.
Die Modelle erkennen und wechseln während des laufenden Gesprächs automatisch zwischen 97 unterstützten Sprachen, ohne dass manuelle Einstellungen angepasst werden müssen.
Allen von den Modellen generierten Audioausgaben wird ein unhörbares SynthID-Wasserzeichen eingebettet, um sicherzustellen, dass die Medien verlässlich als KI-generierte Inhalte erkennbar bleiben.
Entwickler können über die Gemini-API und Google AI Studio sowie über unterstützte Partner-Streaming-Plattformen auf beide Modelle zugreifen.
Ja, Gemini 3.8 Live verarbeitet visuelle Eingaben in Nahezu-Echtzeit, sodass das Modell Unterhaltungen auf visuellen Kontext stützen und darauf basierende Fragen beantworten kann.