Gemini 3.8 & 3.8 Live Extended Thinking favicon

Gemini 3.8 & 3.8 Live Extended Thinking

Gemini 3.8 Live et 3.8 Live Extended Thinking sont des modèles de dialogue vocal et multimodal en temps réel conçus pour le raisonnement simultané, l'appel d'outils en arrière-plan et les flux de travail vocaux interactifs en direct.

ChatbotDialogue parlé simultané et…Identification automatique et…Traitement du contexte visuel pour une…Exécution asynchrone d'outils en…
Gemini 3.8 & 3.8 Live Extended Thinking product interface screenshot
Visites mensuelles estimées
8,8 M
Période des données:
Référencé sur AIToolly

Qu’est-ce que Gemini 3.8 & 3.8 Live Extended Thinking ? Présentation du produit

Fonction du produit et positionnement officiel

Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking sont des modèles de dialogue conçus pour les interactions vocales en temps quasi réel, l'ancrage visuel et le raisonnement en plusieurs étapes.

Gemini 3.8 Live se concentre sur l'intelligence conversationnelle évolutive avec un changement automatique entre 97 langues, tandis que 3.8 Live Extended Thinking offre un raisonnement parallèle simultané, des repères conversationnels précoces et une narration continue des tâches en arrière-plan.

À quoi peut servir Gemini 3.8 & 3.8 Live Extended Thinking ?

Cas d’usage étayés par les sources officielles

Intégration des employés en temps réel

Guider dynamiquement les sessions d'intégration des collaborateurs en répondant aux questions à l'aide d'un contexte visuel en temps réel.

Coordination asynchrone des réservations

Coordonner des réservations en plusieurs étapes et exécuter des fonctions en arrière-plan sans interrompre la conversation orale en direct.

Génération visuelle de code à partir d'esquisses

Transformer des croquis dessinés à la main et des instructions orales en composants React fonctionnels.

Raisonnement parallèle et exécution d'outils en arrière-plan

Gemini 3.8 Live Extended Thinking résout les interruptions dans les flux de travail vocaux en raisonnant et en parlant en même temps. Au lieu de suspendre le dialogue lors du traitement de requêtes complexes, le modèle introduit des repères conversationnels tels que des accusés de réception verbaux et la narration de l'avancement.

Les fonctionnalités d'exécution en arrière-plan permettent aux deux modèles d'effectuer des appels d'API, d'exécuter des outils externes et de gérer des actions en plusieurs étapes de manière asynchrone. L'interaction orale se poursuit ainsi sans interruption pendant la finalisation des tâches sous-jacentes.

  • Utilise des repères verbaux précoces tels que des accusés de réception pour confirmer naturellement les requêtes entrantes
  • Fournit une narration de l'avancement en direct pour expliquer les actions en plusieurs étapes au fil de leur exécution en arrière-plan
  • Maintient des conversations orales ininterrompues pendant l'exécution d'outils externes et les appels d'API

Points à tester avant de choisir Gemini 3.8 & 3.8 Live Extended Thinking

Vérifications à effectuer avec vos contenus et votre flux de travail

  • Vérifier si les langues de conversation requises sont prises en charge parmi les 97 langues détectées automatiquement.
  • Confirmer si votre organisation a accès aux programmes de préversion privée pour le déploiement de Gemini Enterprise.
  • Déterminer si les flux de travail cibles nécessitent une conversation en direct standard via 3.8 Live ou un raisonnement simultané en plusieurs étapes via 3.8 Live Extended Thinking.

Sources et date de vérification de Gemini 3.8 & 3.8 Live Extended Thinking

Sources vérifiées et date de la vérification

Dernière vérification
Catégorie
Chatbot

Questions fréquentes sur Gemini 3.8 & 3.8 Live Extended Thinking

Réponses fondées sur la fiche produit dont les sources ont été vérifiées

Comment Gemini 3.8 Live Extended Thinking gère-t-il les tâches complexes pendant un appel ?

Il raisonne et s'exprime simultanément, en utilisant des accusés de réception verbaux naturels et une narration en direct des progrès pour maintenir la fluidité de la conversation pendant l'exécution de tâches en plusieurs étapes.

Combien de langues les modèles prennent-ils en charge lors d'une conversation en direct ?

Les modèles détectent et basculent automatiquement entre 97 langues prises en charge au cours de la conversation, sans nécessiter d'ajustement manuel des paramètres.

Comment l'audio généré est-il authentifié comme provenant d'une intelligence artificielle ?

L'ensemble des flux audio générés par les modèles intègre un filigrane SynthID imperceptible afin de garantir que le média reste identifiable comme du contenu produit par une IA.

Où les développeurs peuvent-ils accéder à ces modèles vocaux ?

Les développeurs peuvent accéder aux deux modèles via l'API Gemini et Google AI Studio, ainsi que par l'intermédiaire de plateformes de streaming partenaires compatibles.

Gemini 3.8 Live peut-il traiter un contexte visuel en même temps que la voix ?

Oui, Gemini 3.8 Live traite les entrées visuelles en temps quasi réel, ce qui permet au modèle d'ancrer les conversations et de répondre aux questions en s'appuyant sur le contexte visuel.

Découvrez d’autres outils récemment ajoutés dans la même catégorie.