Tous les modèles
Google

Gemini 3.8 Live Extended Thinking

Un modèle vocal Gemini distinct qui traite les demandes complexes en arrière-plan tout en poursuivant la conversation.

Présentation de l'anglais simple

Qu'est-ce que Gemini 3.8 Live Extended Thinking ?

Extended Thinking associe parole en direct, planification et utilisation d’outils en arrière-plan. Il peut annoncer sa progression pendant une demande en plusieurs étapes, avec des niveaux de réflexion faible, moyen ou élevé.

Ses limites d’entrée et de sortie sont identiques à celles de Gemini 3.8 Live. Google affiche les mêmes tarifs par token pour les deux, mais le raisonnement supplémentaire peut accroître la consommation. GPT-Live 1 délègue plutôt les tâches approfondies à un agent backend choisi séparément.

Bon ajustement pour

  • Parcours d’assistance vocale en plusieurs étapes
  • Assistants vocaux de planification et de recherche
  • Agents qui expliquent leur progression pendant les appels d’outils

Comparaison des catégories

Les faits importants pour les modèles voix

Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.

Base de prix
Audio 0,005 $/min en entrée · 0,018 $/min en sortiePrix basé sur un jeton, un caractère ou une minute pour l'itinéraire d'accès répertorié.
Mode d'interaction
Voix à voix avec entrée visuelle et raisonnement en arrière-planComportement parole-parole, audio-audio ou synthèse vocale en streaming.
Latence publiée
Non publiéMesure publiée par le fournisseur avec ses exclusions indiquées ; pas un test Cody.
Langues
Multilingue ; vérifier la prise en charge actuelle de l'API LiveCouverture linguistique documentée par le fournisseur ou marqueur clair non publié.
Outils et contrôle
Fonctions asynchrones uniquement, ancrage via la rechercheFonctionnalités natives d’appel de fonctions, de raisonnement ou de contrôle vocal.
Contexte ou limite d'entrée
131 072 entrées · 65 536 sortiesLimite de jetons ou de caractères documentée lorsque cela est significatif.

Accès API et fournisseur

Où obtenir Gemini 3.8 Live Extended Thinking

Disponibilité

Régions et étape d'accès

Disponible via Gemini Live API et Google AI Studio dans les régions prises en charge.

Utilisez la liste des régions disponibles en direct de Google et vérifiez les restrictions de fonctionnalités pour l'itinéraire sélectionné.

Vérifier la disponibilité en direct

Données et formation

L'itinéraire compte.

Google indique que les invites et réponses Gemini API payantes ne sont pas utilisées pour améliorer ses produits. Le contenu des services non payants peut généralement être utilisé, avec un traitement différent pour les utilisateurs de l'EEE, du Royaume-Uni et de la Suisse ; vérifiez les conditions actuelles de votre compte et de votre région.

Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.

Lire la politique du fournisseur

Questions fréquemment posées

FAQ Gemini 3.8 Live Extended Thinking

Qu'est-ce que Gemini 3.8 Live Extended Thinking ?

Un modèle vocal Gemini distinct qui traite les demandes complexes en arrière-plan tout en poursuivant la conversation. Extended Thinking associe parole en direct, planification et utilisation d’outils en arrière-plan. Il peut annoncer sa progression pendant une demande en plusieurs étapes, avec des niveaux de réflexion faible, moyen ou élevé.

Quand Gemini 3.8 Live Extended Thinking est-il sorti ?

Gemini 3.8 Live Extended Thinking a été publié sur 15 septembre 2026 selon les documents du fournisseur cités.

Où puis-je accéder à Gemini 3.8 Live Extended Thinking ?

Disponible via Gemini Live API et Google AI Studio dans les régions prises en charge. Les voies d'accès répertoriées dans ce guide sont Google.

Combien coûte Gemini 3.8 Live Extended Thinking ?

Entrée audio à 0,005 $/min · Sortie audio à 0,018 $/min. Tarifs payants : 3 USD en entrée audio et 12 USD en sortie par million de tokens. Le texte coûte 0,75 USD en entrée et 4,50 USD en sortie ; les images/vidéos coûtent 1 USD en entrée par million de tokens. Le raisonnement et les recherches payantes peuvent ajouter des frais.

Où le Gemini 3.8 Live Extended Thinking est-il disponible ?

Disponible via Gemini Live API et Google AI Studio dans les régions prises en charge. Utilisez la liste des régions disponibles en direct de Google et vérifiez les restrictions de fonctionnalités pour l'itinéraire sélectionné.

Mes données API Gemini 3.8 Live Extended Thinking sont-elles utilisées pour la formation ?

Google indique que les invites et réponses Gemini API payantes ne sont pas utilisées pour améliorer ses produits. Le contenu des services non payants peut généralement être utilisé, avec un traitement différent pour les utilisateurs de l'EEE, du Royaume-Uni et de la Suisse ; vérifiez les conditions actuelles de votre compte et de votre région. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.

Comparaisons associées

Comparaisons face à face

  1. Gemini 3.8 Live Extended Thinking vs GPT-Live 1

    Frontend vocal full duplex du OpenAI pour une conversation naturelle qui délègue un raisonnement et des actions plus approfondis à un agent backend distinct.

    Ouvrir la comparaison complète
  2. Gemini 3.8 Live Extended Thinking vs Gemini 3.8 Live

    Le modèle vocal en temps réel de Google pour des échanges réactifs avec audio, texte et contexte visuel.

    Ouvrir la comparaison complète
  3. Gemini 3.8 Live Extended Thinking vs GPT-Realtime-2.1

    Modèle de raisonnement parole-parole en temps réel de OpenAI pour les agents vocaux utilisant des outils qui ont également besoin d'un contexte de texte et d'image.

    Ouvrir la comparaison complète
  4. Gemini 3.8 Live Extended Thinking vs Gemini 3.1 Flash Live Preview

    Modèle audio-audio en avant-première de Google pour un dialogue à faible latence avec une conscience multimodale, une réflexion, une mise à la terre de recherche et un appel de fonction.

    Ouvrir la comparaison complète
  5. Gemini 3.8 Live Extended Thinking vs Eleven v3 Conversational

    Modèle de synthèse vocale en temps réel expressif de ElevenLabs pour un dialogue naturel, une transmission émotionnelle, des balises audio et plus de 70 langues.

    Ouvrir la comparaison complète
  6. Gemini 3.8 Live Extended Thinking vs Inworld Realtime TTS-2

    Le tout nouveau modèle expressif de synthèse vocale en temps réel d'Inworld, conçu pour mémoriser les conversations et parler dans plus de 100 langues.

    Ouvrir la comparaison complète
  7. Gemini 3.8 Live Extended Thinking vs Grok Voice Think Fast 2.0

    Modèle de parole en temps réel actuel de SpaceXAI pour les agents conversationnels en moins d'une seconde avec accès aux outils.

    Ouvrir la comparaison complète