Todos los modelos
Google

Gemini 3.8 Live Extended Thinking

Un modelo de voz Gemini independiente que resuelve solicitudes complejas en segundo plano mientras mantiene la conversación.

Descripción general en inglés sencillo

Qué es realmente Gemini 3.8 Live Extended Thinking

Extended Thinking combina voz en directo con planificación y uso de herramientas en segundo plano. Puede informar verbalmente del progreso mientras resuelve una solicitud de varios pasos, con niveles de pensamiento bajo, medio o alto.

Sus límites de entrada y salida coinciden con los de Gemini 3.8 Live. Google publica las mismas tarifas por token para ambos, pero el razonamiento adicional puede aumentar el consumo. GPT-Live 1, en cambio, delega el trabajo más profundo a un agente de backend elegido por separado.

Buen ajuste para

  • Flujos de asistencia por voz de varios pasos
  • Asistentes de planificación e investigación por voz
  • Agentes que explican el progreso al usar herramientas

Comparación de categorías

Los hechos que importan para los modelos voz

Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.

Base del precio
Audio $0.005/min entrada · $0.018/min salidaPrecio basado en tokens, caracteres o minutos para la ruta de acceso indicada.
Modo de interacción
Voz a voz con entrada visual y razonamiento en segundo planoComportamiento de voz a voz, audio a audio o texto a voz transmitido.
Latencia publicada
No publicadoMedición publicada por el proveedor con sus exclusiones indicadas; no es una prueba Cody.
Idiomas
Multilingüe; verificar el soporte actual de Live APICobertura de idioma documentada por el proveedor o un marcador claro e inédito.
Herramientas y control
Solo funciones asíncronas, fundamentación con búsquedaFunciones nativas de llamada de funciones, razonamiento o control de voz.
Contexto o límite de entrada
131.072 entradas · 65.536 salidasToken documentado o límite de caracteres cuando sea significativo.

Acceso a API y proveedores

Dónde conseguir Gemini 3.8 Live Extended Thinking

Disponibilidad

Regiones y etapa de acceso

Disponible mediante Gemini Live API y Google AI Studio en las regiones admitidas.

Utilice la lista en vivo de regiones disponibles de Google y verifique las restricciones de funciones para la ruta seleccionada.

Consultar disponibilidad en vivo

Datos y entrenamiento

La ruta importa.

Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región.

Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.

Lea la política del proveedor.

Preguntas frecuentes

Preguntas frecuentes sobre Gemini 3.8 Live Extended Thinking

¿Qué es Gemini 3.8 Live Extended Thinking?

Un modelo de voz Gemini independiente que resuelve solicitudes complejas en segundo plano mientras mantiene la conversación. Extended Thinking combina voz en directo con planificación y uso de herramientas en segundo plano. Puede informar verbalmente del progreso mientras resuelve una solicitud de varios pasos, con niveles de pensamiento bajo, medio o alto.

¿Cuándo se lanzó Gemini 3.8 Live Extended Thinking?

Gemini 3.8 Live Extended Thinking se lanzó en 15 de septiembre de 2026 según los materiales del proveedor citados.

¿Dónde puedo acceder a Gemini 3.8 Live Extended Thinking?

Disponible mediante Gemini Live API y Google AI Studio en las regiones admitidas. Las rutas de acceso enumeradas en esta guía son Google.

¿Cuánto cuesta Gemini 3.8 Live Extended Thinking?

$0.005/min entrada de audio · $0.018/min salida de audio. Tarifas del nivel de pago: 3 USD de entrada de audio y 12 USD de salida por millón de tokens. El texto cuesta 0,75 USD de entrada y 4,50 USD de salida; la entrada de imagen/vídeo, 1 USD por millón de tokens. El razonamiento y la búsqueda de pago pueden añadir costes.

¿Dónde está disponible Gemini 3.8 Live Extended Thinking?

Disponible mediante Gemini Live API y Google AI Studio en las regiones admitidas. Utilice la lista en vivo de regiones disponibles de Google y verifique las restricciones de funciones para la ruta seleccionada.

¿Se utilizan mis datos API Gemini 3.8 Live Extended Thinking para capacitación?

Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.

Comparaciones relacionadas

Comparaciones cara a cara

  1. Gemini 3.8 Live Extended Thinking vs GPT-Live 1

    La interfaz de voz full-duplex de OpenAI para una conversación natural que delega razonamientos y acciones más profundos a un agente de backend independiente.

    Abrir comparación completa
  2. Gemini 3.8 Live Extended Thinking vs Gemini 3.8 Live

    El modelo de voz en tiempo real de Google para conversaciones fluidas con audio, texto y contexto visual.

    Abrir comparación completa
  3. Gemini 3.8 Live Extended Thinking vs GPT-Realtime-2.1

    Modelo de razonamiento de voz a voz en tiempo real de OpenAI para agentes de voz que utilizan herramientas que también necesitan contexto de texto e imagen.

    Abrir comparación completa
  4. Gemini 3.8 Live Extended Thinking vs Gemini 3.1 Flash Live Preview

    Modelo de vista previa de audio a audio de Google para diálogos de baja latencia con conciencia, pensamiento, base de búsqueda y llamadas de funciones multimodales.

    Abrir comparación completa
  5. Gemini 3.8 Live Extended Thinking vs Eleven v3 Conversational

    Modelo expresivo de conversión de texto a voz en tiempo real ElevenLabs para diálogo natural, entrega emocional, etiquetas de audio y más de 70 idiomas.

    Abrir comparación completa
  6. Gemini 3.8 Live Extended Thinking vs Inworld Realtime TTS-2

    El modelo expresivo de conversión de texto a voz en tiempo real más nuevo de Inworld, diseñado para recordar la entrega conversacional y hablar en más de 100 idiomas.

    Abrir comparación completa
  7. Gemini 3.8 Live Extended Thinking vs Grok Voice Think Fast 2.0

    Modelo actual de voz a voz en tiempo real de SpaceXAI para agentes conversacionales en menos de un segundo con acceso a herramientas.

    Abrir comparación completa