Todos os modelos
Voz e tempo realDisponível
Google

Gemini 3.8 Live Extended Thinking

Um modelo de voz Gemini separado que resolve solicitações complexas em segundo plano enquanto mantém a conversa.

Visão geral em inglês simples

O que Gemini 3.8 Live Extended Thinking realmente é

O Extended Thinking combina fala ao vivo com planejamento e uso de ferramentas em segundo plano. Pode informar o progresso por voz durante uma solicitação de várias etapas, com níveis de pensamento baixo, médio ou alto.

Seus limites de entrada e saída são iguais aos do Gemini 3.8 Live. O Google publica as mesmas tarifas por token para ambos, mas raciocínio extra pode aumentar o uso. Já o GPT-Live 1 delega tarefas mais profundas a um agente de backend escolhido separadamente.

Bom ajuste para

  • Fluxos de suporte por voz em várias etapas
  • Assistentes de planejamento e pesquisa por voz
  • Agentes que explicam o progresso durante chamadas de ferramentas

Comparação de categorias

Os fatos que importam para os modelos voz

Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.

Base de preço
Áudio US$ 0,005/min de entrada · US$ 0,018/min de saídaPreço baseado em token, caractere ou minuto para a rota de acesso listada.
Modo de interação
Voz para voz com entrada visual e raciocínio em segundo planoComportamento de fala para fala, áudio para áudio ou transmissão de texto para fala.
Latência publicada
Não publicadoMedição publicada pelo provedor com suas exclusões declaradas; não é um teste Cody.
Idiomas
Multilíngue; verificar o suporte atual da API LiveCobertura linguística documentada pelo fornecedor ou um marcador claro e não publicado.
Ferramentas e controle
Somente funções assíncronas, fundamentação com pesquisaRecursos nativos de chamada de função, raciocínio ou controle de fala.
Contexto ou limite de entrada
131.072 entradas · 65.536 saídasToken documentado ou limite de caracteres onde for significativo.

Acesso à API e ao provedor

Onde obter Gemini 3.8 Live Extended Thinking

Disponibilidade

Regiões e estágio de acesso

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas.

Use a lista de regiões disponíveis ao vivo do Google e verifique as restrições de recursos para a rota selecionada.

Verifique a disponibilidade ao vivo

Dados e treinamento

A rota é importante.

Google afirma que os prompts e respostas pagos do Gemini API não são usados ​​para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região.

Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.

Leia a política do provedor

Perguntas frequentes

Perguntas frequentes sobre Gemini 3.8 Live Extended Thinking

O que é Gemini 3.8 Live Extended Thinking?

Um modelo de voz Gemini separado que resolve solicitações complexas em segundo plano enquanto mantém a conversa. O Extended Thinking combina fala ao vivo com planejamento e uso de ferramentas em segundo plano. Pode informar o progresso por voz durante uma solicitação de várias etapas, com níveis de pensamento baixo, médio ou alto.

Quando o Gemini 3.8 Live Extended Thinking foi lançado?

Gemini 3.8 Live Extended Thinking foi lançado em 15 de setembro de 2026 de acordo com os materiais do fornecedor citado.

Onde posso acessar Gemini 3.8 Live Extended Thinking?

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas. As rotas de acesso listadas neste guia são Google.

Quanto custa Gemini 3.8 Live Extended Thinking?

Entrada de áudio de US$ 0,005/min · Saída de áudio de US$ 0,018/min. Tarifas pagas: US$ 3 para entrada de áudio e US$ 12 para saída por milhão de tokens. Texto custa US$ 0,75 na entrada e US$ 4,50 na saída; entrada de imagem/vídeo custa US$ 1 por milhão de tokens. Raciocínio e pesquisas pagas podem gerar custos extras.

Onde o Gemini 3.8 Live Extended Thinking está disponível?

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas. Use a lista de regiões disponíveis ao vivo do Google e verifique as restrições de recursos para a rota selecionada.

Os dados da minha API Gemini 3.8 Live Extended Thinking são usados ​​para treinamento?

Google afirma que os prompts e respostas pagos do Gemini API não são usados ​​para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.

Comparações relacionadas

Comparações lado a lado

  1. Gemini 3.8 Live Extended Thinking vs GPT-Live 1

    Front-end de voz full-duplex do OpenAI para conversas naturais que delega raciocínios e ações mais profundos a um agente de back-end separado.

    Abrir comparação completa
  2. Gemini 3.8 Live Extended Thinking vs Gemini 3.8 Live

    O modelo de voz em tempo real do Google para conversas ágeis com áudio, texto e contexto visual.

    Abrir comparação completa
  3. Gemini 3.8 Live Extended Thinking vs GPT-Realtime-2.1

    Modelo de raciocínio de fala para fala em tempo real do OpenAI para agentes de voz que usam ferramentas e que também precisam de contexto de texto e imagem.

    Abrir comparação completa
  4. Gemini 3.8 Live Extended Thinking vs Gemini 3.1 Flash Live Preview

    Modelo de visualização de áudio para áudio do Google para diálogo de baixa latência com consciência multimodal, pensamento, base de pesquisa e chamada de função.

    Abrir comparação completa
  5. Gemini 3.8 Live Extended Thinking vs Eleven v3 Conversational

    Modelo expressivo de conversão de texto em fala em tempo real do ElevenLabs para diálogo natural, entrega emocional, tags de áudio e mais de 70 idiomas.

    Abrir comparação completa
  6. Gemini 3.8 Live Extended Thinking vs Inworld Realtime TTS-2

    O mais novo modelo expressivo de conversão de texto em fala em tempo real da Inworld, projetado para lembrar a conversação e falar em mais de 100 idiomas.

    Abrir comparação completa
  7. Gemini 3.8 Live Extended Thinking vs Grok Voice Think Fast 2.0

    Modelo atual de fala em fala em tempo real do SpaceXAI para agentes de conversação em menos de um segundo com acesso a ferramentas.

    Abrir comparação completa