Todos os modelos
Voz e tempo realDisponível
Google

Gemini 3.8 Live

O modelo de voz em tempo real do Google para conversas ágeis com áudio, texto e contexto visual.

Visão geral em inglês simples

O que Gemini 3.8 Live realmente é

O Gemini 3.8 Live pode conversar sobre o que o usuário diz ou mostra na câmera e chamar ferramentas durante a conversa. Ao contrário do Gemini 3.8 Flash, que retorna texto, o Live foi feito para interação por voz.

Escolha esta versão para assistentes de voz do dia a dia. O raciocínio é intercalado com a conversa, sem nível de pensamento ajustável. Extended Thinking é um modelo separado para tarefas mais complexas.

Bom ajuste para

  • Atendimento ao cliente por conversa
  • Assistentes de voz com contexto da câmera
  • Agentes de voz cotidianos que usam ferramentas

Comparação de categorias

Os fatos que importam para os modelos voz

Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.

Base de preço
Áudio US$ 0,005/min de entrada · US$ 0,018/min de saídaPreço baseado em token, caractere ou minuto para a rota de acesso listada.
Modo de interação
Voz para voz com entrada visual e raciocínio intercaladoComportamento de fala para fala, áudio para áudio ou transmissão de texto para fala.
Latência publicada
Não publicadoMedição publicada pelo provedor com suas exclusões declaradas; não é um teste Cody.
Idiomas
97 idiomas (segundo o anúncio do Google)Cobertura linguística documentada pelo fornecedor ou um marcador claro e não publicado.
Ferramentas e controle
Funções (assíncronas por padrão), fundamentação com pesquisaRecursos nativos de chamada de função, raciocínio ou controle de fala.
Contexto ou limite de entrada
131.072 entradas · 65.536 saídasToken documentado ou limite de caracteres onde for significativo.

Acesso à API e ao provedor

Onde obter Gemini 3.8 Live

Disponibilidade

Regiões e estágio de acesso

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas.

Use a lista de regiões disponíveis ao vivo do Google e verifique as restrições de recursos para a rota selecionada.

Verifique a disponibilidade ao vivo

Dados e treinamento

A rota é importante.

Google afirma que os prompts e respostas pagos do Gemini API não são usados ​​para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região.

Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.

Leia a política do provedor

Perguntas frequentes

Perguntas frequentes sobre Gemini 3.8 Live

O que é Gemini 3.8 Live?

O modelo de voz em tempo real do Google para conversas ágeis com áudio, texto e contexto visual. O Gemini 3.8 Live pode conversar sobre o que o usuário diz ou mostra na câmera e chamar ferramentas durante a conversa. Ao contrário do Gemini 3.8 Flash, que retorna texto, o Live foi feito para interação por voz.

Quando o Gemini 3.8 Live foi lançado?

Gemini 3.8 Live foi lançado em 15 de setembro de 2026 de acordo com os materiais do fornecedor citado.

Onde posso acessar Gemini 3.8 Live?

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas. As rotas de acesso listadas neste guia são Google.

Quanto custa Gemini 3.8 Live?

Entrada de áudio de US$ 0,005/min · Saída de áudio de US$ 0,018/min. Tarifas pagas: US$ 3 para entrada de áudio e US$ 12 para saída por milhão de tokens. Texto custa US$ 0,75 na entrada e US$ 4,50 na saída; entrada de imagem/vídeo custa US$ 1 por milhão de tokens. Raciocínio e pesquisas pagas podem gerar custos extras.

Onde o Gemini 3.8 Live está disponível?

Disponível pela Gemini Live API e pelo Google AI Studio nas regiões atendidas. Use a lista de regiões disponíveis ao vivo do Google e verifique as restrições de recursos para a rota selecionada.

Os dados da minha API Gemini 3.8 Live são usados ​​para treinamento?

Google afirma que os prompts e respostas pagos do Gemini API não são usados ​​para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.

Comparações relacionadas

Comparações lado a lado

  1. Gemini 3.8 Live vs GPT-Live 1

    Front-end de voz full-duplex do OpenAI para conversas naturais que delega raciocínios e ações mais profundos a um agente de back-end separado.

    Abrir comparação completa
  2. Gemini 3.8 Live vs Gemini 3.8 Live Extended Thinking

    Um modelo de voz Gemini separado que resolve solicitações complexas em segundo plano enquanto mantém a conversa.

    Abrir comparação completa
  3. Gemini 3.8 Live vs GPT-Realtime-2.1

    Modelo de raciocínio de fala para fala em tempo real do OpenAI para agentes de voz que usam ferramentas e que também precisam de contexto de texto e imagem.

    Abrir comparação completa
  4. Gemini 3.8 Live vs Gemini 3.1 Flash Live Preview

    Modelo de visualização de áudio para áudio do Google para diálogo de baixa latência com consciência multimodal, pensamento, base de pesquisa e chamada de função.

    Abrir comparação completa
  5. Gemini 3.8 Live vs Eleven v3 Conversational

    Modelo expressivo de conversão de texto em fala em tempo real do ElevenLabs para diálogo natural, entrega emocional, tags de áudio e mais de 70 idiomas.

    Abrir comparação completa
  6. Gemini 3.8 Live vs Inworld Realtime TTS-2

    O mais novo modelo expressivo de conversão de texto em fala em tempo real da Inworld, projetado para lembrar a conversação e falar em mais de 100 idiomas.

    Abrir comparação completa
  7. Gemini 3.8 Live vs Grok Voice Think Fast 2.0

    Modelo atual de fala em fala em tempo real do SpaceXAI para agentes de conversação em menos de um segundo com acesso a ferramentas.

    Abrir comparação completa