Gemini 3.8 Flash-Lite TTS
O modelo de voz mais econômico do Google para leitura em voz alta e produção de áudio em escala em 101 idiomas.
O modelo de voz mais econômico do Google para leitura em voz alta e produção de áudio em escala em 101 idiomas.
Visão geral em inglês simples
Flash-Lite TTS transforma roteiros em fala com o mesmo formato de solicitação do Flash TTS, por um preço menor de saída de áudio. É uma opção prática para locuções recorrentes e o componente de fala de um assistente de voz.
Os dois modelos permitem criar vozes personalizadas e roteiros com dois interlocutores. Geram fala, não respostas: um assistente de conversa ainda precisa de componentes separados de escuta e raciocínio. Não usam a API Gemini Live.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Acesso à API e ao provedor
Disponibilidade
Disponível pela API Gemini e pelo Google AI Studio nas regiões atendidas.
A replicação de voz no AI Studio não está disponível em Illinois, Texas, EEE, Reino Unido, Suíça e Índia. Essa restrição não é uma proibição geral de TTS nessas regiões.
Verifique a disponibilidade ao vivoDados e treinamento
Google afirma que os prompts e respostas pagos do Gemini API não são usados para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
O modelo de voz mais econômico do Google para leitura em voz alta e produção de áudio em escala em 101 idiomas. Flash-Lite TTS transforma roteiros em fala com o mesmo formato de solicitação do Flash TTS, por um preço menor de saída de áudio. É uma opção prática para locuções recorrentes e o componente de fala de um assistente de voz.
Gemini 3.8 Flash-Lite TTS foi lançado em 23 de setembro de 2026 de acordo com os materiais do fornecedor citado.
Disponível pela API Gemini e pelo Google AI Studio nas regiões atendidas. As rotas de acesso listadas neste guia são Google.
US$ 0,50 entrada de texto · US$ 6 saída de áudio / 1 M de tokens. Tarifas introdutórias Standard até 31 de dezembro de 2026; ambas dobram em 1º de janeiro de 2027. O áudio usa 25 tokens por segundo. Cache e outros níveis de serviço têm tarifas diferentes.
Disponível pela API Gemini e pelo Google AI Studio nas regiões atendidas. A replicação de voz no AI Studio não está disponível em Illinois, Texas, EEE, Reino Unido, Suíça e Índia. Essa restrição não é uma proibição geral de TTS nessas regiões.
Google afirma que os prompts e respostas pagos do Gemini API não são usados para melhorar seus produtos. Geralmente, conteúdo de serviço não pago pode ser usado, com tratamento diferente para usuários do EEE, do Reino Unido e da Suíça; verifique os termos atuais para sua conta e região. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Comparações relacionadas
O modelo de voz do Google para narração expressiva, vozes de personagens e diálogos em 130 idiomas.
Abrir comparação completaModelo expressivo de conversão de texto em fala em tempo real do ElevenLabs para diálogo natural, entrega emocional, tags de áudio e mais de 70 idiomas.
Abrir comparação completaO mais novo modelo expressivo de conversão de texto em fala em tempo real da Inworld, projetado para lembrar a conversação e falar em mais de 100 idiomas.
Abrir comparação completa