Gemini 3.8 Flash-Lite TTS
El modelo de voz más económico de Google para lectura en voz alta y producción de audio a gran escala en 101 idiomas.
El modelo de voz más económico de Google para lectura en voz alta y producción de audio a gran escala en 101 idiomas.
Descripción general en inglés sencillo
Flash-Lite TTS convierte guiones en voz con el mismo formato de solicitud que Flash TTS y un menor precio de salida de audio. Es una opción práctica para locuciones repetidas y el componente de voz de un asistente.
Ambos modelos permiten diseñar voces y usar guiones con dos hablantes. Generan voz, no respuestas: un asistente conversacional sigue necesitando componentes separados de escucha y razonamiento. No utilizan la API Gemini Live.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Acceso a API y proveedores
Disponibilidad
Disponible mediante la API Gemini y Google AI Studio en las regiones admitidas.
La replicación de voz en AI Studio no está disponible en Illinois, Texas, el EEE, Reino Unido, Suiza e India. Esto no implica una prohibición general de TTS en esas regiones.
Consultar disponibilidad en vivoDatos y entrenamiento
Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
El modelo de voz más económico de Google para lectura en voz alta y producción de audio a gran escala en 101 idiomas. Flash-Lite TTS convierte guiones en voz con el mismo formato de solicitud que Flash TTS y un menor precio de salida de audio. Es una opción práctica para locuciones repetidas y el componente de voz de un asistente.
Gemini 3.8 Flash-Lite TTS se lanzó en 23 de septiembre de 2026 según los materiales del proveedor citados.
Disponible mediante la API Gemini y Google AI Studio en las regiones admitidas. Las rutas de acceso enumeradas en esta guía son Google.
0,50 $ entrada de texto · 6 $ salida de audio / 1 M de tokens. Tarifas iniciales Standard hasta el 31 de diciembre de 2026; ambas se duplican el 1 de enero de 2027. El audio usa 25 tokens por segundo. La caché y otros niveles de servicio tienen tarifas distintas.
Disponible mediante la API Gemini y Google AI Studio en las regiones admitidas. La replicación de voz en AI Studio no está disponible en Illinois, Texas, el EEE, Reino Unido, Suiza e India. Esto no implica una prohibición general de TTS en esas regiones.
Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
El modelo de voz de Google para narración expresiva, voces de personajes y diálogos en 130 idiomas.
Abrir comparación completaModelo expresivo de conversión de texto a voz en tiempo real ElevenLabs para diálogo natural, entrega emocional, etiquetas de audio y más de 70 idiomas.
Abrir comparación completaEl modelo expresivo de conversión de texto a voz en tiempo real más nuevo de Inworld, diseñado para recordar la entrega conversacional y hablar en más de 100 idiomas.
Abrir comparación completa