GPT-Live 1
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
Descripción general en inglés sencillo
GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
The architecture separates conversation from deeper work. GPT-Live 1 manages the voice experience while a Responses model or an application-operated agent handles reasoning and approved tools. The published voice price therefore excludes backend model usage, tools, telephony, and application infrastructure.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Acceso a API y proveedores
Disponibilidad
Available through OpenAI's Live API for browser, server, and telephony voice applications.
Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
Consultar disponibilidad en vivoDatos y entrenamiento
OpenAI dice que el contenido de la API no se utiliza para la capacitación de forma predeterminada. Los registros predeterminados de supervisión de abusos se pueden conservar hasta 30 días, con controles adicionales disponibles para las organizaciones que califiquen.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent. GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
GPT-Live 1 se lanzó en 10 de septiembre de 2026 según los materiales del proveedor citados.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Las rutas de acceso enumeradas en esta guía son OpenAI.
$0.05 / voice minute. Voice sessions are billed per second without whole-minute rounding. Backend model and tool usage is billed separately, as are telephony and application infrastructure.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
OpenAI dice que el contenido de la API no se utiliza para la capacitación de forma predeterminada. Los registros predeterminados de supervisión de abusos se pueden conservar hasta 30 días, con controles adicionales disponibles para las organizaciones que califiquen. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
Modelo de razonamiento de voz a voz en tiempo real de OpenAI para agentes de voz que utilizan herramientas que también necesitan contexto de texto e imagen.
Abrir comparación completaModelo de vista previa de audio a audio de Google para diálogos de baja latencia con conciencia, pensamiento, base de búsqueda y llamadas de funciones multimodales.
Abrir comparación completaModelo expresivo de conversión de texto a voz en tiempo real ElevenLabs para diálogo natural, entrega emocional, etiquetas de audio y más de 70 idiomas.
Abrir comparación completaEl modelo expresivo de conversión de texto a voz en tiempo real más nuevo de Inworld, diseñado para recordar la entrega conversacional y hablar en más de 100 idiomas.
Abrir comparación completaModelo actual de voz a voz en tiempo real de SpaceXAI para agentes conversacionales en menos de un segundo con acceso a herramientas.
Abrir comparación completa