GPT-Live 1
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
Présentation de l'anglais simple
GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
The architecture separates conversation from deeper work. GPT-Live 1 manages the voice experience while a Responses model or an application-operated agent handles reasoning and approved tools. The published voice price therefore excludes backend model usage, tools, telephony, and application infrastructure.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Accès API et fournisseur
Disponibilité
Available through OpenAI's Live API for browser, server, and telephony voice applications.
Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
Vérifier la disponibilité en directDonnées et formation
OpenAI indique que le contenu de l'API n'est pas utilisé par défaut pour la formation. Les journaux de surveillance des abus par défaut peuvent être conservés jusqu'à 30 jours, avec des contrôles supplémentaires disponibles pour les organisations éligibles.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent. GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
GPT-Live 1 a été publié sur 10 septembre 2026 selon les documents du fournisseur cités.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Les voies d'accès répertoriées dans ce guide sont OpenAI.
$0.05 / voice minute. Voice sessions are billed per second without whole-minute rounding. Backend model and tool usage is billed separately, as are telephony and application infrastructure.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
OpenAI indique que le contenu de l'API n'est pas utilisé par défaut pour la formation. Les journaux de surveillance des abus par défaut peuvent être conservés jusqu'à 30 jours, avec des contrôles supplémentaires disponibles pour les organisations éligibles. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
Comparaisons associées
Modèle de raisonnement parole-parole en temps réel de OpenAI pour les agents vocaux utilisant des outils qui ont également besoin d'un contexte de texte et d'image.
Ouvrir la comparaison complèteModèle audio-audio en avant-première de Google pour un dialogue à faible latence avec une conscience multimodale, une réflexion, une mise à la terre de recherche et un appel de fonction.
Ouvrir la comparaison complèteModèle de synthèse vocale en temps réel expressif de ElevenLabs pour un dialogue naturel, une transmission émotionnelle, des balises audio et plus de 70 langues.
Ouvrir la comparaison complèteLe tout nouveau modèle expressif de synthèse vocale en temps réel d'Inworld, conçu pour mémoriser les conversations et parler dans plus de 100 langues.
Ouvrir la comparaison complèteModèle de parole en temps réel actuel de SpaceXAI pour les agents conversationnels en moins d'une seconde avec accès aux outils.
Ouvrir la comparaison complète