GPT-Live 1
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent.
Übersicht in einfacher englischer Sprache
GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
The architecture separates conversation from deeper work. GPT-Live 1 manages the voice experience while a Responses model or an application-operated agent handles reasoning and approved tools. The published voice price therefore excludes backend model usage, tools, telephony, and application infrastructure.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
API- und Provider-Zugriff
Verfügbarkeit
Available through OpenAI's Live API for browser, server, and telephony voice applications.
Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
Laut OpenAI werden API-Inhalte standardmäßig nicht für das Training verwendet. Standardprotokolle zur Missbrauchsüberwachung können bis zu 30 Tage lang aufbewahrt werden, wobei berechtigten Organisationen zusätzliche Kontrollen zur Verfügung stehen.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
OpenAI's full-duplex voice frontend for natural conversation that delegates deeper reasoning and actions to a separate backend agent. GPT-Live 1 listens and speaks at the same time, so it can handle pauses, acknowledgements, interruptions, and background noise without forcing every exchange into rigid turns. It also provides transcripts and response text alongside the live audio.
GPT-Live 1 wurde gemäß den zitierten Anbietermaterialien auf 10. September 2026 veröffentlicht.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Die in diesem Handbuch aufgeführten Zugriffsrouten sind OpenAI.
$0.05 / voice minute. Voice sessions are billed per second without whole-minute rounding. Backend model and tool usage is billed separately, as are telephony and application infrastructure.
Available through OpenAI's Live API for browser, server, and telephony voice applications. Direct access follows OpenAI's live supported-country list; the Free API tier is not supported for this model.
Laut OpenAI werden API-Inhalte standardmäßig nicht für das Training verwendet. Standardprotokolle zur Missbrauchsüberwachung können bis zu 30 Tage lang aufbewahrt werden, wobei berechtigten Organisationen zusätzliche Kontrollen zur Verfügung stehen. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Verwandte Vergleiche
Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen.
Vollständigen Vergleich öffnenDas Vorschau-Audio-zu-Audio-Modell von Google für Dialoge mit geringer Latenz mit multimodalem Bewusstsein, Denken, Sucherdung und Funktionsaufruf.
Vollständigen Vergleich öffnenElevenLabs‘ ausdrucksstarkes Echtzeit-Text-to-Speech-Modell für natürliche Dialoge, emotionale Übermittlung, Audio-Tags und mehr als 70 Sprachen.
Vollständigen Vergleich öffnenDas neueste ausdrucksstarke Echtzeit-Text-to-Speech-Modell von Inworld, das darauf ausgelegt ist, sich die gesprochene Sprache zu merken und in mehr als 100 Sprachen zu sprechen.
Vollständigen Vergleich öffnenDas aktuelle Echtzeit-Speech-to-Speech-Modell von SpaceXAI für Sub-Sekunden-Konversationsagenten mit Tool-Zugriff.
Vollständigen Vergleich öffnen