Alle Modelle
OpenAI

GPT-Realtime-2.1

Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen.

Übersicht in einfacher englischer Sprache

Was GPT-Realtime-2.1 eigentlich ist

GPT-Realtime-2.1 ist für Live-Gespräche konzipiert, bei denen das Modell in einer Echtzeitsitzung zuhören, sprechen, Anweisungen befolgen und Tools aufrufen muss. OpenAI hebt im Vergleich zur Vorgängerversion verbesserte Unterbrechungen, Stille, Geräusche und alphanumerische Handhabung hervor.

Audio-, Text- und Bildeingaben werden in verschiedenen Token-Klassen abgerechnet. Ein realistisches Budget erfordert daher die erfasste Nutzung vollständiger Gespräche und nicht eine einfache Umrechnung nur der Audiominuten.

Gute Passform für

  • Toolbasierte Sprachagenten für Kunden oder Mitarbeiter
  • Multimodale Echtzeitassistenten
  • OpenAI-native Agent-Stacks

Kategorievergleich

Die Fakten, die für die stimme-Modelle wichtig sind

Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.

Preisbasis
Audio 32 $ Eingang · 64 $ Ausgang / 1 Mio. TokenToken-, zeichen- oder minutenbasierter Preis für die aufgeführte Zugangsroute.
Interaktionsmodus
Speech-to-Speech mit Text-/BildkontextSpeech-to-Speech-, Audio-to-Audio- oder gestreamtes Text-to-Speech-Verhalten.
Veröffentlichte Latenz
Nicht veröffentlichtVom Anbieter veröffentlichte Messung mit den angegebenen Ausschlüssen; kein Cody-Test.
Sprachen
Mehrsprachig; genaue Liste hier nicht veröffentlichtVom Anbieter dokumentierte Sprachabdeckung oder ein eindeutiger unveröffentlichter Marker.
Werkzeuge und Steuerung
Funktionsaufrufe und konfigurierbare ArgumentationNative Funktionsaufruf-, Argumentations- oder Sprachsteuerungsfunktionen.
Kontext oder Eingabelimit
128K Eingang · 32K maximaler AusgangDokumentiertes Token oder Zeichenlimit, wo es sinnvoll ist.

API- und Provider-Zugriff

Wo bekomme ich GPT-Realtime-2.1?

Verfügbarkeit

Regionen und Zugriffsphase

Verfügbar über die Echtzeit-API von OpenAI in unterstützten Ländern und Gebieten.

Der Direktzugriff folgt der Live-Liste der unterstützten Länder von OpenAI.

Überprüfen Sie die Live-Verfügbarkeit

Daten und Schulung

Die Route ist wichtig.

Laut OpenAI werden API-Inhalte standardmäßig nicht für das Training verwendet. Standardprotokolle zur Missbrauchsüberwachung können bis zu 30 Tage lang aufbewahrt werden, wobei berechtigten Organisationen zusätzliche Kontrollen zur Verfügung stehen.

Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.

Lesen Sie die Richtlinien des Anbieters

Häufig gestellte Fragen

GPT-Realtime-2.1 FAQ

Was ist GPT-Realtime-2.1?

Das Echtzeit-Speech-to-Speech-Argumentationsmodell von OpenAI für Tool-verwendende Sprachagenten, die auch Text- und Bildkontext benötigen. GPT-Realtime-2.1 ist für Live-Gespräche konzipiert, bei denen das Modell in einer Echtzeitsitzung zuhören, sprechen, Anweisungen befolgen und Tools aufrufen muss. OpenAI hebt im Vergleich zur Vorgängerversion verbesserte Unterbrechungen, Stille, Geräusche und alphanumerische Handhabung hervor.

Wann wurde GPT-Realtime-2.1 veröffentlicht?

Der Anbieter veröffentlicht im von Cody überprüften Quellmaterial kein klares Veröffentlichungsdatum für GPT-Realtime-2.1.

Wo kann ich auf GPT-Realtime-2.1 zugreifen?

Verfügbar über die Echtzeit-API von OpenAI in unterstützten Ländern und Gebieten. Die in diesem Handbuch aufgeführten Zugriffsrouten sind OpenAI.

Wie viel kostet GPT-Realtime-2.1?

32 $ Audioeingang · 64 $ Audioausgang / 1 Mio. Token. Text kostet 4 $ Input und 24 $ Output pro Million Token; Die Bildeingabe beträgt 5 US-Dollar pro Million Token. Die Raten für zwischengespeicherte Eingaben sind unterschiedlich.

Wo ist GPT-Realtime-2.1 erhältlich?

Verfügbar über die Echtzeit-API von OpenAI in unterstützten Ländern und Gebieten. Der Direktzugriff folgt der Live-Liste der unterstützten Länder von OpenAI.

Werden meine GPT-Realtime-2.1-API-Daten für das Training verwendet?

Laut OpenAI werden API-Inhalte standardmäßig nicht für das Training verwendet. Standardprotokolle zur Missbrauchsüberwachung können bis zu 30 Tage lang aufbewahrt werden, wobei berechtigten Organisationen zusätzliche Kontrollen zur Verfügung stehen. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.