Tous les modèles
OpenAI

GPT-Live 1

Frontend vocal full duplex du OpenAI pour une conversation naturelle qui délègue un raisonnement et des actions plus approfondis à un agent backend distinct.

Présentation de l'anglais simple

Qu'est-ce que GPT-Live 1 ?

Le GPT-Live 1 écoute et parle en même temps, ce qui lui permet de gérer les pauses, les accusés de réception, les interruptions et le bruit de fond sans forcer chaque échange à se transformer en virages rigides. Il fournit également des transcriptions et des textes de réponse parallèlement à l'audio en direct.

L'architecture sépare la conversation du travail plus approfondi. GPT-Live 1 gère l'expérience vocale tandis qu'un modèle de réponses ou un agent exploité par une application gère le raisonnement et les outils approuvés. Le prix de la voix publié exclut donc l'utilisation du modèle backend, les outils, la téléphonie et l'infrastructure applicative.

Bon ajustement pour

  • Service client naturel et planification des appels
  • Des interfaces vocales qui doivent continuer à parler pendant le travail
  • Les équipes qui souhaitent choisir ou exploiter l'agent backend

Comparaison des catégories

Les faits importants pour les modèles voix

Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.

Base de prix
0,05 $/minute vocale + utilisation du backendPrix basé sur un jeton, un caractère ou une minute pour l'itinéraire d'accès répertorié.
Mode d'interaction
Frontend vocal full-duplex avec backend déléguéComportement parole-parole, audio-audio ou synthèse vocale en streaming.
Latence publiée
Non publiéMesure publiée par le fournisseur avec ses exclusions indiquées ; pas un test Cody.
Langues
Plusieurs accents, dialectes et langues ; liste exacte non publiéeCouverture linguistique documentée par le fournisseur ou marqueur clair non publié.
Outils et contrôle
Réponses ou délégation du client aux agents et outils backendFonctionnalités natives d’appel de fonctions, de raisonnement ou de contrôle vocal.
Contexte ou limite d'entrée
Non publiéLimite de jetons ou de caractères documentée lorsque cela est significatif.

Accès API et fournisseur

Où obtenir GPT-Live 1

Disponibilité

Régions et étape d'accès

Disponible via l'API Live de OpenAI pour les applications vocales de navigateur, de serveur et de téléphonie.

L'accès direct suit la liste des pays pris en charge en direct par OpenAI ; le niveau API gratuite n'est pas pris en charge pour ce modèle.

Vérifier la disponibilité en direct

Données et formation

L'itinéraire compte.

OpenAI indique que le contenu de l'API n'est pas utilisé par défaut pour la formation. Les journaux de surveillance des abus par défaut peuvent être conservés jusqu'à 30 jours, avec des contrôles supplémentaires disponibles pour les organisations éligibles.

Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.

Lire la politique du fournisseur

Questions fréquemment posées

FAQ GPT-Live 1

Qu'est-ce que GPT-Live 1 ?

Frontend vocal full duplex du OpenAI pour une conversation naturelle qui délègue un raisonnement et des actions plus approfondis à un agent backend distinct. Le GPT-Live 1 écoute et parle en même temps, ce qui lui permet de gérer les pauses, les accusés de réception, les interruptions et le bruit de fond sans forcer chaque échange à se transformer en virages rigides. Il fournit également des transcriptions et des textes de réponse parallèlement à l'audio en direct.

Quand GPT-Live 1 est-il sorti ?

GPT-Live 1 a été publié sur 10 septembre 2026 selon les documents du fournisseur cités.

Où puis-je accéder à GPT-Live 1 ?

Disponible via l'API Live de OpenAI pour les applications vocales de navigateur, de serveur et de téléphonie. Les voies d'accès répertoriées dans ce guide sont OpenAI.

Combien coûte GPT-Live 1 ?

0,05 $/minute vocale. Les sessions vocales sont facturées à la seconde sans arrondi à la minute entière. L’utilisation du modèle backend et des outils est facturée séparément, tout comme la téléphonie et l’infrastructure applicative.

Où le GPT-Live 1 est-il disponible ?

Disponible via l'API Live de OpenAI pour les applications vocales de navigateur, de serveur et de téléphonie. L'accès direct suit la liste des pays pris en charge en direct par OpenAI ; le niveau API gratuite n'est pas pris en charge pour ce modèle.

Mes données API GPT-Live 1 sont-elles utilisées pour la formation ?

OpenAI indique que le contenu de l'API n'est pas utilisé par défaut pour la formation. Les journaux de surveillance des abus par défaut peuvent être conservés jusqu'à 30 jours, avec des contrôles supplémentaires disponibles pour les organisations éligibles. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.

Comparaisons associées

Comparaisons face à face

  1. GPT-Live 1 vs Gemini 3.8 Live

    Le modèle vocal en temps réel de Google pour des échanges réactifs avec audio, texte et contexte visuel.

    Ouvrir la comparaison complète
  2. GPT-Live 1 vs Gemini 3.8 Live Extended Thinking

    Un modèle vocal Gemini distinct qui traite les demandes complexes en arrière-plan tout en poursuivant la conversation.

    Ouvrir la comparaison complète
  3. GPT-Live 1 vs GPT-Realtime-2.1

    Modèle de raisonnement parole-parole en temps réel de OpenAI pour les agents vocaux utilisant des outils qui ont également besoin d'un contexte de texte et d'image.

    Ouvrir la comparaison complète
  4. GPT-Live 1 vs Gemini 3.1 Flash Live Preview

    Modèle audio-audio en avant-première de Google pour un dialogue à faible latence avec une conscience multimodale, une réflexion, une mise à la terre de recherche et un appel de fonction.

    Ouvrir la comparaison complète
  5. GPT-Live 1 vs Eleven v3 Conversational

    Modèle de synthèse vocale en temps réel expressif de ElevenLabs pour un dialogue naturel, une transmission émotionnelle, des balises audio et plus de 70 langues.

    Ouvrir la comparaison complète
  6. GPT-Live 1 vs Inworld Realtime TTS-2

    Le tout nouveau modèle expressif de synthèse vocale en temps réel d'Inworld, conçu pour mémoriser les conversations et parler dans plus de 100 langues.

    Ouvrir la comparaison complète
  7. GPT-Live 1 vs Grok Voice Think Fast 2.0

    Modèle de parole en temps réel actuel de SpaceXAI pour les agents conversationnels en moins d'une seconde avec accès aux outils.

    Ouvrir la comparaison complète