GPT-Live : full-duplex chez ChatGPT, pas dans votre callbot
GPT-Live : full-duplex chez ChatGPT, pas dans votre callbot
OpenAI a lancé GPT-Live full-duplex dans ChatGPT le 8 juillet 2026, mais l'API entreprise reste fermée. Le calendrier réaliste pour votre callbot.
Sommaire
- Ce qu'OpenAI a mis dans les mains le 8 juillet et pourquoi le full-duplex n'est pas un gain de latence
- L'API entreprise n'existe pas encore : le vrai calendrier de migration
- Le français n'est pas encore une langue de production pour GPT-Live
- Ce que ça change pour une entreprise française
- Ce qu'il faut retenir
- Trois décisions à cadrer avec votre CODIR avant la rentrée
- Mise à jour du 13 septembre 2026 : l'API GPT-Live-1 s'ouvre à 0,05 $ la minute, mais le tarif ne s'arrête pas là
- Conclusion
Parler de ce sujet avec Webotit
OpenAI a lancé GPT-Live dans ChatGPT le 8 juillet 2026 puis ouvert l'API GPT-Live-1 le 10 septembre 2026 à 0,05 $/minute pour la couche vocale seule. Une DSI française teste le français en interne avant migration : la parité de langue et l'éligibilité EU Data Zone de l'endpoint ne sont pas publiées, la latence du modèle de raisonnement pairé reste à mesurer séparément.
Ce qu'OpenAI a mis dans les mains le 8 juillet et pourquoi le full-duplex n'est pas un gain de latence
Le 8 juillet 2026, OpenAI a publié GPT-Live, une famille de modèles vocaux composée de GPT-Live-1 et GPT-Live-1 mini.1 La distribution est ciblée : GPT-Live-1 est le modèle par défaut des formules payantes ChatGPT Go, Plus et Pro, et GPT-Live-1 mini est servi aux comptes gratuits.2
Le changement d'architecture est réel. GPT-Live abandonne le modèle « tour de parole » utilisé jusqu'ici par ChatGPT Voice. Le modèle traite l'audio en continu, dans les deux sens, et décide plusieurs fois par seconde s'il faut parler, se taire, poursuivre l'écoute, interrompre son interlocuteur ou déclencher un outil.1 Concrètement : le modèle peut glisser un « mhm » ou un « d'accord » pendant que l'utilisateur parle, tenir un aller-retour rapide, ou rester silencieux si l'utilisateur cherche un mot.1
Pour les questions qui exigent une recherche web, un raisonnement plus long ou un outil complexe, GPT-Live délègue à GPT-5.5 en arrière-plan et rapporte la réponse dans la conversation.2 C'est un schéma connu : un modèle « rapide et social » en façade de conversation, un modèle « lent et savant » derrière. La nouveauté est que la fusion se fait sans que l'utilisateur perçoive le passage de relais.
Beaucoup de commentaires ont réduit ce lancement à un gain de latence. C'est une lecture courte. Le vrai apport du full-duplex se joue sur la gestion des silences et des interruptions, pas sur le temps de premier son. OpenAI annonce, pour son offre voix précédente, une médiane de premier segment audio entre 300 et 600 millisecondes.3 L'entreprise n'a pas publié le chiffre pour GPT-Live. Agora, un fournisseur d'infrastructure temps réel, a mesuré indépendamment le comportement du modèle le jour du lancement : environ 1,1 seconde pour reconnaître qu'un utilisateur a parlé, 1,4 seconde pour céder la parole quand l'utilisateur interrompt, zéro faux arrêt sous voix de fond, et un surcoût moyen de 314 millisecondes en présence de 10 % de pertes de paquets.4
Ces chiffres racontent une histoire différente de « ChatGPT parle plus vite ». Ils décrivent un modèle qui gère mieux la conversation quand elle devient bruyante, désordonnée ou dégradée par le réseau. C'est utile pour un callbot d'assurance où le client parle dans une voiture, ou pour un SAV e-commerce où l'appel arrive derrière un casque de mauvaise qualité. En contrepartie, la latence brute perçue reste proche de la seconde. Un DSI qui attend un callbot « instantané » sera déçu : GPT-Live n'est pas le saut technologique qui rend la voix indistinguable d'un humain. Il rend la conversation plus tolérante aux interruptions et aux silences. Ce sont deux problèmes distincts.
L'API entreprise n'existe pas encore : le vrai calendrier de migration
Le point le plus important pour un CODIR français : votre callbot ne peut pas encore consommer GPT-Live. L'API que vos éditeurs et intégrateurs utilisent pour brancher OpenAI dans une plateforme voix n'est pas ouverte.2
Concrètement, si vous exploitez aujourd'hui un callbot fondé sur la Realtime API — que ce soit GPT-Realtime-2 sorti le 7 mai 2026 avec raisonnement embarqué ou une génération antérieure — votre architecture ne bouge pas d'ici la fin de l'été. Toute promesse commerciale qu'un fournisseur voix vous ferait cette semaine sur GPT-Live en production doit être écrite au conditionnel dans son devis.
OpenAI n'a pas publié de feuille de route entreprise pour GPT-Live à ce jour. Voici le scénario de planification que nous recommandons chez Webotit à un DSI qui doit outiller son équipe callbot dès maintenant — à recalibrer dès qu'OpenAI publie une date d'ouverture API et un SLA. Inscription sur la liste d'attente OpenAI dès maintenant pour l'équipe qui gère votre callbot. Prévoir un accès API partiel plausible en fin d'été ou début d'automne 2026, avec probablement des quotas et sans engagement de service (SLA) formalisé au départ. Tests internes en environnement de préproduction sur un jeu d'appels réels enregistrés, en français, entre septembre et novembre. Décision d'arbitrage en comité de pilotage vers la fin d'année. Migration éventuelle en production au premier ou deuxième trimestre 2027.
Une DSI qui compresse ce calendrier pour être « la première à basculer » prend un risque disproportionné pour un gain d'expérience marginal. Le retour d'expérience de la vague GPT-Realtime-1 vers GPT-Realtime-2, documenté dans notre article de mai, montre qu'un changement de modèle vocal impose au minimum une nouvelle passe d'évaluation qualité, une revalidation des garde-fous et une renégociation de contrat avec le fournisseur télécom.
Le français n'est pas encore une langue de production pour GPT-Live
Deuxième détail que la plupart des équipes ratent : OpenAI reconnaît explicitement que la voix est optimisée pour « la plupart des langues parlées » et que « pour certaines langues, le modèle peut avoir un accent non natif ou des lacunes de fluidité ».5 L'entreprise n'a pas publié de liste de langues prises en charge à parité pour GPT-Live à la date du lancement.5
Pour un service client français qui traite des appels en France, cette formulation doit être lue comme un feu orange. GPT-Realtime, l'offre développeur voix existante, a un cousin dédié à la traduction — gpt-realtime-translate — qui documente 13 langues de sortie dont le français, l'espagnol, le portugais, l'allemand, l'italien, le russe, le chinois, le japonais, le coréen, le hindi, l'indonésien et le vietnamien.5 Mais gpt-realtime-translate est un produit différent, orienté traduction en direct, pas un modèle vocal généraliste de conversation.
Un directeur relation client d'une banque ou d'une mutuelle française qui envisagerait GPT-Live pour son callbot doit donc tester le français en conditions réelles avant tout engagement contractuel. Un accent nord-américain sur un callbot bancaire peut suffire à faire raccrocher un client dès l'entrée en conversation. Un mot mal prononcé sur un numéro d'adhérent mutuelle produit une réclamation.
Ce que ça change pour une entreprise française
Trois canaux concrets où l'annonce du 8 juillet a un impact opérationnel immédiat.
Canal 1 — les cellules SAV e-commerce. Un e-commerçant français qui traite des pics d'appels sur des retours, des livraisons ou des remboursements observe deux choses. L'ergonomie conversationnelle de GPT-Live rend la voix IA plus supportable pour un client déjà agacé — moins de coupures maladroites, plus de silence quand le client hésite. Mais ce bénéfice ne devient monnayable qu'au moment où l'API entreprise est ouverte, ce qui n'est pas encore le cas.2 D'ici là, un pilote callbot d'e-commerce sur GPT-Realtime-2 reste le bon choix opérationnel. Il faut cadrer dès maintenant un dossier de retour sur investissement qui isole ce que le passage éventuel à GPT-Live apporterait vraiment, et ce qu'il coûterait en re-tests.
Canal 2 — les banques et mutuelles régionales. Une banque de détail ou une mutuelle santé française qui exploite un callbot pour des demandes standard — solde, opposition carte, prise de RDV, statut de dossier — doit peser la sensibilité de son audience à l'accent et au ton. La confiance d'un client bancaire tient à des détails de prononciation que GPT-Live n'a pas garantis à parité française. Un callbot de relation client déployé sur GPT-Realtime-2 ou sur une pile Azure vocale reste plus prudent tant qu'OpenAI n'a pas publié un engagement français explicite.
Canal 3 — les callbots médicaux hospitaliers. Un GHT ou un hôpital public qui traiterait des flux de prise de rendez-vous ou d'orientation par callbot fait face à un enjeu de conformité RGPD et santé qui va au-delà du choix de modèle. Le fait que GPT-Live délègue à GPT-5.5 en arrière-plan pour les demandes complexes2 ajoute une deuxième surface d'audit : où passent les données médicales pendant la délégation, dans quelle région, sous quelle certification. Tant qu'OpenAI n'a pas explicité ce point sur GPT-Live pour l'offre entreprise, un DSI d'hôpital français est fondé à attendre.
Dans les trois cas, la décision n'est pas « adopter maintenant ou refuser », mais « préparer une fenêtre d'arbitrage documentée pour début 2027 avec un dossier de test français interne prêt le jour où l'API entreprise ouvre ».
Ce qu'il faut retenir
- GPT-Live sort le 8 juillet 2026 dans ChatGPT, pas dans votre callbot d'entreprise : l'API développeur et entreprise reste sur liste d'attente sans date publiée.2
- Le vrai apport du full-duplex est la gestion des silences et des interruptions, pas la latence brute — Agora mesure 1,1 s pour reconnaître la parole et 1,4 s pour céder le tour, pas moins.4
- Le français n'est pas confirmé à parité : OpenAI parle d'« accent non natif » ou de « lacunes de fluidité » pour certaines langues.5
- Migration recommandée par Webotit pour un callbot d'ETI française, à recalibrer sur la feuille de route entreprise d'OpenAI dès qu'elle est publiée : accès API partiel fin été / début automne, tests français en préproduction, décision en fin d'année, mise en production 2027.
- Recommandation Webotit : un pilote callbot en production sur GPT-Realtime-2 reste le bon choix opérationnel cet été.
Trois décisions à cadrer avec votre CODIR avant la rentrée
Décision 1 — Ne pas remplacer votre callbot en production ce trimestre. Un fournisseur voix qui vous promet GPT-Live cet été promet une capacité qui n'existe pas dans son API. Verrouillez au contrat : le passage à GPT-Live sera un avenant, pas une clause silencieuse, et il déclenche un test qualité français à vos frais avant bascule.
Décision 2 — Inscrire l'équipe callbot sur la liste d'attente OpenAI dès cette semaine. Le moment où vous recevez l'accès API détermine votre position dans la file de bêta-testeurs français. Préparez en parallèle un jeu de tests francophones extrait de vos vrais appels — anonymisés, catégorisés par intention métier, avec des accents régionaux et des conditions audio variées. C'est ce jeu qui vous permettra de trancher, pas la démo publique de ChatGPT.
Décision 3 — Rouvrir la discussion d'architecture avec votre intégrateur. GPT-Live change la façon dont un callbot orchestre les silences et les interruptions. Si votre pile callbot repose sur des modules de détection de fin de parole (endpointing) et d'interruption (barge-in) construits pour un modèle à tours de parole, ces briques deviendront redondantes ou concurrentes du modèle. La gestion technique des interruptions et du VAD dans un agent vocal mérite d'être remise à plat dans votre feuille de route avant la fin de l'année, même si vous ne migrez qu'en 2027.
Mise à jour du 13 septembre 2026 : l'API GPT-Live-1 s'ouvre à 0,05 $ la minute, mais le tarif ne s'arrête pas là
OpenAI a ouvert l'API GPT-Live-1 le 10 septembre 2026, deux mois après le lancement grand public dans ChatGPT.6 Le modèle full-duplex qui manquait à votre callbot d'entreprise est désormais accessible aux développeurs et aux intégrateurs. La thèse du calendrier de juillet ci-dessus n'est plus « attendre l'ouverture » mais « préparer la migration avec un dossier de tests francophones ».
Le prix affiché est de 0,05 $ par minute de voix.7 OpenAI annonce un gain de 30 points sur le benchmark Full Duplex Bench face à GPT-Realtime-2.1, et une première place sur Tau3, un benchmark de service client vocal, quand GPT-Live-1 est associé à GPT-6 Astra en effort de raisonnement moyen.6
Ce que le tarif de 0,05 $ la minute couvre vraiment
Le prix annoncé couvre uniquement la couche vocale. GPT-Live-1 délègue le raisonnement à un modèle backend séparé (GPT-6 Astra, Codex ou ChatGPT Work selon l'usage) et vous payez les tokens de ce modèle en supplément.8 S'ajoutent les frais des outils appelés pendant l'appel (recherche web, exécution de code, base de connaissances) et le temps de conteneur si vous utilisez une sandbox managée.
Un callbot d'assurance qui traite 40 000 appels de trois minutes par mois consomme donc 6 000 $ de voix pure, plus les tokens du modèle de raisonnement pour les cas complexes, plus les outils métier. Le calcul n'est pas un forfait à 0,05 $ la minute, c'est une pile de compteurs. À reconstruire dans votre calculateur de retour sur investissement avant toute signature d'avenant.
Le modèle n'accepte plus l'entrée image que GPT-Live acceptait en juillet : audio et texte seulement.7 Douze voix sont proposées au lancement (Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta, Cinder). Les voix personnalisées ne sont accessibles que via une négociation commerciale.
Trois vérifications avant de reconsidérer la migration
Support du français à parité de qualité. Le blog OpenAI du 10 septembre confirme la disponibilité API mais ne publie toujours pas de liste de langues supportées à parité pour GPT-Live-1.6 La zone d'ombre de juillet reste ouverte. Un directeur relation client qui envisage un pilote francophone doit exiger un test réel sur ses propres flux d'appels avant tout engagement, comme prévu dans le calendrier de juillet ci-dessus.
Résidence des données et conformité DORA/RGPD. OpenAI documente dans sa page Data Controls une éligibilité EU pour certains endpoints (dont le /v1/realtime historique), mais ne publie pas encore, à la date du lancement, l'éligibilité EU Data Zone ni Zero Data Retention spécifique à GPT-Live-1 ou à son endpoint /v1/live/sessions. La résidence de traitement, le stockage, l'éligibilité de l'endpoint et les contrôles applicables aux outils tiers appelés pendant l'appel restent donc à qualifier séparément pour ce endpoint. Cette clarification est un préalable pour les banques françaises soumises à DORA Article 28, comme documenté dans notre analyse Mistral et arbitrage DORA. Une DSI de banque ou de mutuelle doit poser cette question précise à son commercial OpenAI avant de commander un test.
Latence du modèle de raisonnement pairé. Le gain de 30 points sur Full Duplex Bench se mesure sur la couche vocale seule.6 Dès que le callbot doit interroger GPT-6 Astra pour comprendre une demande d'assurance ou de bancaire, la latence perçue par l'appelant redevient celle du modèle backend, pas celle du modèle vocal. Vos tests francophones doivent mesurer les deux séparément.
Notre lecture pour une DSI d'ETI ou de grand compte français
Le calendrier de juillet reste valide, avec un curseur qui avance sans se casser. Le point d'accès API est désormais ouvert, ce qui débloque la phase de préproduction plus tôt que prévu. La partie tests francophones internes reste la même : plusieurs semaines de rejeu sur des appels réels anonymisés. La bascule production reste alignée sur un premier ou second trimestre 2027, avec ou sans OpenAI selon la qualité du français mesurée.
Pour un callbot de relation client qui tourne aujourd'hui sur GPT-Realtime-2 ou sur une pile Azure, la bonne question n'est plus « quand pourrai-je essayer GPT-Live-1 ». C'est « quel jeu de tests francophones je fais valider par mon fournisseur voix avant de signer un avenant qui bascule mon trafic ».
Conclusion
GPT-Live est une vraie avancée sur la couche produit ChatGPT et un signal important pour l'industrie de la voix IA. L'API GPT-Live-1 est ouverte depuis le 10 septembre 2026 (voir la mise à jour ci-dessus), mais l'intégration reste conditionnée à un test qualité français interne, à une clarification EU Data Zone pour l'endpoint, et à un budget qui tient compte de la pile de compteurs voix + tokens + outils. Un CODIR qui fait le tri entre l'annonce et le calendrier réel de migration prend une avance nette sur ses concurrents qui vont perdre du temps à essayer de basculer trop tôt.
Le bon usage de l'automne 2026 reste de solidifier votre callbot actuel, de préparer un dossier de test français interne, et de cadrer avec votre fournisseur le passage éventuel à GPT-Live-1 comme une décision documentée pour 2027, pas comme un pilote de démonstration. Estimez le retour sur investissement de votre callbot actuel et échangez avec un expert Webotit avant de signer tout engagement contractuel qui mentionnerait GPT-Live-1 cette année.
Qu'est-ce que GPT-Live et quand a-t-il été lancé ?
GPT-Live est une famille de modèles vocaux full-duplex publiée par OpenAI le 8 juillet 2026. Elle comprend GPT-Live-1 pour les formules payantes ChatGPT (Go, Plus, Pro) et GPT-Live-1 mini pour l'offre gratuite. Le full-duplex signifie que le modèle écoute et parle simultanément au lieu d'alterner par tours de parole. Les questions nécessitant un raisonnement plus profond ou une recherche web sont déléguées à GPT-5.5 en arrière-plan.12
GPT-Live est-il déjà utilisable dans un callbot d'entreprise ?
Oui, depuis le 10 septembre 2026. OpenAI a ouvert l'API GPT-Live-1 aux développeurs et aux intégrateurs à 0,05 $ par minute de voix, avec 12 voix au lancement et un gain annoncé de 30 points sur Full Duplex Bench face à GPT-Realtime-2.1. Ce prix couvre la couche vocale uniquement : les tokens du modèle de raisonnement backend (GPT-6 Astra, Codex ou ChatGPT Work) et les outils appelés pendant l'appel sont facturés en supplément. Un pilote francophone reste conditionné à un test qualité français interne (la parité de langue n'est pas publiée par OpenAI) et à une clarification de l'éligibilité EU Data Zone spécifique à l'endpoint /v1/live/sessions pour toute DSI soumise à DORA ou RGPD. Voir la mise à jour du 13 septembre 2026 ci-dessus pour la décomposition tarifaire complète.678
Quelle est la latence réelle de GPT-Live pour un callbot ?
OpenAI n'a pas publié de chiffre officiel pour GPT-Live. La mesure indépendante d'Agora, faite le jour du lancement, donne environ 1,1 seconde pour reconnaître qu'un utilisateur a parlé et 1,4 seconde pour céder le tour de parole quand il interrompt, avec un surcoût moyen de 314 millisecondes en présence de 10 % de pertes de paquets. Le full-duplex n'apporte donc pas un gain de latence brute — il apporte une meilleure gestion des silences et des interruptions.4
GPT-Live gère-t-il le français à parité pour un service client français ?
OpenAI reconnaît explicitement que la voix est optimisée pour « la plupart des langues parlées » et que « pour certaines langues, le modèle peut avoir un accent non natif ou des lacunes de fluidité ». Aucune liste de langues à parité n'a été publiée pour GPT-Live. Un service client français qui envisage GPT-Live doit exiger un test réel sur ses propres flux d'appels francophones avant tout engagement.5
Quel calendrier de migration pour une ETI française qui veut passer à GPT-Live ?
Depuis le 10 septembre 2026, l'API GPT-Live-1 est ouverte à 0,05 $/minute pour la couche vocale (voir la mise à jour du 13 septembre ci-dessus). Le calendrier que Webotit recommande à un DSI qui outille son équipe callbot maintenant : accès API disponible immédiatement, tests français en préproduction sur des appels réels anonymisés entre septembre et novembre 2026, décision d'arbitrage en comité de pilotage en fin d'année, migration en production au premier ou deuxième trimestre 2027. Toute promesse d'un fournisseur pour une bascule immédiate doit être verrouillée par un avenant contractuel qui déclenche un test qualité français à ses frais avant mise en production, avec une clarification écrite sur l'éligibilité EU Data Zone de l'endpoint pour un périmètre régulé.6
Sources et references
Articles associés
GPT-Realtime-2 : OpenAI met le raisonnement dans le callbot
GPT-Realtime-2 sort le 7 mai 2026 avec contexte 128K, 5 niveaux de raisonnement et la Realtime API en GA. Ce qu'un DSI français doit cadrer avant de signer.
LireMAI-Voice-2 : ce que la voix native Azure change pour un callbot ETI
Microsoft lance MAI-Voice-2 le 2 juin 2026 : voix native Azure à 22 $/M caractères, 15 langues dont le français, latence temps réel. Ce que ça change.
LireVoice agents : endpointing, barge-in et S2S en prod
Guide 2026 pour concevoir un voice agent qui tient à l’échelle : pipeline STT/LLM/TTS, endpointing, barge-in, Realtime S2S, et téléphonie (Twilio).
Lire

