Aller au contenu principal
Retour à Us
LLM

GPT-5.6 Luna −80 % : rouvrez votre business case chatbot

OpenAI a divisé par 5 le prix de GPT-5.6 Luna le 30 juillet 2026. Recalculez la ligne LLM de votre business case chatbot avant de signer.

Louis-Clément Schiltz
CEO & Founder, Webotit.ai
9 min de lecture

Parler de ce sujet avec Webotit

En bref

Le 30 juillet 2026, OpenAI a baissé le prix de GPT-5.6 Luna de 80 % (0,20 $ / 1,20 $ par million de tokens en entrée / sortie) et celui de Terra de 20 % (2 $ / 12 $). Sol reste inchangé à 5 $ / 30 $. Pour une DSI d'ETI qui prépare un appel d'offres chatbot ou callbot, la baisse suffit à rouvrir un business case signé en juin ou juillet.

Ce qu'OpenAI a annoncé jeudi soir, chiffres à l'appui

Jeudi 30 juillet 2026, OpenAI publie une révision tarifaire de sa famille GPT-5.6, trois semaines après le lancement de Sol, Terra et Luna.1 Deux modèles baissent, un reste stable.

  • Luna passe de 1 $ à 0,20 $ par million de tokens en entrée, et de 6 $ à 1,20 $ en sortie. La baisse est de 80 % en entrée comme en sortie.2
  • Terra passe de 2,50 $ à 2 $ en entrée, et de 15 $ à 12 $ en sortie. La baisse est de 20 %.2
  • Sol reste à 5 $ en entrée et 30 $ en sortie.2

OpenAI attribue la baisse à des gains d'efficacité obtenus en utilisant GPT-5.6 en interne pour réécrire son propre code d'inférence : le coût de service bout-en-bout aurait reculé de 20 % et la génération de tokens gagné plus de 15 % d'efficacité.3 Le même jour, Sarah Friar, directrice financière d'OpenAI, indique en interne que le revenu annualisé de juillet dépasse à lui seul l'ensemble du deuxième trimestre, porté par la famille GPT-5.6, ChatGPT Work et Codex.4

La grille officielle publiée sur openai.com confirme les nouveaux tarifs et précise que Luna est optimisé pour les traitements à faible latence et à haut volume — exactement le profil d'un chatbot ou d'un callbot en production.5

Ce que la nouvelle grille change pour un chatbot ou un callbot ETI

Reprenez votre business case de juin. La ligne « coût LLM » y était chiffrée sur les tarifs Luna ou Terra d'origine (1 $ / 6 $ et 2,50 $ / 15 $). Si votre moteur de réponse tournait sur Luna, cette ligne vient d'être divisée par cinq ; si elle tournait sur Terra, elle recule d'un cinquième. La part de la ligne modèle dans le coût complet (TCO) varie fortement selon l'architecture retenue, mais tout ce qui touche à l'inférence LLM subit la même baisse en pourcentage.

Prenons une formule illustrative — pas un profil « typique ». Notons E le volume mensuel de tokens en entrée (en millions) et S le volume en sortie. Sur Luna, le coût modèle mensuel passe de E × 1 + S × 6 à E × 0,20 + S × 1,20. Sur Terra, il passe de E × 2,50 + S × 15 à E × 2 + S × 12.

Deux exemples chiffrés, purement mathématiques, pour rendre l'ordre de grandeur lisible. Pour E = 200 et S = 40 sur Luna, la facture mensuelle passe de 440 $ à 88 $ (−80 %). Pour les mêmes volumes sur Terra, elle passe de 1 100 $ à 880 $ (−20 %). Ces montants ne sont pas issus d'une étude sectorielle publiée : ce sont les valeurs que produit la formule à ces deux entrées. Substituez vos propres E et S pour obtenir votre chiffre.

Cette arithmétique n'est valable qu'à volume tokens équivalent. Si votre projet inclut du RAG, une couche d'orchestration, une base vecteur, une téléphonie SIP et des SLA voix, ces lignes ne bougent pas. Ce qui bouge, c'est la part LLM du TCO — la seule ligne qui, jusqu'ici, servait de justification au « on attend pour lancer » quand une direction financière trouvait le tarif trop élevé pour un modèle de pointe.

Trois arbitrages à revoir cette semaine avant votre appel d'offres

Premier arbitrage — votre business case interne. Si votre CODIR a arbitré en juin ou juillet un projet chatbot ou callbot sur la base d'un coût LLM Luna ou Terra, le TCO à 12 mois n'est plus le même. Ne signez pas le bon de commande sur l'ancienne grille : demandez à votre intégrateur ou à votre éditeur une note à 48 heures qui recalcule la ligne LLM sur la grille du 30 juillet. Deux cas se présentent. Soit le projet devient rentable plus tôt et vous accélérez le calendrier de production. Soit le seuil de ROI passe sous la barre annuelle et vous transformez un pilote en programme.

Deuxième arbitrage — vos appels d'offres en cours. Si vous êtes en phase d'appel d'offres chatbot, callbot ou mailbot et que les candidats vous ont chiffré une consommation tokens en juillet, exigez une révision de la ligne coût modèle avec les tarifs du 30 juillet. Un fournisseur qui refuse la révision ou qui la négocie mollement ne maîtrise pas sa marge et vous fera payer la baisse plus tard. C'est un signal utile pour arbitrer entre deux candidats à qualité comparable.

Troisième arbitrage — votre clause de révision tarifaire. Le mouvement du 30 juillet n'est probablement pas le dernier. Les analystes lisent la baisse Luna comme une réponse frontale à la pression coût côté clients — Uber aurait consommé son budget IA annuel en quatre mois avant d'introduire des paliers de dépense — et à la concurrence des modèles chinois à poids ouverts.6 Ajoutez à vos contrats LLM Enterprise une clause de révision automatique quand le fournisseur publie une baisse supérieure à 20 % sur un modèle de votre grille de référence. Sans clause, vous découvrez le prochain palier au renouvellement, pas au trimestre où il tombe.

Si la question tourne autour du dimensionnement fin, notre simulateur du coût callbot par appel intègre la baisse et donne un ordre de grandeur en dix minutes.

Ce que ça change pour une entreprise française

Pour une direction relation client d'assurance ou de mutuelle, la baisse Luna rend viable un chatbot adhérent qui absorbe des questions de niveau 1 (état de remboursement, pièces manquantes, calendrier de télétransmission) à un coût unitaire qui rentre dans le budget d'un centre de contact classique. Le sujet n'était pas tenable à 6 $ par million de tokens en sortie. Il l'est à 1,20 $. La discussion se déplace de « on attend que ça baisse » à « quel taux de reprise humaine on accepte au démarrage ». Une compagnie ou une mutuelle française qui préparait un pilote pour l'automne peut désormais poser une question opérationnelle : combien d'appels ou d'emails absorbe le chatbot déployé pour la relation adhérent avant d'atteindre son seuil de satisfaction cible, et à quel horizon.

Pour une direction e-commerce ETI, l'arithmétique se joue sur le volume. Un site marchand qui traite plusieurs dizaines de milliers de conversations par mois voyait la ligne LLM peser lourdement sur le TCO d'un chatbot SAV branché sur Luna ou Terra. La baisse ouvre la porte à un chatbot qui répond à plus de types de demandes — retours, suivi de commande, disponibilité produit, préventes — sans que le coût par conversation devienne un point de blocage en comité de pilotage. Le seuil de bascule n'est plus « à partir de combien on limite les scénarios pour tenir le budget », c'est « jusqu'où on étend la couverture sans dégrader la marge ».

Pour une DSI d'ETI industrielle ou publique, la baisse Terra concerne moins le prix affiché que la crédibilité du business case. Un modèle de milieu de gamme facturé 2 $ / 12 $ passe sous le seuil psychologique au-delà duquel une direction financière refuse de valider un projet IA sans preuves de ROI documentées. Cela ne dispense pas de produire ces preuves, mais cela raccourcit la conversation en comité d'investissement, en particulier pour un chatbot ou un callbot déployé sur des processus internes — assistance informatique, RH, achats, questions réglementaires — où la fiabilité prime sur la fluidité conversationnelle.

Trois précautions restent en revanche entières. La disponibilité API globale s'est ouverte le 9 juillet 2026 pour les utilisateurs éligibles de l'EEE, de la Suisse et du Royaume-Uni, après la levée par OpenAI du régime « 20 partenaires US validés » qui prévalait au lancement du 26 juin 2026.58 Côté résidence d'inférence, la matrice diffère par plateforme : Microsoft Foundry propose GPT-5.6 Sol, Terra et Luna en Data Zone Standard UE — le trafic est routé vers un datacenter à l'intérieur de la frontière EU Data Boundary.9 AWS Bedrock restreint GPT-5.6 Terra à l'inférence In-Region aux États-Unis (N. Virginia, Ohio, Oregon), sans profil d'inférence Geo ou Global couvrant l'Europe.10 Une DSI qui cible Azure peut donc capturer la baisse en zone UE ; une DSI qui cible Bedrock reste, pour l'Europe, sur GPT-5.5 In-Region ou attend une extension géographique côté AWS. La conformité EU AI Act ne bouge pas d'un centimètre avec la grille tarifaire : à compter du 2 août 2026, l'Article 50(1) du règlement (UE) 2024/1689 impose aux fournisseurs de systèmes d'IA destinés à interagir directement avec une personne physique de concevoir le système pour que cette personne soit informée qu'elle interagit avec une IA — sauf si cette nature est manifestement évidente pour une personne raisonnablement bien informée, attentive et avisée, ou si le système est autorisé par la loi pour détecter, prévenir, enquêter ou poursuivre des infractions pénales avec garanties appropriées (exception qui ne s'applique pas si le système est accessible au public pour signaler une infraction).7 Les obligations GPAI courent depuis le 2 août 2025 ; les pouvoirs de sanction correspondants de l'AI Office (Articles 91 à 93 et amendes Article 101) s'activent au 2 août 2026.11 Enfin, le prix affiché n'est pas le TCO : latence, garanties SLA, portabilité des modèles affinés et coût d'observabilité pèsent souvent plus lourd que la ligne modèle sur un déploiement à 24 mois.

Trois décisions concrètes à prendre en août

Un. Recalculer la ligne LLM de tout projet chatbot, callbot ou mailbot chiffré en juillet, sur la grille du 30 juillet, avant de signer un bon de commande. La note tient en deux pages et se produit en 48 heures.

Deux. Rouvrir les appels d'offres LLM Enterprise déjà émis où la consommation tokens est un critère de sélection, avec une demande explicite de révision. Un fournisseur qui ne passe pas la baisse fournit un signal utile pour arbitrer.

Trois. Ajouter aux contrats LLM Enterprise renouvelés d'ici la fin de l'année une clause de révision automatique déclenchée dès qu'un fournisseur publie une baisse supérieure à 20 % sur un modèle de votre grille de référence. Cette clause coûte peu à négocier maintenant, cher à récupérer plus tard.

Si votre CODIR veut chiffrer l'impact d'une bascule sur le business case, le calculateur de retour sur investissement Webotit intègre les tarifs post-30 juillet et produit un scénario ETI type en quelques minutes.

Conclusion : la baisse est acquise, l'accès et la gouvernance restent à cadrer

La baisse Luna −80 % est le premier mouvement tarifaire agressif d'OpenAI depuis le lancement de la famille GPT-5.6 il y a trois semaines. Elle transforme la ligne modèle d'un chatbot ETI de « décision arbitrée » en « bruit de fond ». Elle valide, au passage, la thèse défendue en mars par notre article sur la guerre des prix LLM : la trajectoire prix des LLM de pointe rend viables des cas d'usage qui ne l'étaient pas il y a dix-huit mois.

Deux réserves opérationnelles restent en travers du chemin. La disponibilité API est ouverte pour les utilisateurs éligibles en EEE, Suisse et Royaume-Uni depuis le 9 juillet, mais la résidence d'inférence dépend de la plateforme : Microsoft Foundry propose la famille GPT-5.6 en Data Zone Standard UE,9 quand AWS Bedrock restreint GPT-5.6 Terra à l'inférence In-Region aux États-Unis.10 Et la conformité EU AI Act prend effet à compter du 2 août 2026 : l'obligation Article 50(1) de transparence chatbot devient opposable, indépendamment de la grille tarifaire.

La bonne question pour votre CODIR d'août n'est donc pas « faut-il basculer sur Luna ». C'est « quelle combinaison de fournisseurs LLM permet de capturer la baisse là où elle est livrable et de rester conforme où elle ne l'est pas encore ». Chez Webotit, nous répondons à cette question à travers une orchestration d'agents IA gouvernable et multi-modèle, avec bascule Mistral en repli et clause de portabilité contractuelle.

Questions frequentes

Quel est le nouveau prix de GPT-5.6 Luna et Terra au 30 juillet 2026 ?

Luna passe à 0,20 $ par million de tokens en entrée et 1,20 $ en sortie, contre 1 $ / 6 $ auparavant, soit une baisse de 80 %. Terra passe à 2 $ en entrée et 12 $ en sortie, contre 2,50 $ / 15 $, soit une baisse de 20 %. Sol reste à 5 $ / 30 $. Ces tarifs sont publiés sur la grille officielle OpenAI et confirmés par les principales sources presse du 30 juillet.25

La baisse Luna change-t-elle le TCO d'un chatbot ou d'un callbot ETI ?

Oui, mais uniquement sur la ligne LLM. Sur Luna, la formule mensuelle passe de E × 1 + S × 6 à E × 0,20 + S × 1,20 (avec E et S en millions de tokens en entrée / sortie), soit une baisse de 80 %. À titre d'illustration mathématique (pas une charge « typique »), pour E = 200 et S = 40, la facture passe de 440 $ à 88 $ par mois. Les autres lignes du TCO — RAG, orchestration, téléphonie SIP, observabilité, conduite du changement — ne sont pas affectées.

Faut-il rouvrir un business case chatbot signé en juin ou juillet 2026 ?

Oui, si la ligne coût modèle utilisait Luna ou Terra dans son dimensionnement. La baisse suffit à faire passer certains projets marginaux au-dessus du seuil de ROI attendu, ou à raccourcir le retour sur investissement d'un pilote. La note de recalcul tient en deux pages et se produit en 48 heures. Le résultat sert à décider si le bon de commande part sur l'ancienne grille ou si le calendrier s'accélère.

Pourquoi OpenAI baisse-t-il maintenant plutôt qu'au lancement de GPT-5.6 ?

OpenAI attribue publiquement la baisse à des gains d'efficacité obtenus en utilisant GPT-5.6 pour réécrire son propre code d'inférence : coût de service bout-en-bout réduit de 20 %, efficacité de génération améliorée de plus de 15 %.3 La lecture presse ajoute deux facteurs : la pression coût des clients Enterprise (Uber aurait consommé son budget IA annuel en quatre mois avant d'introduire des paliers de dépense)6 et la concurrence des modèles chinois à poids ouverts qui grignotent le bas de gamme sur les traitements de volume.

La baisse concerne-t-elle aussi la disponibilité européenne de GPT-5.6 ?

La disponibilité API pour l'EEE, la Suisse et le Royaume-Uni a été ouverte le 9 juillet 2026, après la levée par OpenAI du régime « 20 partenaires US validés » qui prévalait au lancement du 26 juin — contexte historique dans GPT-5.6 bloqué hors US : votre shortlist LLM Q4 2026 retombe à 3.58 Côté résidence d'inférence, la matrice diffère par plateforme : Microsoft Foundry propose GPT-5.6 Sol, Terra et Luna en Data Zone Standard UE (routage dans la frontière EU Data Boundary),9 alors qu'AWS Bedrock restreint GPT-5.6 Terra à l'inférence In-Region aux États-Unis (N. Virginia, Ohio, Oregon), sans profil Geo ou Global.10 Une DSI qui cible Bedrock pour un usage européen reste sur GPT-5.5 In-Region ou attend une extension géographique côté AWS — la baisse tarifaire ne modifie pas cette contrainte.

Sources et references

  1. [1]
  2. [2]
  3. [3]
  4. [4]
  5. [5]
  6. [6]
  7. [7]
  8. [8]
  9. [9]
  10. [10]
  11. [11]
OpenAIGPT-5.6prix API LLMcoût chatbotcallbotappel d'offresETI France