Claude Sonnet 5 : tarif de lancement jusqu'au 31 août, puis +50 %
Claude Sonnet 5 : tarif de lancement jusqu'au 31 août, puis +50 %
Anthropic lance Sonnet 5 à 2/10 $ par million de tokens jusqu'au 31 août 2026. Au 1er septembre : 3/15 $, plus un tokenizer qui gonfle les factures.
Sommaire
- Le 30 juin 2026, Anthropic ouvre Sonnet 5 avec un tarif d'appel qui ferme le 31 août
- « Coût neutre » est exact jusqu'au 31 août, faux le 1er septembre
- Sur les benchmarks agents, Sonnet 5 talonne Opus 4.8 pour 40 à 60 % de son prix
- Trois scénarios français où l'arbitrage bascule vraiment
- Ce que ça change pour une entreprise française
- Trois décisions à prendre avant le 1er septembre 2026
- Conclusion
Parler de ce sujet avec Webotit
Le 30 juin 2026, Anthropic lance Claude Sonnet 5 à 2 $ / 10 $ par million de tokens jusqu'au 31 août 2026. Au 1er septembre, le tarif passe à 3 $ / 15 $, soit +50 %. Le nouveau tokenizer peut produire jusqu'à 35 % de tokens en plus pour le même texte. Une DSI française a jusqu'au 31 août pour éprouver ses agents IA avant que la facture réelle bouge.
Le 30 juin 2026, Anthropic ouvre Sonnet 5 avec un tarif d'appel qui ferme le 31 août
Le mardi 30 juin 2026, Anthropic met Claude Sonnet 5 à disposition sur Claude.ai, Claude Code, l'API Claude Platform et AWS Bedrock. Le tarif de lancement est fixé à 2 dollars par million de tokens en entrée et 10 dollars par million de tokens en sortie jusqu'au 31 août 2026 inclus.12 À partir du 1er septembre 2026, le tarif public passe à 3 dollars en entrée et 15 dollars en sortie.3 C'est une hausse de 50 % du prix affiché au million de tokens.
Le modèle est présenté par Anthropic comme le Sonnet le plus agentique jamais publié : planification, utilisation d'outils navigateur et terminal, autonomie sur des tâches multi-étapes.4 Il est disponible par défaut pour les utilisateurs Free et Pro de Claude.ai et pour les plans Max, Team et Enterprise.1
Ce sont deux faits distincts. Le premier est marketing : un modèle plus puissant, plus autonome, plus utile pour des agents IA en production. Le second est comptable : deux mois de tarif préférentiel, puis une facture qui monte, sur un modèle qui s'imposera probablement par défaut dans beaucoup d'usages.
« Coût neutre » est exact jusqu'au 31 août, faux le 1er septembre
Anthropic a positionné ce tarif de lancement comme « approximativement coût neutre » par rapport à Sonnet 4.6, sur la base d'un même texte facturé.3 C'est une formulation qui mérite d'être lue en entier, parce qu'elle contient deux mécanismes qu'un directeur financier ne voit pas dans un tableau de tarif.
Premier mécanisme : la hausse de tarif du 1er septembre. À partir de ce jour, le prix par million de tokens augmente de 50 % côté entrée comme côté sortie.3 Un contrat annuel déjà signé sur la base de Sonnet 4.6 (3/15 $) reste sur les mêmes rails ; un budget du quatrième trimestre calibré sur les 2/10 $ affichés le 30 juin bouge de 50 % au 1er septembre.
Deuxième mécanisme : le nouveau tokenizer. Sonnet 5 utilise un tokenizer différent de celui de Sonnet 4.6. Sur le même texte, le nouveau tokenizer peut produire jusqu'à 1,35 fois plus de tokens comptabilisés.3 Un prompt qui coûtait 100 tokens sur Sonnet 4.6 peut en coûter jusqu'à 135 sur Sonnet 5 — sans qu'aucune ligne de code ni aucun texte utilisateur ne change. Anthropic a précisément calibré ce tarif de lancement à 2/10 $ pour que la combinaison « nouveau prix × nouveau tokenizer » retombe proche de la facture Sonnet 4.6.
Les deux mécanismes ne s'empilent pas de la même façon selon d'où l'on part. Pour qui migre de Sonnet 4.6 vers Sonnet 5 après le 1er septembre, le tarif public reste identique (3/15 $) : l'écart de facture provient uniquement du tokenizer et peut atteindre +35 % sur les mêmes requêtes.3 Pour qui a calibré son budget sur les 2/10 $ affichés le 30 juin, la bascule au tarif public de 3/15 $ pèse +50 % en tarif, à volume de tokens constant. Un directeur financier doit donc poser les deux repères, pas un seul.
Sur les benchmarks agents, Sonnet 5 talonne Opus 4.8 pour 40 à 60 % de son prix
Le calcul économique du modèle repose sur trois mesures publiées avec le system card du 30 juin, revues par METR, Apollo Research et l'AI Security Institute britannique.5
Sur SWE-bench Pro (référence de codage agentique multi-étapes), Sonnet 5 marque 63,2 %, contre 69,2 % pour Opus 4.8 et 58,1 % pour Sonnet 4.6.46 Sur Terminal-Bench 2.1 (exécution de tâches en terminal), Sonnet 5 atteint 80,4 %, au-dessus des 74,6 % d'Opus 4.8.7 Sur des tâches de travail intellectuel, Sonnet 5 dépasse légèrement Opus 4.8.4
L'écart de tarif change la lecture. Opus 4.8 est facturé 5 dollars par million de tokens en entrée et 25 dollars en sortie sur l'API Claude.8 Sonnet 5 est à 2/10 $ jusqu'au 31 août et passera à 3/15 $ le 1er septembre.3 Sur la période de lancement, un agent qui aurait tourné sur Opus 4.8 pour rester au niveau agentique peut basculer sur Sonnet 5 à environ 40 % du prix, en gardant l'écrasante majorité des performances agents et en dépassant Opus 4.8 sur Terminal-Bench et sur le travail intellectuel. Après le 1er septembre, le rapport reste favorable : Sonnet 5 à 3/15 $ coûte 40 % de moins qu'Opus 4.8 à volume de tokens égal.
Opus 4.8 conserve un avantage net sur les tâches de raisonnement les plus exigeantes et sur les revues cybersécurité.4 Pour un chatbot relation client, un mailbot de qualification ou un callbot d'appels sortants, la balance penche pour Sonnet 5. Pour un agent de conformité qui tranche sur des dossiers réglementaires ACPR ou ANSSI, Opus 4.8 reste le bon choix par défaut.
Trois scénarios français où l'arbitrage bascule vraiment
Pour éviter le flou, voici trois scénarios illustratifs. Ce ne sont pas des cas clients Webotit : ce sont des cas types, construits sur des volumes typiques et des tarifs publics, pour montrer où le calcul change.
Scénario 1 — Chatbot d'assistance dans le retail français. Un distributeur exploiterait un chatbot de support à 80 000 sessions par mois, environ 800 tokens par session en moyenne, mix 60 % entrée / 40 % sortie. Volume mensuel de référence sur Sonnet 4.6 : 64 millions de tokens. Sur Sonnet 4.6 à 3/15 $, la facture mensuelle s'établirait autour de 500 dollars. Sur Sonnet 5 au tarif de lancement (2/10 $), la facture tomberait autour de 330 dollars à volume de tokens équivalent (fixe) ; en tenant compte du nouveau tokenizer (jusqu'à 1,35× de tokens comptabilisés sur le même texte), elle monterait jusqu'à ~450 dollars — soit une économie réelle qui va de ~10 % (borne haute tokenizer) à ~34 % (fixe), pas 34 % automatique. Au 1er septembre, avec 3/15 $ + tokenizer, la facture retomberait entre 500 et 675 dollars mensuels selon le facteur d'inflation réel. Décision utile : lancer un pilote sans attendre, mesurer le facteur tokenizer sur les prompts réels, décider avant le 31 août.
Scénario 2 — Agent IA back-office dans un distributeur français. Un directeur des opérations lancerait un agent IA qui traite 12 000 conversations par mois de résolution de litiges, avec un contexte moyen de 20 000 tokens et une réponse de 2 000 tokens. Volume mensuel de référence : 240 millions de tokens en entrée et 24 millions en sortie. Sur Opus 4.8 à 5/25 $, la facture serait autour de 1 800 dollars par mois (1 200 en entrée + 600 en sortie). Sur Sonnet 5 au tarif de lancement (2/10 $) à volume de tokens équivalent, elle tomberait autour de 720 dollars par mois — 40 % du coût Opus 4.8. Avec un tokenizer Sonnet 5 à 1,35× sur les mêmes prompts, elle monterait à ~970 dollars par mois — encore 54 % du coût Opus 4.8. Sur les tâches agentiques concernées, les benchmarks publiés indiquent une performance proche.4 Décision utile : la marge est structurellement plus large ici, donc l'arbitrage Opus 4.8 → Sonnet 5 dégagerait entre 830 et 1 080 dollars mensuels pendant la période de lancement selon le facteur tokenizer réel, à condition que la qualité de raisonnement reste au niveau sur un échantillon de production. Après le 1er septembre, l'écart reste solide à ce volume.
Scénario 3 — Mailbot de qualification chez une mutuelle santé. Une mutuelle sous contrainte ACPR + HDS ferait tourner un mailbot qui qualifie 200 000 emails d'adhérents par mois. Volume de référence sur Sonnet 4.6 : 300 millions de tokens, très largement à dominante entrée. Le cas n'est pas latence-critique, il est conformité-critique. À volume de tokens équivalent, le tarif Sonnet 5 de lancement tomberait autour de 700 dollars par mois contre 1 050 dollars sur Sonnet 4.6, soit 33 % d'économie théorique jusqu'au 31 août. Avec un tokenizer Sonnet 5 à 1,35× sur les mêmes emails, la facture réelle Sonnet 5 remonterait autour de 945 dollars — l'économie tombe à ~10 %. À partir du 1er septembre, avec 3/15 $ et le même tokenizer, l'avantage s'inverse : la facture dépasserait celle de Sonnet 4.6 d'environ 35 %. Décision utile : profiter de cette fenêtre pour tester la précision de Sonnet 5 sur des emails réels d'adhérents en environnement isolé et mesurer le facteur tokenizer sur du français administratif, puis décider avant fin août si Sonnet 5 reste sur le trajet ou si le mailbot reste sur Sonnet 4.6 pour verrouiller la facture connue.
Un point commun aux trois scénarios : la fenêtre de lancement ne rembourse pas un projet, elle rembourse un pilote bien conçu. Sur Sonnet 4.6 → Sonnet 5 (Scénarios 1 et 3), la vraie économie de cette fenêtre dépend d'un chiffre non publié par Anthropic : le facteur tokenizer réel sur vos prompts français. Sur Opus 4.8 → Sonnet 5 (Scénario 2), la marge structurelle rend la bascule solide même à 1,35×. C'est cette asymétrie qu'un comité FinOps doit poser avant de décider.
Ce que ça change pour une entreprise française
Si vous êtes DSI, directeur relation client ou directeur des achats IT d'une ETI française, la sortie de Sonnet 5 change trois choses concrètes, mais aucune de manière évidente.
Elle rouvre le sujet FinOps IA avant le 1er septembre. Un budget LLM du quatrième trimestre arrêté sur la base des tarifs Sonnet 4.6 ne demande aucune action. Un budget recalibré sur les 2/10 $ affichés le 30 juin doit être resigné avec le tarif du 1er septembre. Sinon, la ligne facture explosera fin T3 sans discussion en amont.
Elle repositionne les projets qui étaient calés « Opus 4.8 obligatoire ». Pour un agent IA de back-office, une équipe qui avait tranché sur Opus 4.8 au printemps faute d'alternative agentique crédible peut réviser sa décision. La fenêtre ouverte jusqu'au 31 août est le bon moment pour un test A/B sérieux, pas pour une bascule non instrumentée. Nous avions analysé la logique multi-agents d'Opus 4.8 dans Claude Opus 4.8 et Dynamic Workflows : Sonnet 5 ne remplace pas Opus 4.8 sur toutes ces charges, mais il ouvre un chemin de descente pour les agents secondaires.
Elle rend la mise en cache des prompts (prompt caching) difficile à ignorer. Anthropic facture les tokens lus depuis le cache à environ un dixième du prix d'entrée, et les tokens écrits en cache légèrement au-dessus.3 Sur un chatbot avec des prompts système longs et répétitifs, l'écart peut être significatif. La logique tenait déjà sur Sonnet 4.6 ; avec un tokenizer qui gonfle jusqu'à 35 % le compte de tokens, elle devient encore plus dure à ignorer.
Webotit conçoit ses chatbots, callbots, mailbots et équipes d'agents IA pour rester découplés du fournisseur de LLM et du tokenizer sous-jacent — Claude, GPT, Mistral ou Gemini, selon le ratio coût/qualité du cas d'usage. Ce découplage n'est pas un argument marketing, c'est ce qui permet de basculer d'Opus 4.8 vers Sonnet 5 pendant la fenêtre de lancement, puis de rearbitrer au 1er septembre sans réécrire un produit. Si vous voulez chiffrer ce que ça donne pour votre périmètre, estimez le retour sur investissement d'un chatbot ou callbot Webotit. Si vous préparez un projet agents IA back-office sur les 90 prochains jours, la fenêtre de lancement Sonnet 5 est un vrai levier de pilote — à condition d'en sortir avec des chiffres exploitables.
Trois décisions à prendre avant le 1er septembre 2026
1. Mesurer l'inflation tokens sur vos prompts réels. Anthropic annonce un facteur jusqu'à 1,35× sur les tokens comptabilisés.3 Le chiffre exact dépend de vos textes (français vs anglais, mots techniques, structure JSON). Un test sur 1 000 requêtes représentatives, avec comparaison token-count Sonnet 4.6 vs Sonnet 5, donne le vrai facteur d'inflation à intégrer dans votre budget du quatrième trimestre.
2. Réviser les projets calibrés Opus 4.8. Pour chaque agent IA en production ou en pilote sur Opus 4.8, poser la question : « est-ce que Sonnet 5 couvre 100 % des cas critiques ? » Si oui, la migration d'ici au 31 août peut dégager plusieurs milliers d'euros par mois. Si non, documenter précisément lesquels ne passent pas — c'est de l'information utile pour la revue de fin d'année.
3. Renégocier les contrats Anthropic en cours. Si vous avez un contrat Enterprise avec Anthropic ou un revendeur, le tarif de lancement publié le 30 juin est un précédent tarifaire utilisable. Pour un volume significatif au quatrième trimestre, une clause d'ajustement au 1er septembre — plancher de remise, garantie de prix, ou plafond de facturation — vaut la peine d'être demandée avant que le tarif public bascule.
Conclusion
Un tarif de lancement annoncé sur deux mois n'est pas une remise. C'est une invitation à tester, mesurer et arbitrer avant que la facture réelle ne bouge : jusqu'à +50 % par rapport au tarif de lancement pour qui aurait calibré le T4 sur les 2/10 $, et jusqu'à +35 % vs Sonnet 4.6 via le nouveau tokenizer. Pour une DSI française qui prépare son budget agents IA du quatrième trimestre 2026, la fenêtre du 30 juin au 31 août est la seule vraie occasion de calibrer sur données réelles avant que la ligne Anthropic ne se resserre.
Sonnet 5 est un bon modèle. Il n'est pas neutre pour votre facture au 1er septembre. La question utile n'est pas « faut-il migrer » : c'est « qu'est-ce qu'on a mesuré d'ici fin août pour que la décision se prenne sur des chiffres ».
Vous préparez un projet chatbot, callbot, mailbot ou agents IA et vous voulez le découpler dès la conception de votre fournisseur de LLM ? Discutez-en avec nos équipes spécialisées en IA conversationnelle Webotit.
Questions frequentes
Quand Claude Sonnet 5 est-il sorti et quel est son tarif ?
Claude Sonnet 5 a été mis à disposition par Anthropic le 30 juin 2026 sur Claude.ai, Claude Code, l'API Claude Platform et AWS Bedrock. Le tarif de lancement est de 2 dollars par million de tokens en entrée et 10 dollars par million de tokens en sortie jusqu'au 31 août 2026 inclus. À partir du 1er septembre 2026, le tarif public passe à 3 dollars en entrée et 15 dollars en sortie, soit une hausse de 50 %.
Pourquoi le tokenizer de Sonnet 5 change-t-il la facture ?
Sonnet 5 utilise un tokenizer différent de celui de Sonnet 4.6. Sur un même texte, il peut produire jusqu'à 35 % de tokens comptabilisés en plus. Un prompt qui coûtait 100 tokens sur Sonnet 4.6 peut en coûter jusqu'à 135 sur Sonnet 5, sans qu'aucune modification n'ait été apportée au prompt. Pour qui migre depuis Sonnet 4.6, le tarif public reste identique (3/15 $) mais la facture peut monter jusqu'à +35 % via ce seul effet. Pour qui aurait calibré son budget sur les 2/10 $ affichés le 30 juin, la bascule au tarif public au 1er septembre ajoute +50 % à volume de tokens constant.
Sonnet 5 remplace-t-il Opus 4.8 pour les agents IA ?
Non, pas totalement. Sur les benchmarks agents publiés le 30 juin 2026, Sonnet 5 marque 63,2 % sur SWE-bench Pro contre 69,2 % pour Opus 4.8 et bat Opus 4.8 sur Terminal-Bench 2.1 (80,4 % contre 74,6 %) et sur le travail intellectuel. Sur les tâches de raisonnement les plus exigeantes et sur la cybersécurité, Opus 4.8 reste devant. Sonnet 5 devient donc un choix par défaut solide pour de nombreux agents back-office et front-office, mais Opus 4.8 conserve les cas critiques de raisonnement long.
Que doit tester une DSI française pendant la fenêtre de lancement Sonnet 5 ?
Trois choses concrètes. Un, mesurer l'inflation tokens sur 1 000 requêtes représentatives en français pour connaître le facteur d'inflation réel entre Sonnet 4.6 et Sonnet 5. Deux, comparer la qualité de sortie Sonnet 5 vs Opus 4.8 sur les agents IA back-office pour identifier les cas où la bascule est possible. Trois, activer et instrumenter la mise en cache des prompts sur les prompts système répétitifs, dont la logique économique se renforce avec le nouveau tokenizer.
Sonnet 5 est-il disponible sur AWS Bedrock pour un déploiement en région France ?
Oui. Anthropic et AWS ont annoncé le 30 juin 2026 la disponibilité de Sonnet 5 sur Amazon Bedrock, avec la prise en charge du même tarif de lancement. Pour une entreprise française qui a déjà cadré sa conformité sur Bedrock, la bascule technique se limite à un changement de nom de modèle dans l'API. La cartographie fournisseur reste inchangée, ce qui est utile pour les revues AI Act et DORA en cours.
Sources et references
Articles associés

Claude Fable 5 : Mythos en production, tarif x2, fenêtre J-11
Anthropic ouvre Claude Fable 5 le 9 juin 2026 : 10/50 $ par M tokens, fallback Opus 4.8 sur cyber et bio, gratuit Pro/Max/Team/Enterprise jusqu'au 22 juin.
Lire
GPT-5.6 bloqué hors US : votre shortlist LLM Q4 2026 retombe à 3
OpenAI réserve GPT-5.6 Sol, Terra et Luna à 20 partenaires US validés par Washington. Voici comment ajuster votre contrat LLM Q4 dès cette semaine.
Lire
Anthropic coupe : ce que ça change pour vos contrats LLM en France
L'interdiction US Fable 5 et Mythos 5 du 12 juin oblige toute ETI française à rouvrir ses clauses LLM. Anatomie d'une fenêtre d'arbitrage de 90 jours.
Lire