Claude Sonnet 5 : le tarif 2/10 $ devient permanent, hausse annulée
Claude Sonnet 5 : le tarif 2/10 $ devient permanent, hausse annulée
Anthropic rend permanent le tarif 2/10 $ de Sonnet 5 (annonce du 10 août 2026). La hausse à 3/15 $ prévue au 1er septembre n'aura pas lieu.
Sommaire
- Anthropic annule la hausse et fige Sonnet 5 à 2 / 10 $
- Le tokenizer compte environ 30 % de tokens en plus
- Sonnet 5 talonne Opus 4.8 sur les tests agents, à 40 % du prix
- Ce que ça change sur votre facture, en trois calculs
- Votre budget agents IA du T4 2026 tient en quatre décisions
- Un prix figé par la concurrence, pas par générosité
- Mise à jour du 29 septembre 2026 : Sonnet 5.5 baisse la facture sans changer le tarif
Parler de ce sujet avec Webotit
Le 10 août 2026, Anthropic rend permanent le tarif de Claude Sonnet 5 : 2 $ en entrée et 10 $ en sortie par million de tokens. La hausse à 3 $ / 15 $ prévue au 1er septembre est annulée. Votre budget du T4 2026 se stabilise. Reste à mesurer le tokenizer, qui compte environ 30 % de tokens en plus.
Anthropic annule la hausse et fige Sonnet 5 à 2 / 10 $
Le 10 août 2026, Anthropic a rendu permanent le tarif d'appel de Claude Sonnet 5. Il est de 2 dollars par million de tokens en entrée, 10 dollars en sortie. Un token est un fragment de texte, l'unité que le fournisseur facture. La documentation officielle de la plateforme le confirme. La hausse à 3 et 15 dollars, prévue au 1er septembre 2026, n'aura pas lieu.8910
Rappel du calendrier. Le 30 juin 2026, Anthropic ouvre Sonnet 5 sur Claude.ai, Claude Code, sa plateforme et Amazon Bedrock, l'offre d'IA du cloud d'Amazon.12 Le tarif de 2 / 10 $ est alors présenté comme introductif, jusqu'au 31 août inclus.1 Le prix affiché devait ensuite monter de 50 %.3 Ce calendrier est caduc.
Un budget du quatrième trimestre calibré sur les 2 / 10 $ du 30 juin n'a donc plus à être resigné. La ligne Sonnet 5 se stabilise.
L'arbitrage bascule même dans l'autre sens. Un contrat annuel Sonnet 4.6, facturé 3 / 15 $ et jamais renégocié, coûte maintenant plus cher qu'un contrat Sonnet 5 au même volume de tokens.
Le tokenizer compte environ 30 % de tokens en plus
Un tokenizer découpe votre texte en unités facturées, les tokens. Celui de Sonnet 5 n'est pas celui de Sonnet 4.6. Sur un même texte, il compte environ 30 % de tokens en plus, d'après la documentation Anthropic.8 Des analyses indépendantes montent jusqu'à 35 % sur certaines charges.3 Votre facture ne suit donc pas le tarif affiché.
Anthropic avait calibré son tarif de lancement pour compenser cet effet. Le fournisseur parlait d'un passage « approximativement coût neutre » depuis Sonnet 4.6, à texte identique.3 Un prompt de 100 tokens sur Sonnet 4.6 peut en coûter jusqu'à 135 sur Sonnet 5.3 Aucune ligne de code n'a bougé, aucun texte utilisateur non plus.
Maintenant que le tarif reste à 2 / 10 $, les deux effets jouent en sens inverse. Le prix au million baisse d'un tiers face aux 3 / 15 $ de Sonnet 4.6. Le compteur de tokens, lui, monte d'environ 30 %. Selon vos textes, votre facture baisse franchement ou reste presque stable. Anthropic ne publie pas ce coefficient pour du français administratif : il se mesure sur vos prompts.
Sonnet 5 talonne Opus 4.8 sur les tests agents, à 40 % du prix
Sonnet 5 approche Opus 4.8 sur les tâches automatisées, et le dépasse sur deux mesures. Les chiffres viennent du dossier technique publié le 30 juin avec le modèle.5 Il a été relu par METR, un organisme d'évaluation indépendant, par Apollo Research et par l'AI Security Institute britannique.5
Le tarif, lui, sépare nettement les deux modèles.
Sur SWE-bench Pro (un test de codage en plusieurs étapes), Sonnet 5 marque 63,2 %, contre 69,2 % pour Opus 4.8 et 58,1 % pour Sonnet 4.6.46 Sur Terminal-Bench 2.1, qui exécute des tâches en ligne de commande, il atteint 80,4 % contre 74,6 % pour Opus 4.8.7 Sur des tâches de travail intellectuel, il passe légèrement devant.4
Le tarif change la lecture de ces écarts. Opus 4.8 coûte 5 dollars par million de tokens en entrée et 25 dollars en sortie.8 Sonnet 5 reste à 2 / 10 $. Un agent qui tournait sur Opus 4.8 pour tenir le niveau peut donc basculer autour de 40 % du prix, à volume de tokens égal.
Opus 4.8 garde l'avantage sur le raisonnement long et sur les revues de cybersécurité.4 Pour un chatbot de relation client, un mailbot de qualification ou un callbot d'appels sortants, je prendrais Sonnet 5. Pour un agent qui prépare des dossiers réglementaires, je resterais sur Opus 4.8. Je pense aux dossiers destinés à l'ACPR, le régulateur des banques et des assurances, ou à l'ANSSI, l'agence française de cybersécurité. Dans les deux cas, l'IA prépare et l'humain valide.
Ce que ça change sur votre facture, en trois calculs
Voici trois cas types, calculés sur des volumes courants et des tarifs publics. Ce ne sont pas des clients Webotit. Ils montrent où la bascule dégage de la marge, et où elle en dégage peu. Les factures sont mensuelles, en dollars.
| Cas type | Facture actuelle | Sonnet 5, tokens à volume égal | Sonnet 5, tokenizer à 1,35× |
|---|---|---|---|
| Chatbot de support d'un distributeur, 80 000 sessions par mois, 64 millions de tokens | 500 $ sur Sonnet 4.6 | 330 $ | 450 $ |
| Agent de back-office, 12 000 litiges par mois, 240 millions de tokens en entrée et 24 en sortie | 1 800 $ sur Opus 4.8 | 720 $ | 970 $ |
| Mailbot d'une mutuelle santé, 200 000 e-mails par mois, 300 millions de tokens | 1 050 $ sur Sonnet 4.6 | 700 $ | 945 $ |
Un point commun aux trois cas : cette fenêtre ne rembourse pas un projet, elle rembourse un pilote bien conçu.
Quand vous partez de Sonnet 4.6, l'économie va d'environ 10 % à 34 %. Tout dépend du coefficient tokenizer mesuré sur vos textes. Elle n'est jamais acquise d'avance. Elle se vérifie avant de signer un engagement annuel.
Quand vous partez d'Opus 4.8, la marge est d'un autre ordre. Sur le cas de back-office, la bascule dégage entre 830 et 1 080 dollars par mois, même avec un tokenizer à 1,35×. Les tests publiés donnent Sonnet 5 proche d'Opus 4.8 sur ces tâches.4 Reste à le confirmer sur un échantillon de production.
Le mailbot de la mutuelle est le cas le plus serré. Une mutuelle de ce type relèverait de l'ACPR et de l'hébergement certifié des données de santé. L'enjeu n'y est pas la vitesse de réponse, mais la conformité. Une économie de 10 % ne paie pas une recette complète refaite à neuf. Une économie de 33 % la paie.
Votre budget agents IA du T4 2026 tient en quatre décisions
La hausse annulée ne referme pas le sujet, elle le déplace. Vous n'avez plus de date couperet, donc plus d'excuse pour trancher vite et mal. Voici ce que je ferais ce mois-ci, avec un budget du quatrième trimestre à arrêter.
- Mesurez le coefficient tokenizer sur 1 000 requêtes représentatives, en français. Comparez le compteur de tokens de Sonnet 4.6 et de Sonnet 5. Vous obtenez le vrai chiffre à mettre dans votre budget, pas une moyenne de documentation.
- Rejouez les projets calés sur Opus 4.8. Pour chaque agent en production ou en pilote, demandez si Sonnet 5 couvre 100 % des cas critiques. Si oui, la bascule dégage plusieurs milliers d'euros par mois à volume significatif. Si non, notez lesquels échouent : c'est utile pour la revue de fin d'année. Nous avions détaillé la logique multi-agents d'Opus 4.8 dans Claude Opus 4.8 et Dynamic Workflows.
- Activez la mise en cache des prompts. Anthropic facture les tokens lus depuis le cache autour d'un dixième du prix d'entrée.3 Sur un chatbot dont le prompt système est long et répétitif, l'écart se voit sur la facture.
- Demandez une clause de plafond de facturation à douze mois. Le tarif 2 / 10 $ est le repère public depuis le 10 août.8 Une hausse programmée puis retirée montre que la grille bouge dans les deux sens.
Un prix figé par la concurrence, pas par générosité
Je ne lis pas cette annulation comme un geste commercial généreux. Anthropic n'a pas expliqué publiquement sa décision. La pression sur les modèles agentiques de milieu de gamme est forte. DeepSeek V4-Pro coûte 3 à 4 fois moins cher en heures creuses. Mistral Medium 3 est là, et Gemini 3.7 Flash est en promotion.
Cette stabilité n'est pas une garantie à douze mois. Un tarif introductif annoncé pour deux mois, puis rendu permanent moins de trois semaines avant l'échéance, décrit une grille qui bouge vite. Je signerais donc un engagement annuel avec un plafond de facturation. Il vous protège d'un futur réarbitrage d'Anthropic, pas d'une hausse déjà annoncée.
Nous concevons nos chatbots, callbots, mailbots et équipes d'agents IA pour rester détachés du fournisseur de modèle et de son tokenizer. C'est ce qui permet de passer d'Opus 4.8 à Sonnet 5 sans réécrire le produit, puis de réarbitrer si la grille rebouge. Pour chiffrer l'effet sur votre périmètre, estimez le retour sur investissement d'un chatbot ou callbot Webotit.
Vous cadrez un projet agents IA back-office et vous voulez le détacher dès la conception de votre fournisseur de modèle ? Discutez-en avec nos équipes spécialisées en IA conversationnelle Webotit.
Mise à jour du 29 septembre 2026 : Sonnet 5.5 baisse la facture sans changer le tarif
Anthropic a publié Claude Sonnet 5.5 le 28 septembre 2026. Le tarif au million de tokens ne bouge pas : 2 dollars en entrée, 10 dollars en sortie, 0,20 dollar pour la lecture de cache.11 Une DSI qui a signé un engagement annuel sur le repère 2 / 10 $ garde donc son contrat. Aucune renégociation à prévoir.
La deuxième nouvelle vise directement la facture. Sur des charges identiques, Anthropic mesure une sortie plus rapide de plus de 30 % et un coût par tâche réduit jusqu'à 30 %.1112 La baisse ne vient pas d'un rabais sur le prix affiché. Elle vient d'un comportement plus économe : Sonnet 5.5 consomme moins de tokens et déclenche moins d'appels d'outils pour arriver au même résultat. Sur le code, il utilise environ un tiers d'appels d'outils en moins. Il exécute aussi près de deux fois moins de commandes shell qu'un Sonnet 5 lancé sur la même tâche.12
Le mécanisme change l'arbitrage selon le produit. Un chatbot de relation client échange souvent avec un ou deux appels d'outils par tour. Le gain se voit surtout à la latence : 30 % de vitesse en plus sur le temps de première réponse. Un agent IA back-office peut enchaîner plusieurs appels d'outils par dossier, selon le workflow. Là, le regroupement d'appels et la réduction du nombre d'étapes portent l'économie mesurée par Anthropic. Un callbot d'appels sortants dépend des deux : la vitesse tient la conversation, le nombre d'étapes tient le coût minute par minute.
Ce que je retiens pour un budget du quatrième trimestre déjà bâti sur Sonnet 5. La bascule se code en une ligne dans l'appel API, avec l'identifiant claude-sonnet-5-5.11 Elle est disponible dès le 28 septembre sur Amazon Bedrock, Google Vertex AI et Microsoft Foundry.1113 La cartographie de conformité reste la même. Je testerais sur un pilote existant, avec un compteur de tokens et un journal d'appels d'outils avant et après. Si la baisse tient sur vos textes, l'économie récupérée finance une itération de plus sans re-signer un contrat. Pour chiffrer l'effet sur votre périmètre, simulez le coût de vos chatbots et callbots ou estimez le retour sur investissement d'un projet Webotit.
Questions frequentes
Quand Claude Sonnet 5 est-il sorti et quel est son tarif en 2026 ?
Anthropic a ouvert Claude Sonnet 5 le 30 juin 2026 sur Claude.ai, Claude Code, sa plateforme et Amazon Bedrock. Le tarif d'appel était de 2 dollars par million de tokens en entrée et 10 dollars en sortie. Il était présenté comme introductif jusqu'au 31 août 2026. Le 10 août 2026, Anthropic l'a rendu permanent : la hausse à 3 / 15 dollars prévue au 1er septembre 2026 n'aura pas lieu.
Pourquoi le tokenizer de Sonnet 5 change-t-il la facture ?
Sonnet 5 découpe le texte autrement que Sonnet 4.6. Sur un même texte, il compte environ 30 % de tokens en plus selon Anthropic, et jusqu'à 35 % selon des analyses indépendantes. Un prompt de 100 tokens sur Sonnet 4.6 en coûte donc environ 130 sur Sonnet 5, sans aucune modification de votre part. Le prix au million baisse d'un tiers, le compteur de tokens monte : la facture réelle dépend de vos textes.
Sonnet 5 remplace-t-il Opus 4.8 pour les agents IA ?
Non, pas partout. Sur les tests publiés le 30 juin 2026, Sonnet 5 marque 63,2 % sur SWE-bench Pro, contre 69,2 % pour Opus 4.8. Il passe devant sur Terminal-Bench 2.1, à 80,4 % contre 74,6 %, et sur le travail intellectuel. Opus 4.8 garde l'avantage sur le raisonnement long et sur la cybersécurité. Sonnet 5 devient un choix par défaut solide pour beaucoup d'agents, pas pour tous.
Que doit tester une DSI française avant de basculer sur Sonnet 5 ?
Mesurez d'abord le coefficient tokenizer sur 1 000 requêtes représentatives en français. Comparez ensuite la qualité de sortie de Sonnet 5 et d'Opus 4.8 sur les agents de back-office, pour repérer les cas où la bascule tient. Activez enfin la mise en cache des prompts système répétitifs, dont l'intérêt économique grandit avec le nouveau tokenizer.
Sonnet 5 est-il disponible sur Amazon Bedrock pour un déploiement en France ?
Oui. Anthropic et Amazon ont annoncé la disponibilité de Sonnet 5 sur Amazon Bedrock le 30 juin 2026, avec le même tarif de lancement. Si votre conformité est déjà cadrée sur Bedrock, la bascule technique se limite à changer le nom du modèle dans l'appel. La cartographie de vos fournisseurs ne change pas. Cela aide pour vos revues AI Act et DORA en cours (DORA est le règlement européen sur la résilience numérique du secteur financier).
Sources et references
Articles associés
Claude Fable 5 : Mythos en production, tarif x2, fenêtre J-11
Anthropic ouvre Claude Fable 5 le 9 juin 2026 : 10/50 $ par M tokens, fallback Opus 4.8 sur cyber et bio, gratuit Pro/Max/Team/Enterprise jusqu'au 22 juin.
LireGPT-5.6 rouvert à la France : votre présélection LLM repasse à 4
OpenAI a rouvert l'accès à GPT-5.6 en France le 9 juillet 2026. Le verrou américain peut retomber : sécurisez votre contrat LLM avant octobre.
LireAnthropic coupe : ce que ça change pour vos contrats LLM en France
L'interdiction US Fable 5 et Mythos 5 du 12 juin oblige toute ETI française à rouvrir ses clauses LLM. Anatomie d'une fenêtre d'arbitrage de 90 jours.
Lire