Aller au contenu principal
Retour à Us
LLM

Claude Opus 4.1 retiré : 3 chantiers DSI avant Opus 5

Anthropic a retiré Claude Opus 4.1 le 5 août 2026, troisième rupture Claude en huit semaines. Cadrez votre clause de version et votre plan de migration.

Louis-Clément Schiltz
CEO & Founder, Webotit.ai
8 min de lecture

Parler de ce sujet avec Webotit

En bref

Anthropic a retiré Claude Opus 4.1 le 5 août 2026 : tout appel à claude-opus-4-1-20250805 retourne une erreur. Troisième changement en huit semaines, après le retrait du mode rapide sur Opus 4.7 le 24 juillet et sa mutation silencieuse sur Opus 4.6 le 29 juin. Une DSI qui exploite Claude en production doit poser cette semaine une politique de version explicite, au contrat comme à l'exécution.

Le 5 août, Opus 4.1 sort du catalogue Anthropic sans période de grâce

Le 5 août 2026, Anthropic annonce dans les notes de version de la plateforme Claude que le modèle Claude Opus 4.1 est retiré.1 L'identifiant technique claude-opus-4-1-20250805 renvoie désormais une erreur à chaque appel. La recommandation officielle est de migrer vers Claude Opus 5. Les équipes de recherche peuvent demander un accès prolongé via l'External Researcher Access Program.1

C'est la seule voie de sortie. Il n'y a pas de repli silencieux, pas de délai de tolérance, pas de bascule automatique vers Opus 4.7 ou Opus 4.8. Une intégration en production qui appelle claude-opus-4-1-20250805 casse à la première requête.

Opus 4.1 était sorti le 5 août 2025.1 Sa fenêtre commerciale a donc duré exactement un an, dans une gamme où Anthropic pousse depuis fin 2025 Sonnet 5, Opus 4.7, Opus 4.8 puis Opus 5. Une intégration posée fin 2025 avait de bonnes raisons d'épingler Opus 4.1 pour la stabilité, précisément parce que la cadence de publication était devenue difficile à suivre côté qualification. Cette prudence se retourne aujourd'hui contre elle.

Le même jour, Anthropic pousse également les points d'ancrage d'inférence (inference hooks) en bêta pour Claude Enterprise.1 Deux annonces produit distinctes le même jour, sur la même surface Enterprise : la lecture opérationnelle est claire, la plateforme Claude Enterprise entre dans un rythme d'itération soutenu, et le contrat client doit être capable de suivre ce rythme.

Trois changements Claude en huit semaines, la cadence à intégrer côté contrat

Il faut sortir la chronologie. Elle change la lecture.

29 juin 2026. Anthropic retire le mode rapide sur Opus 4.6. Les requêtes avec speed: "fast" continuent à passer, mais ne bénéficient plus ni de la vitesse premium ni du tarif premium. Elles s'exécutent en standard, sans erreur, avec le champ usage.speed qui reflète la vitesse réellement utilisée.1 C'est une mutation silencieuse : votre facture baisse, votre latence remonte, et personne ne se plaint tant que la supervision ne bute pas sur l'engagement de service côté expérience utilisateur.

24 juillet 2026. Anthropic retire le mode rapide sur Opus 4.7. Cette fois, contrairement à Opus 4.6, la requête avec speed: "fast" renvoie une erreur. Pas de repli automatique. Opus 4.7 lui-même reste disponible en vitesse standard.1 C'est un changement dur, annoncé un mois plus tôt le 25 juin.1

5 août 2026. Anthropic retire Opus 4.1 complètement. Aucune requête ne passe.1

Trois changements de comportement en huit semaines, sur trois versions consécutives d'Opus, avec trois régimes de rupture différents : silencieux dégradé, erreur dure sur un mode, erreur dure sur un modèle entier. Ce n'est pas une exception. C'est la nouvelle cadence Anthropic sur Claude Enterprise, et elle n'est pas cohérente avec la manière dont une DSI d'ETI française pose habituellement un socle chatbot ou callbot en production sur douze à dix-huit mois.

À titre de comparaison, sur la même fenêtre, OpenAI a lancé la famille GPT-5.6 Sol, Terra, Luna le 26 juin sous liste américaine, puis a baissé Terra de 20 % et Luna de 80 % le 30 juillet.2 Sur les deux principaux fournisseurs LLM Enterprise en France, la cadence de changement est passée d'un modèle par trimestre à deux ou trois changements de comportement par mois. Ce que ça change pour votre exploitation, ce n'est pas le contenu de chaque annonce. C'est la fréquence à laquelle il faut re-qualifier.

Ce que ça change pour une entreprise française

Trois éléments concrets à cadrer cette semaine.

Un — la clause de version dans votre contrat Claude Enterprise. Si votre contrat renvoie à un pool de modèles Anthropic sans version épinglée, votre équipe technique subit chaque changement produit sans préavis contractuel. À l'inverse, si votre contrat épingle un identifiant précis (par exemple claude-opus-4-8), vous êtes protégé jusqu'au retrait de cet identifiant, mais vous devez organiser vous-même la re-qualification avant chaque bascule. Le bon compromis pour une DSI qui exploite un chatbot ou un callbot Claude en production, c'est une clause qui fixe deux règles : Anthropic notifie 90 jours à l'avance tout retrait dur d'un modèle en cours d'exploitation, et vous avez le droit de rester sur la version N-1 pendant douze mois après la sortie de N. Cette clause n'était pas standard fin 2025. Elle doit l'être maintenant.

Deux — la matrice de tests de non-régression sur Claude côté produit. Un chatbot support ou un mailbot en production sur Claude Opus 4.8 ne peut pas basculer vers Opus 5 sans une passe de qualification. Opus 5 introduit une contrainte de comportement qui n'existait pas sur 4.8 : désactiver le raisonnement (thinking: {"type": "disabled"}) est refusé aux niveaux d'effort xhigh et max, ce qui retourne une erreur 400.1 Un prompt qui marchait en production avec un effort: "max" et un raisonnement désactivé casse à la migration. La question opérationnelle n'est pas « Opus 5 est-il meilleur qu'Opus 4.8 », elle est « quel budget de test avez-vous pour valider la bascule sans dégrader l'expérience utilisateur du chatbot au moment de la bascule ».

Trois — la couche d'abstraction technique dans votre agent. Une intégration qui appelle directement l'API Anthropic avec un identifiant modèle en dur est vulnérable à chaque annonce. Une intégration qui passe par une couche d'orchestration capable de router entre Claude Opus 5, Claude Opus 4.8, un modèle Mistral en repli et un modèle à poids ouverts hébergé sur site absorbe la même annonce sans incident. C'est le sujet qu'un projet agents IA gouvernés doit cadrer dès le pilote, pas au moment du renouvellement de contrat. Un agent IA de première génération repose trop souvent sur l'hypothèse d'un fournisseur unique.

Pour une entité financière dans le champ DORA — banque, assurance, mutuelle sous ACPR — cette discipline entre en écho direct avec la réglementation. L'Article 28 impose une stratégie de gestion du risque lié aux prestataires TIC et la tenue d'un registre des contrats.3 L'Article 30 fixe les clauses contractuelles minimales à intégrer aux arrangements couvrant des fonctions critiques ou importantes.3 Un fournisseur LLM qui casse trois versions en huit semaines sans clause de préavis dans votre contrat, ce n'est pas une non-conformité automatique. C'est un risque à évaluer, à documenter dans votre registre et à remonter au prochain rapport annuel. Le régulateur ne demandera pas si vous êtes en Opus 5 ou Opus 4.8. Il demandera comment votre production absorbe la prochaine rupture. À faire valider par votre conseil juridique avant intégration au contrat.

Trois questions à traiter cette semaine côté DSI et direction relation client

Avant de rouvrir le contrat, il faut d'abord poser une photographie honnête de l'existant.

Première question : combien de vos intégrations en production appellent-elles explicitement claude-opus-4-1-20250805 ? Il n'est pas rare de découvrir à cette occasion des intégrations construites fin 2025 par un intégrateur externe et jamais rebasculées depuis : elles sont en panne depuis le 5 août. Vos utilisateurs le sentent avant que votre supervision ne le voie. Un examen des journaux d'appel API des dernières vingt-quatre heures suffit à faire l'inventaire.

Deuxième question : quel est le budget migration Opus 5 versus repli sur Opus 4.8 pour votre principal cas d'usage Claude ? Opus 5 coûte 5 dollars d'entrée et 25 dollars de sortie par million de tokens, un tarif inchangé par rapport à Opus 4.8.1 Le budget n'est donc pas l'obstacle, c'est le budget de test. Pour un chatbot ou un mailbot en production, il faut prévoir une fenêtre de re-qualification produit dédiée, plus une campagne de tests de charge côté infrastructure. C'est le vrai coût de la migration.

Troisième question : qui pilote la relation contractuelle Claude Enterprise chez vous ? Ce n'est plus un sujet achats IT qui remonte au CODIR une fois par an au renouvellement. C'est un sujet de gouvernance mensuelle, avec un point d'ordre du jour au comité DSI, un référent risques et un référent produit. La cadence Anthropic actuelle rend intenable le modèle « on renouvelle le contrat annuel et on ne s'en occupe plus jusqu'à l'année prochaine ».

Cette bascule concerne au premier chef les directions relation client qui exploitent un chatbot ou callbot en production. La discipline se pose en trois trimestres, pas en trois semaines. Autant la démarrer maintenant.

Cadrer proprement une politique de version Claude côté production demande de croiser un contrat, une architecture d'exécution et une gouvernance mensuelle. Si vous rouvrez votre dossier Anthropic ce trimestre, notre équipe peut vous aider à chiffrer le coût de migration et de résilience multi-modèle sur votre cas d'usage principal, avant que la prochaine annonce ne rende l'arbitrage plus coûteux.

Questions frequentes

Quelles requêtes Claude sont concrètement cassées depuis le 5 août 2026 ?

Toute requête envoyée à l'identifiant claude-opus-4-1-20250805 sur l'API Anthropic, Amazon Bedrock, Google Cloud ou Microsoft Foundry retourne désormais une erreur.1 Il n'y a ni repli silencieux, ni bascule automatique vers un modèle proche. Les autres identifiants Claude (Opus 4.6, Opus 4.7, Opus 4.8, Opus 5, Sonnet 5, Haiku 4.5) restent opérationnels. Un audit rapide de vos appels API sur les dernières 24 heures suffit à repérer les intégrations qui échouent en silence.

Faut-il migrer vers Claude Opus 5 ou rester sur Opus 4.8 en repli ?

Cela dépend du profil du cas d'usage. Opus 5 est au même tarif qu'Opus 4.8 (5 dollars d'entrée, 25 dollars de sortie par million de tokens) et apporte des gains significatifs sur les benchmarks agentiques.1 Mais Opus 5 introduit un changement de comportement : désactiver le raisonnement aux niveaux xhigh et max retourne une erreur 400, ce qui casse certains prompts existants.1 Pour un chatbot support ou un mailbot de qualification, la migration Opus 5 est cohérente à condition de prévoir une fenêtre de tests dédiée. Pour un cas où votre équipe n'a pas de fenêtre de test dans le trimestre, rester temporairement sur Opus 4.8 est légitime.

Cette cadence Anthropic pose-t-elle un problème de conformité DORA pour une banque française ?

Pour une entité financière dans le champ DORA, oui — mais indirectement. Article 28 impose une stratégie de gestion du risque lié aux prestataires TIC et la tenue d'un registre des contrats.3 Article 30 fixe les clauses contractuelles minimales pour les fonctions critiques ou importantes.3 Trois changements de comportement Claude en huit semaines, dont un retrait dur sans période de grâce, correspondent au type d'exposition qui doit remonter dans votre registre au prochain rapport annuel. Négocier avec Anthropic un préavis contractuel long et une garantie de disponibilité de la version précédente relève de la bonne pratique contractuelle, pas d'une exigence DORA littérale. À faire valider par votre conseil juridique avant intégration au contrat.

Une couche d'orchestration multi-modèle vaut-elle vraiment l'investissement pour une ETI qui n'exploite qu'un seul cas d'usage Claude ?

Oui, dès que ce cas d'usage est en production sur un volume opérationnel. La cadence de changement Anthropic mesurée sur juin-juillet-août 2026 rend intenable une intégration qui appelle un identifiant modèle en dur : chaque annonce déclenche un chantier de re-qualification en urgence. Une couche d'orchestration qui route entre Claude, Mistral et un modèle à poids ouverts en repli absorbe le même événement sans incident, et amortit son coût dès qu'une nouvelle bascule modèle devient nécessaire. Pour un projet agents IA gouvernés, ce découplage doit être posé dès le pilote, pas au premier accident de production.

Sources et references

  1. [1]
  2. [2]
  3. [3]
AnthropicClaude Opusdépréciationgouvernance IADSIDORA