Qu’est-ce que Claude Opus 5.5, sorti le 22 septembre 2026 ?

Anthropic a publié Claude Opus 5.5 le 22 septembre 2026, sous l’identifiant claude-opus-5-5. C’est le premier modèle de la famille 5.5 : Sonnet 5.5 et Haiku 5.5 suivront « dans les prochaines semaines », selon l’annonce de l’éditeur. Pour une entreprise française qui a déjà Claude en production, une question arrive vite : faut-il basculer, et sur quels cas d’usage ?

Claude Opus 5.5 est le nouveau modèle haut de gamme d’Anthropic, présenté comme aussi performant que Claude Fable 5.1 sur la plupart des tâches, pour un coût inférieur de 40 % à celui d’Opus 5 sur des charges typiques. Il ne fonctionne plus sans le mode « thinking » et intègre le marquage prévu pour l’AI Act.

Ce qu’Anthropic annonce, et ce que l’annonce laisse ouvert

Côté performance, Anthropic écrit qu’Opus 5.5 se situe « au niveau de Claude Fable 5.1 sur la plupart des travaux ». Côté coût, l’éditeur annonce une baisse de 40 % par rapport à Opus 5 « sur des charges typiques », et une génération de texte plus de 30 % plus rapide. Le modèle est disponible sur la plateforme Claude, dans Claude Code et chez les grands fournisseurs de cloud : Amazon Web Services, Google Cloud et Microsoft Azure. La rétention zéro des données reste proposée, comme pour les Opus précédents.

Le tarif affiché par million de tokens baisse de 20 % en entrée comme en sortie, et celui des lectures en cache de 60 %. Anthropic explique les 40 % par ce prix par token plus bas, combiné à un modèle qui consomme moins de tokens par tâche, et cette seconde part varie forcément d’un usage à l’autre : une chaîne agentique qui relit souvent le même contexte en cache ne gagnera pas dans les mêmes proportions qu’une extraction ponctuelle. Plusieurs points restent d’ailleurs ouverts à la date de publication : aucune date de retrait n’est fixée pour Opus 5, et la définition de la « charge typique » n’est pas publiée. Le gain réel dépend de votre profil de requêtes et se mesure chez vous.

Qu’est-ce qui change concrètement pour une entreprise française ?

L’annonce touche le budget, l’expérience des utilisateurs et la conformité, avec un poids très différent selon les usages. Une DSI qui fait tourner une dizaine de cas d’usage sur Claude n’en tirera pas le même bénéfice partout, et c’est cette hétérogénéité qui doit guider l’ordre de migration.

Le coût des cas d’usage à fort volume

Les usages qui appellent Opus des milliers de fois par jour, comme la revue documentaire, l’analyse de contrats ou les agents de support de niveau 2, sont ceux où une baisse de cet ordre pèse vraiment dans le budget. Sur un assistant consulté quelques dizaines de fois par semaine, la différence reste trop faible pour justifier un chantier.

Une application qui reste sur Opus 5 ne touchera rien de cette baisse. Le gain arrive sous un nouvel identifiant, et il faut aller le chercher. C’est le mécanisme que nous décrivions dans notre analyse de la dépendance à un modèle IA et de l’architecture qui permet d’en changer : une baisse tarifaire sur un identifiant existant atteint les applications sans effort, alors qu’une nouvelle génération demande une migration.

La latence des usages interactifs

Une génération plus de 30 % plus rapide compte surtout là où un humain attend la réponse : un assistant juridique consulté en réunion, un copilote de conseiller en agence bancaire, un agent qui enchaîne des étapes et dont chaque appel s’additionne au précédent. Pour les traitements par lots de nuit, la latence ne change rien au service rendu.

Les équipes qui avaient écarté Opus pour des raisons de temps de réponse peuvent rouvrir la question, en particulier sur les agents qui pilotent des écrans en computer use ou passent par des API, où chaque étape paie son propre délai et où l’attente de l’utilisateur se cumule.

Le marquage prévu pour l’AI Act

Anthropic précise qu’Opus 5.5 embarque, comme Fable 5.1, ses mesures de marquage (watermarking) destinées à respecter l’AI Act européen. Le sujet renvoie à l’article 50 du règlement, qui organise la transparence sur les contenus générés par IA et s’applique depuis le 2 août 2026. Pour l’obligation de marquage, le report Digital Omnibus n’a accordé un délai, jusqu’au 2 décembre 2026, qu’aux systèmes génératifs mis sur le marché avant le 2 août 2026. Opus 5.5, sorti le 22 septembre, n’entre pas dans ce délai : son marquage est attendu dès sa sortie.

Le marquage côté fournisseur laisse entières les obligations de l’entreprise qui déploie le modèle, à commencer par l’information des personnes exposées à un contenu généré. Notre point sur le calendrier de l’AI Act après le report détaille ce qui reste dû, et la page consacrée à la conformité AI Act en entreprise décrit notre accompagnement.

Faut-il migrer tout de suite vers Claude Opus 5.5 ?

Pas en bloc. Migrez d’abord les cas d’usage à fort volume ou sensibles à la latence, après les avoir rejoués sur un jeu d’évaluation tiré de vos données réelles. Pour les usages qui tournent aujourd’hui sur Sonnet ou Haiku, attendez les versions 5.5 annoncées pour les prochaines semaines avant d’arbitrer.

L’ordre que nous recommandons à nos clients :

  1. Inventorier les cas d’usage qui appellent Opus aujourd’hui, avec leur volume et leur criticité.
  2. Vérifier la date de création de chaque compte API et l’effet du preserved thinking sur les intégrations.
  3. Adapter les requêtes aux paramètres que le nouveau modèle refuse.
  4. Rejouer un échantillon de requêtes réelles sur Opus 5.5 et comparer qualité, consommation et latence.
  5. Basculer un premier cas d’usage par la configuration, avec retour arrière possible.
  6. Réévaluer les usages Sonnet et Haiku à la sortie des versions 5.5.

Les cas où la bascule se justifie vite

Les candidats naturels sont les usages déjà sur Opus 5 dont le coût freine le passage à l’échelle, et ceux où le temps de réponse dégrade l’expérience. Il y a aussi les usages montés sur Fable 5.1 pour sa qualité : si Opus 5.5 tient le niveau annoncé, c’est pour eux la piste d’économie la plus directe, à condition que vos évaluations le confirment sur vos propres données.

Les cas où attendre est plus raisonnable

Les usages qui tournent sur Sonnet ou Haiku relèvent d’un autre calcul. Passer d’un Sonnet à un Opus, même moins cher qu’avant, reste un changement de gamme, et Sonnet 5.5 arrive. Les applications validées récemment après un long cycle de recette, en particulier dans les secteurs régulés où chaque changement de modèle repasse devant un comité, ont intérêt à grouper la migration avec l’arrivée du reste de la famille plutôt qu’à enchaîner deux recettes en quelques semaines.

Qu’est-ce que le preserved thinking change pour vos intégrations ?

Le preserved thinking est un garde-fou anti-distillation introduit avec Fable 5.1. Selon Anthropic, il empêche un utilisateur de l’API de modifier le contexte antérieur de Claude pour tenter d’en extraire le raisonnement. Il s’applique à Fable 5.1 et à Opus 5.5 pour les comptes API créés à partir du 31 août 2026, et l’éditeur renvoie vers une documentation qui explique comment tester et mettre à jour les intégrations concernées.

Un compte API ouvert depuis le 31 août ne se comporte donc pas comme un compte plus ancien. Un nouveau projet, une nouvelle filiale ou un intégrateur qui reprend un chantier sous un compte neuf tombent dans ce cas. Les intégrations qui modifient l’historique de conversation entre deux appels sont celles à tester en priorité, puisque c’est précisément ce que le garde-fou encadre.

Le mode thinking devient obligatoire

Anthropic indique qu’Opus 5.5 n’est plus disponible avec le mode « thinking » désactivé. Pour les usages qui appelaient Opus sans raisonnement étendu, comme l’extraction de champs ou la classification de documents, le comportement change : le modèle raisonne avant de répondre, et ces tokens de réflexion sont facturés comme des tokens de sortie, même quand leur texte n’est pas renvoyé. La consommation par requête et le temps de réponse changent donc. L’annonce fait état d’un niveau d’effort réglable, fixé à « medium » par défaut dans ses comparaisons, qui devient le principal levier pour ces usages simples. Raison de plus pour mesurer vos propres cas au lieu de transposer le chiffre de 40 %.

Comment tester Opus 5.5 avant de basculer la production ?

Un changement de modèle se recette comme une mise à jour logicielle, avec des données réelles et des critères écrits avant le test. Les équipes qui décident sur la base d’une démonstration réussie découvrent les régressions en production, au moment où elles coûtent le plus cher.

Rejouer vos cas réels plutôt que des benchmarks

Les benchmarks publiés par Anthropic mesurent des tâches génériques. Votre revue de contrats, votre classement de réclamations ou votre agent de support ont leurs propres pièges : formats maison, vocabulaire métier, cas limites que l’équipe a mis des mois à identifier. Un jeu d’évaluation de quelques centaines de requêtes anonymisées, tirées de la production et accompagnées de la réponse attendue, suffit en général à trancher. Pour les équipes qui industrialisent déjà leurs usages de Claude Code en entreprise, ce jeu a sa place dans l’intégration continue : un modèle candidat qui échoue à la suite reste hors de la production.

Mesurer au niveau du cas d’usage

La facture mensuelle globale ne dit rien de l’effet d’un changement de modèle. Il faut attribuer la consommation, la latence, le taux d’échec et la qualité à chaque cas d’usage pour comparer Opus 5 et Opus 5.5 sur le même périmètre. Sans cette mesure, la baisse annoncée reste une promesse de l’éditeur, impossible à confirmer ou à contester en comité budgétaire. Ce suivi fait partie de l’exploitation des agents dans notre programme Claude Ops d’industrialisation des agents.

Adapter les requêtes avant de basculer

Le changement d’identifiant ne suffit pas. Le guide de migration d’Anthropic liste des réglages que claude-opus-5-5 rejette avec une erreur : thinking désactivé ou budget de réflexion fixé à la main, appel d’outil forcé, température ou paramètres d’échantillonnage modifiés, réponse préremplie, et sur l’API Claude comme sur Google Cloud, ancienne version de l’outil de computer use. Le code qui lit la réponse par position casse aussi, puisque la réponse peut désormais commencer par des blocs de réflexion, et les boucles d’outils doivent renvoyer ces blocs sans les modifier. Ces adaptations se font dans le code, avant toute bascule, et elles se testent sur le jeu d’évaluation comme le reste.

Prévoir le retour arrière

Une fois les requêtes rendues compatibles, la bascule d’un cas d’usage tient dans un réglage de configuration. Si les indicateurs se dégradent après la mise en production, l’équipe revient à Opus 5 sans redéployer l’application. Tant qu’Anthropic n’a pas annoncé de date de retrait pour Opus 5, ce filet reste disponible, et il vaut mieux l’avoir prévu avant d’en avoir besoin.

Qui doit décider d’un changement de modèle en entreprise ?

Selon Deloitte (State of AI in the Enterprise, édition 2026), seules 21 % des organisations disposent d’un modèle de gouvernance mature pour leurs agents IA. Dans les autres, le modèle en production est souvent celui qu’a retenu l’équipe qui a livré le premier prototype, et ce choix n’a jamais été rediscuté. Une sortie comme celle d’Opus 5.5 met ce vide en évidence : personne n’a mandat pour dire si le gain vaut une recette.

Nous recommandons de nommer un responsable du choix de modèle pour chaque cas d’usage, avec des critères écrits : seuil de qualité sur le jeu d’évaluation, plafond de coût, exigences de conformité, contraintes d’hébergement. Dans la méthodologie de gouvernance LOOP™, un changement de modèle est traité comme une modification de l’agent lui-même, avec son approbation tracée et son critère de retour arrière.

Le cas des hébergements imposés

Beaucoup de grands comptes consomment Claude via leur fournisseur de cloud, pour des raisons de contrat, de localisation des données ou de sécurité. Opus 5.5 est annoncé sur Amazon Web Services, Google Cloud et Microsoft Azure, mais la disponibilité par région et les conditions de rétention peuvent différer d’une plateforme à l’autre. Vérifier ces points dans votre région avant la recette évite de valider un modèle que votre contrat ne permet pas encore d’appeler.

Que retenir pour votre feuille de route IA ?

Sur un portefeuille de cas d’usage Claude, la sortie d’Opus 5.5 se traduit par une liste de travaux assez courte : recenser les appels à Opus, corriger les requêtes incompatibles, rejouer le jeu d’évaluation, basculer. Les organisations qui disposent d’une couche d’abstraction, d’un jeu d’évaluation et d’un responsable nommé peuvent capter la baisse annoncée sur leurs usages les plus lourds dès ce trimestre. Pour les autres, chaque nouvelle génération ouvre un projet, l’arbitrage glisse au budget suivant, et Sonnet 5.5 puis Haiku 5.5 arriveront avant que la première question soit tranchée.

Gartner estime que plus de 40 % des projets d’IA agentique seront annulés d’ici fin 2027, en raison de coûts qui dérapent, d’une valeur métier floue ou de contrôles de risque insuffisants. Un modèle moins cher règle une partie du premier problème, à condition d’aller le chercher. Pour situer votre organisation, le diagnostic de maturité IA évalue votre niveau sur les 6 axes du référentiel Koneetiv (édition 2026). Et si vous cherchez un intégrateur Claude en France pour conduire ce type de migration, Koneetiv, partenaire officiel Anthropic et pure player Claude, accompagne les grands comptes sur leurs agents Claude en production.