Vous lancez le matin un gros refactor, une réorganisation de code qui touche des dizaines de fichiers. À midi, votre quota est à sec et la moitié du travail attend encore sur le bureau.
C'est précisément ce scénario qu'Opus 5.5 veut rendre plus rare. Le nouveau modèle haut de gamme d'Anthropic, sorti le mardi 22 septembre 2026, abat le même travail qu'Opus 5 avec moins de tokens.
Et chacun de ces tokens coûte moins cher. Anthropic résume le tout en un chiffre : 40 % de moins par tâche qu'avec Opus 5.
Un autre pourcentage circule depuis l'annonce, 60 %. Voyons d'où viennent ces chiffres, ce que valent les scores publiés, et ce qui risque encore de vous freiner.
Ce qui change par rapport à Opus 5
Opus 5 est sorti le 24 juillet, deux mois plus tôt. C'est devenu le rythme de croisière d'Anthropic sur sa gamme Opus.
Opus 5.5 ouvre la nouvelle famille Claude 5.5. D'après Anthropic, il se hisse au niveau de Fable 5.1, son modèle plus gros et plus cher, sur la plupart des tâches.
| Ce qui bouge | Opus 5 | Opus 5.5 |
|---|---|---|
| Tokens en entrée (par million) | 5 dollars | 4 dollars |
| Tokens en sortie (par million) | 25 dollars | 20 dollars |
| Lectures en cache (par million) | 0,50 dollar | 0,20 dollar |
| Écritures en cache (par million) | 6,25 dollars | 5 dollars |
| Vitesse de génération | 100 | 130, 30 % plus rapide |
| Coût d'une tâche type | 100 | 60, 40 % de moins |
Le style des réponses change aussi. Anthropic a retravaillé la façon d'écrire du modèle : moins de jargon, l'information importante en tête, et des consignes de rédaction mieux suivies.
Sur le papier, ça ressemble à un détail. En pratique, c'est lire la conclusion dès la première ligne au lieu de la chercher au milieu de quarante lignes de raisonnement, et ça vingt fois par jour.
20 %, 60 %, 40 % : qui compare quoi ?
Trois pourcentages accompagnent ce lancement.
20 %, c'est la baisse du prix affiché. Les tokens en entrée passent de 5 à 4 dollars le million, ceux en sortie de 25 à 20 dollars.
60 %, c'est la baisse sur les lectures en cache, qui passent de 0,50 à 0,20 dollar le million.
Si le principe vous échappe, voici l'idée en deux phrases : quand un agent IA renvoie à chaque tour le même dépôt et les mêmes consignes, ce contexte déjà traité n'est plus facturé plein tarif. C'est le cache de prompt.
D'après Anthropic, ces lectures en cache pèsent la majorité du coût du code et du travail agentique. C'est donc la ligne qui compte le plus pour votre facture, bien plus que le prix affiché.
40 %, enfin, c'est l'effet combiné sur une tâche type, mesuré par Anthropic aux réglages par défaut. Les tokens coûtent moins cher, et Opus 5.5 en utilise moins pour arriver au même résultat.
Votre facture dépend de votre usage. Un script qui envoie des demandes courtes, sans contexte réutilisé, profitera surtout des 20 %. Un agent qui tourne en boucle sur votre code se rapprochera des 40 %.
On peut donc se demander d'où vient leur marge !
Anthropic explique que le modèle demande moins de calcul pour être servi. Il coûte donc moins cher à faire tourner, et l'économie se retrouve dans le tarif. C'est aussi simple que ça !
Elle se retrouve aussi dans la vitesse : la génération est plus de 30 % plus rapide qu'avec Opus 5 (vous n'aurez plus le temps de préparer le repas que votre tâche sera terminée 👀).
Pour régler finement votre cache, la documentation d'Anthropic sur le cache de prompt détaille chaque ligne de facturation.
Petit détail pour les curieux : sur Opus 5.5, une lecture en cache coûte 5 % du prix d'entrée, contre 10 % sur la plupart des autres modèles.
![]()
Au niveau de Fable 5.1
L'annonce s'accompagne d'un tableau complet de benchmarks, ces tests standardisés qui notent tous les modèles sur les mêmes exercices. Le principe est détaillé dans notre glossaire, à l'entrée évaluation.
| Épreuve | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 (code dans un terminal) | 66,4 % | 55,8 % | 52,3 % |
| FrontierCode v1.1 (modifications de code acceptées) | 54,4 % | 50,3 % | 48,0 % |
| CursorBench 4.0 (tâches floues sur plusieurs fichiers) | 57,8 % | 51,8 % | 46,6 % |
| GDPval-AA v2.1 (travail de bureau dans 44 métiers, indice : plus haut vaut mieux) | 1846 | 1735 | 1708 |
| OSWorld 2.0 (piloter un ordinateur, notation partielle) | 81,8 % | 80,7 % | 74,0 % |
| Humanity's Last Exam (avec outils) | 67,7 % | 65,6 % | 63,6 % |
Le bond le plus net concerne le code dans un terminal. Sur Terminal-Bench 4.0, Opus 5.5 prend 14 points à Opus 5 et plus de 10 à Fable 5.1.
Un écart en points ne se lit pas comme un pourcentage. Passer de 52,3 % à 66,4 %, c'est 14,1 points, soit environ 27 % de tâches réussies en plus. Anthropic indique une marge d'erreur d'environ 2,6 points sur ce score.
Un exemple parle plus que les scores : Anthropic a demandé à Opus 5.5 et à Fable 5.1 de réécrire HAProxy, un logiciel qui répartit le trafic web entre plusieurs serveurs, du langage C vers Rust.
Les deux versions ont passé presque tous les tests de non-régression du projet, ceux qui vérifient que rien n'a cassé. Opus 5.5 a terminé en 9 h 30 au lieu de 12 heures, pour 51 % de coût en moins.
Si vous n'êtes pas développeur ou n'avez pas compris ces lignes : retenez juste qu'Opus 5.5 est beaucoup moins cher à utiliser.
Finalement pour les plus curieux n'hésitez pas à tester vous mêmes ! Rejouez cinq demandes réelles sur les deux modèles, puis comparez :
- Le temps entre l'envoi de la demande et la réponse complète.
- Le nombre d'allers-retours avant d'obtenir un résultat utilisable.
- Les tokens consommés sur tout l'échange, pas seulement sur la première réponse.
Comptez une demi-heure. Ce petit test porte sur vos fichiers, vos conventions et votre façon d'écrire vos prompts, ce qu'aucun classement ne fera à votre place.
Dans un terminal, il se mène très bien avec Claude Code, que nous enseignons pas à pas.
Cybersécurité et biologie : quand un autre modèle répond à votre place
Anthropic estime qu'Opus 5.5 se compare à Mythos 5.1 en biologie et en cybersécurité. Il hérite donc de garde-fous proches de ceux de Fable 5.1.
Ces garde-fous ne refusent pas vos demandes.
Quand un filtre se déclenche, la demande part discrètement vers un autre modèle : Opus 4.8 pour la plupart des tâches de cybersécurité, Opus 5 pour la biologie et le développement de modèles d'IA de pointe.
Chercher et corriger les bugs de votre propre code reste possible sur Opus 5.5, dans le cadre normal du développement.
Le piège, c'est l'absence de message d'erreur. Votre outil continue de répondre, simplement avec un modèle moins capable. Si vous simulez des attaques (test d'intrusion) ou analysez des programmes compilés, testez vos cas d'usage avant de migrer un outil en production.
Pour les équipes de sécurité défensive, le Cyber Verification Program s'ouvrira à Opus 5.5 dans les semaines qui viennent. Il comptera trois niveaux d'accès, de plus en plus permissifs, jusqu'aux modèles Mythos.
Côté biologie, laboratoires universitaires, startups et entreprises pharmaceutiques peuvent déjà candidater au Life Sciences Verification Program.
Avant sa sortie, le modèle a aussi été évalué par des organisations extérieures, dont METR et Frontier Design. Anthropic le décrit comme plus résistant qu'Opus 5 aux injections de prompt.
C'est aussi son modèle le mieux noté à ce jour sur son audit comportemental automatisé, une batterie de milliers de scénarios simulés qui vérifie que le modèle ne sort pas du cadre qu'on lui donne.
Anthropic veut ralentir, mais pas sur ce modèle
Opus 5.5 est la première sortie depuis le texte publié une semaine plus tôt par Dario Amodei, le PDG d'Anthropic : « We Must Pace the Frontier ».
L'idée : régler la vitesse des progrès de l'IA pour que les pratiques de sécurité gardent une longueur d'avance sur les capacités des modèles.
Ne vous attendez pas pour autant à un frein sur Opus 5.5. Anthropic le présente comme un net progrès par rapport à Opus 5, et les 14 points gagnés sur Terminal-Bench en deux mois vont dans ce sens.
Le ralentissement vise surtout la suite : des modèles capables d'automatiser eux-mêmes la recherche en IA. Pour ceux-là, Anthropic écrit que ses mesures actuelles ne suffiront pas forcément, et veut que les pouvoirs publics prennent plus de place.
Trois changements à vérifier dans vos intégrations
Si vous appelez Claude depuis votre propre code, trois nouveautés méritent un test avant de basculer sur l'identifiant claude-opus-5-5.
- La réflexion ne se coupe plus. Sur Opus 5.5, le mode « thinking », où le modèle raisonne avant de répondre, ne peut plus être désactivé. La documentation d'Anthropic détaille le changement.
- L'historique ne se réécrit plus. Sur les comptes API créés depuis le 31 août 2026, impossible de modifier les tours précédents d'une conversation pour récupérer le raisonnement de Claude. Cette protection, déjà en place sur Fable 5.1, s'étend à Opus 5.5.
- Le texte change de forme. Si vos automatisations découpent les réponses à un endroit précis, le nouveau style peut les casser. C'est le bon moment pour passer aux sorties structurées, au format fixe.
Côté abonnements : plus de marge sur cinq heures
Si vous utilisez Claude par abonnement plutôt que par l'API, le prix au token ne vous concerne pas directement.
Un modèle qui a besoin de moins de tokens pour la même tâche entame en revanche moins votre limite d'usage.
Anthropic ajoute deux gestes au lancement. Les limites sur cinq heures augmentent pour les offres Pro, Max et Team, et les abonnements reçoivent une remise à zéro de leur limite, à garder de côté et à déclencher quand vous le voulez.
Gardez-la pour le jour du gros refactor. 😋
Pour choisir votre offre, nous détaillons les différences entre Claude Pro, Max et Team. Les valeurs officielles figurent sur la page tarifaire d'Anthropic.
Sonnet 5.5 et Haiku 5.5 arrivent
Anthropic annonce Sonnet 5.5 et Haiku 5.5 pour les semaines à venir, avec une bonne partie des mêmes progrès en performance, en efficacité et en sécurité. La répartition de la gamme ne bouge pas.
- Opus pour les tâches difficiles : refactor de grande ampleur, migration de code, débogage qui oblige à garder plusieurs fichiers en tête.
- Sonnet pour le quotidien, quand la vitesse compte autant que la finesse.
- Haiku pour le volume : trier des messages, extraire des données, répéter la même tâche des milliers de fois.
En attendant, Opus 5.5 est disponible sur l'API, dans les applications Claude et chez Amazon Web Services, Google Cloud et Microsoft Azure.
Questions fréquentes
Combien coûte Claude Opus 5.5 ?
Anthropic facture 4 dollars le million de tokens en entrée et 20 dollars en sortie, soit 20 % de moins qu'Opus 5. Les lectures en cache tombent à 0,20 dollar et les écritures à 5 dollars.
Le mode rapide, jusqu'à 2,5 fois plus véloce dans Claude Code et sur la plateforme Claude, coûte 8 dollars en entrée et 40 dollars en sortie.
Opus 5.5 est-il vraiment 60 % moins cher qu'Opus 5 ?
Seulement sur les lectures en cache. Sur une tâche type, Anthropic mesure 40 % d'économie, grâce à des tokens à la fois moins chers et moins nombreux.
Face à Fable 5.1, facturé 10 dollars en entrée et 50 en sortie, Opus 5.5 est en revanche 60 % moins cher par token.
Opus 5.5 est-il meilleur que Fable 5.1 ?
Anthropic le place au même niveau sur la plupart des tâches, et devant sur les tests publiés : 66,4 % contre 55,8 % sur Terminal-Bench 4.0, par exemple.
L'entreprise précise que l'écart paraît plus faible en usage réel. Le plus fiable reste de rejouer cinq de vos demandes sur les deux modèles.
Pourquoi Opus 5.5 répond-il moins bien à certaines questions de cybersécurité ?
Parce qu'un autre modèle répond peut-être à sa place. Quand ses garde-fous se déclenchent, la plupart des tâches de cybersécurité sont confiées à Opus 4.8, sans message d'erreur.
Corriger les bugs de votre propre code reste possible. Les équipes de sécurité défensive pourront bientôt demander un accès élargi via le Cyber Verification Program.
Quand sortent Sonnet 5.5 et Haiku 5.5 ?
Anthropic les annonce dans les semaines qui suivent la sortie d'Opus 5.5, le 22 septembre 2026, avec une bonne partie des mêmes améliorations.
Sonnet vise les tâches du quotidien, Haiku les traitements répétés en grand volume, comme le tri de messages ou l'extraction de données.




