Vous confiez vos corrections de bugs à Claude Opus parce que Sonnet se trompait trop souvent. Chaque mois, la facture de l'API vous rappelle ce choix très coûteux.
Claude Sonnet 5.5 est le modèle intermédiaire d'Anthropic, sorti le 28 septembre 2026. Il remplace Claude Sonnet 5 au même tarif et génère ses réponses plus de 30 % plus vite. Sur plusieurs tests, il arrive à quelques points d'Opus 5.5, pour moitié prix.
Vous trouverez ici ses scores comparés et le calcul de ce qu'il vous coûte vraiment. Suivent les usages où Opus garde l'avantage, puis les changements d'API qui cassent un code écrit pour Sonnet 5. Les parties sur les benchmarks et les prix se lisent sans rien connaître de l'API.
Où se place Sonnet 5.5 dans la gamme Claude
Anthropic range ses modèles par taille. Haiku est le plus petit et le moins cher, Sonnet est l'intermédiaire, Opus le plus puissant des trois. Au-dessus, Fable et Mythos forment le haut de gamme.
Sonnet 5.5 est le deuxième modèle de la famille Claude 5.5, après Opus 5.5. Anthropic l'a annoncé comme un complément plus rapide et moins cher d'Opus 5.5, pas comme son remplaçant. Un Haiku 5.5 était annoncé pour les semaines suivant la sortie.
Si vous utilisiez Sonnet 5, sorti le 30 juin 2026, notre article sur Claude Sonnet 5 détaille le point de départ. Tous les écarts qui suivent se mesurent par rapport à lui.
Les benchmarks, là où il rattrape Opus 5.5 et là où il cale
Tous les chiffres qui suivent viennent de l'annonce d'Anthropic. Ce sont ses propres mesures, pas des classements indépendants.
| Test | Ce qu'il mesure | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|---|
| Terminal-Bench 4.0 | Tâches en ligne de commande, en plusieurs étapes | 70,6 % | 10,3 % | 66,4 % |
| CursorBench 4.0 | Tâches tirées de vraies sessions de code dans Cursor | 55,5 % | 34,1 % | 57,8 % |
| OSWorld 2.1 | Piloter un ordinateur (souris, clavier, écran) | 80,1 % | 57,0 % | 81,8 % |
| Chartography | Lire des graphiques, sans outil | 61,6 % | 15,6 % | 64,4 % |
| Humanity's Last Exam | Questions de niveau expert, avec outils | 64,5 % | 54,9 % | 67,7 % |
| GDPval-AA v2.1 | Travail réel dans 44 métiers, score de type Elo | 1 844 | 1 449 | 1 846 |
Le bond le plus net concerne le code. Sur Terminal-Bench 4.0, Sonnet 5.5 dépasse même Opus 5.5, dans les réglages publiés par Anthropic.
Passer de 10,3 % à 70,6 %, c'est gagner 60,3 points de pourcentage. Le score est multiplié par 6,9. Sur GDPval-AA, le score est une cote de type Elo, où seul l'écart compte. Sonnet 5.5 prend 395 points sur Sonnet 5 et finit à 2 points d'Opus 5.5.
Pour un développeur seul, ça veut dire qu'une tâche comme « lance les tests, trouve pourquoi ils échouent, corrige » a bien plus de chances d'aboutir sans vous. Sonnet 5 échouait neuf fois sur dix sur ce type de test.
Sonnet 5.5 est aussi le premier Sonnet à terminer Pokémon Rouge en ne voyant que des captures d'écran. Une partie dure des heures et oblige à lire l'écran en permanence.
Anthropic écrit elle-même qu'Opus 5.5 est nettement plus fort sur le travail ouvert, celui qui demande du jugement pendant longtemps. Les benchmarks ne mesurent qu'une facette. Pour un choix d'architecture flou ou un audit sans consigne précise, les scores proches ne garantissent pas un résultat proche.
Le prix ne bouge pas
À son lancement, Sonnet 5.5 garde exactement les tarifs de Sonnet 5. Ceux d'Opus 5.5 sont deux fois plus élevés :
| Prix par million de tokens, au lancement | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Entrée | 2 $ | 4 $ |
| Sortie | 10 $ | 20 $ |
| Écriture en cache | 2,50 $ | 5 $ |
| Lecture en cache | 0,20 $ | 0,20 $ |
Un token est un morceau de mot, l'unité que facture l'API. Si le prix du token ne change pas, la baisse vient d'ailleurs. Sonnet 5.5 consomme moins de tokens pour faire le même travail, d'après les tests d'Anthropic.
Il regroupe aussi ses appels d'outils, ces moments où il lit un fichier ou lance une commande. Moins d'étapes, moins de texte relu à chaque étape, donc moins de tokens facturés.
« Jusqu'à 30 % moins cher » est un plafond mesuré par Anthropic. Une tâche qui vous coûtait 1 $ sur Sonnet 5 revient au mieux à 0,70 $. À nombre de tokens égal, la même tâche sur Opus 5.5 coûterait 2 $.
Les « 30 % plus rapide » visent la vitesse d'écriture, en tokens par seconde. Comme il écrit aussi moins, une tâche peut finir plus tôt encore. Le temps d'exécution de vos commandes, lui, ne change pas.
Le niveau d'effort, votre vrai bouton de réglage
L'effort règle combien de temps Claude réfléchit avant de répondre. Il va de low à max. Medium est le réglage par défaut dans les applications Claude et dans Claude Code, High sur l'API.
Sur plusieurs tests, Sonnet 5.5 en Low ou Medium bat le meilleur score de Sonnet 5 pour environ un dixième du coût par tâche. En High sur FrontierCode, il prend 10 points à Sonnet 5 au même réglage, pour environ un quinzième du coût.
Anthropic précise que les niveaux ont été recalibrés. Un réglage « medium » ne produit pas la même quantité de réflexion que sur Sonnet 5, il faut donc refaire vos essais plutôt que reprendre vos anciens réglages.
Ce que les premiers testeurs ont mesuré
Ces chiffres viennent d'entreprises qui avaient accès au modèle avant sa sortie. Anthropic les a publiés sur sa page consacrée à Sonnet. Ce sont leurs tests internes, pas des benchmarks publics.
- Box, qui vend du stockage de documents aux entreprises, a obtenu des réponses plus justes, 2,4 fois plus rapides, avec 12 % de tokens en moins.
- Zendesk, éditeur de logiciels de support client, a traité ses tickets 20 % plus vite sur des centaines de cas réels, avec moins de mauvaises décisions.
- Slack a vu de meilleurs résultats sur presque toutes les évaluations internes de son Slackbot, sans toucher aux prompts, avec environ 14 % de tokens de sortie en moins.
- Lovable, qui génère des applications à partir d'une description, a compté un tiers d'appels d'outils en moins et deux fois moins de commandes lancées pour finir une tâche de code.
- Base44, autre générateur d'applications, a obtenu sur 118 applications réelles un résultat au niveau d'Opus 5 en 3,6 itérations en moyenne, contre 7,7 pour Opus 5.
Le cas de Base44 parle à quiconque construit seul. Le modèle s'arrêtait rarement en cours de route pour poser une question. Un agent qui tourne la nuit ne passe donc pas des heures à attendre votre réponse.
Pour quelles tâches le choisir plutôt qu'Opus 5.5
Pour Anthropic, Sonnet 5.5 excelle sur les tâches bien cadrées. Opus 5.5 garde l'avantage quand il faut trancher sans consigne claire.
- Corriger un bug ou ajouter une fonctionnalité dans un projet existant. Sonnet 5.5 comprend vite une base de code et garde des modifications assez petites pour être relues.
- Produire des documents, des tableurs et des présentations. Dans un test interne d'Anthropic, deux experts ont jugé un premier jet de 10 diapositives prêt à envoyer tel quel.
- Soigner une interface. Les testeurs ont noté son œil pour le design, les parcours utilisateurs et le respect d'un modèle de diapositives.
- Faire tourner un agent souvent. Chaque passage consomme moins de tokens, et le coût tient quand la tâche se répète.
Si vous codez avec un agent dans le terminal, c'est Sonnet 5.5 que vous aurez le plus souvent sous la main. Notre formation Claude Code montre comment lui confier une tâche et relire ce qu'il a changé.
Pour les maquettes et les écrans, son sens du design se travaille avec la bonne méthode. Notre formation dédiée au design avec Claude part de là.
Gardez Opus 5.5 pour un choix d'architecture, une recherche qui doit durer des heures sans consigne, ou une décision que vous ne savez pas formuler vous-même. Notre article sur Opus 5.5 détaille ses propres résultats.
Ce qui casse quand vous migrez depuis Sonnet 5
Changer l'identifiant du modèle ne suffit pas. La documentation de l'API liste cinq changements incompatibles avec un code écrit pour Sonnet 5.
- Le type de réflexion
disabledrenvoie une erreur 400. Il faut envoyerbetween_tools, le réglage de réflexion le plus bas. - L'utilisation forcée d'outils (
tool_choiceàanyoutool) renvoie une erreur 400. Seulsautoetnonepassent. - Les blocs de réflexion sont liés au modèle, à la conversation et au compte qui les a produits.
- L'ancien outil
computer_20251124est refusé sur l'API Claude et Google Cloud, au profit decomputer_toolset_20260801. - L'outil conseiller refuse Opus 4.8, Opus 4.7 et Sonnet 5 comme conseillers.
Voici un appel minimal avec le SDK Python, réflexion préalable coupée et effort moyen.
import anthropic
client = anthropic.Anthropic() # lit la clé dans ANTHROPIC_API_KEY
response = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=2048,
thinking={"type": "between_tools"}, # remplace "disabled"
output_config={"effort": "medium"}, # low, medium ou high avec between_tools
messages=[
{"role": "user", "content": "Explique ce que fait la fonction suivante.\n\nVOTRE_CODE_ICI"}
],
)
print(response.content[-1].text)between_tools n'accepte que les efforts low, medium et high. Pour monter en xhigh ou max, retirez le champ thinking pour revenir à la réflexion adaptative.
Si votre application montre en direct le texte que Claude écrit entre deux appels d'outils, elle devient muette, sans aucune erreur. Ce texte arrive dans des blocs thinking dont le contenu est vide par défaut. Réglez thinking.display en réflexion adaptative, ou passez par between_tools.
Autre piège, pour les comptes créés à partir du 31 août 2026. Modifier un message ancien de l'historique avant de rejouer un bloc de réflexion de Sonnet 5.5 renvoie une erreur 400. Ajoutez des messages en fin de conversation plutôt que de réécrire les précédents.
Pourquoi certaines demandes basculent vers Sonnet 5
Sonnet 5.5 s'en sort bien mieux que Sonnet 5 en cybersécurité. Anthropic l'a donc équipé de filtres automatiques qui renvoient certaines demandes vers Sonnet 5, comme sur ses modèles les plus puissants.
- Cybersécurité offensive. Les demandes jugées à risque basculent vers Sonnet 5. Chercher et corriger les failles de votre propre code n'est pas concerné.
- Biologie. Les demandes dangereuses sont bloquées net, sans bascule, avec les mêmes filtres que Sonnet 5.
- Développement de modèles de pointe. Quelques sujets très pointus, comme certains noyaux pour accélérateurs, basculent vers Sonnet 5.
- Extraction du raisonnement. Demander de recopier mot pour mot sa réflexion interne est bloqué. Demander « pourquoi as-tu fait ça ? » passe sans problème.
Les filtres lisent tout ce que le modèle lit, pas seulement votre message. Un fichier joint ou un résultat de recherche peut donc déclencher une bascule que vous n'avez pas provoquée.
Dans les applications Claude, un avis signale la bascule et la réponse porte le nom du modèle qui l'a écrite. Le sélecteur passe ensuite sur Sonnet 5, et vous pouvez revenir à Sonnet 5.5 à la main. L'aide d'Anthropic explique comment couper ce changement automatique.
Où utiliser Claude Sonnet 5.5
Sonnet 5.5 est ouvert à tous sur Claude.ai, sur le web, iOS et Android. Pour les développeurs, l'identifiant est claude-sonnet-5-5 sur l'API Claude.
- Amazon Bedrock, avec
anthropic.claude-sonnet-5-5 - Google Cloud, avec
claude-sonnet-5-5 - Microsoft Foundry, avec
claude-sonnet-5-5
Le modèle était proposé à son lancement avec la non-conservation des données, une option où Anthropic ne garde pas vos requêtes. Utile si vous traitez des fichiers clients.
Le cache de prompt réduit la facture jusqu'à 90 % sur les parties répétées, et le traitement différé par lots de 50 %, d'après la page Sonnet d'Anthropic.
Questions fréquentes sur Claude Sonnet 5.5
Combien coûte Claude Sonnet 5.5 ?
À son lancement, Claude Sonnet 5.5 coûte 2 $ par million de tokens en entrée et 10 $ en sortie, comme Sonnet 5. La lecture en cache est facturée 0,20 $ par million.
Anthropic estime qu'une tâche coûte jusqu'à 30 % de moins qu'avec Sonnet 5. Le prix du token est le même, mais le modèle en consomme moins pour le même travail.
Claude Sonnet 5.5 est-il meilleur qu'Opus 5.5 ?
Non, mais il s'en approche sur plusieurs tests. Sur GDPval-AA, il obtient 1 844 contre 1 846 pour Opus 5.5, et il dépasse Opus 5.5 sur Terminal-Bench 4.0 avec 70,6 % contre 66,4 %.
Anthropic juge Opus 5.5 nettement plus fort sur le travail ouvert qui demande du jugement pendant longtemps. Sonnet 5.5 coûte deux fois moins cher au token.
Comment utiliser Claude Sonnet 5.5 avec l'API ?
L'identifiant du modèle est claude-sonnet-5-5 sur l'API Claude, Google Cloud et Microsoft Foundry. Sur Amazon Bedrock, c'est anthropic.claude-sonnet-5-5.
Un code écrit pour Sonnet 5 doit être adapté. Le type de réflexion disabled renvoie une erreur 400 et se remplace par between_tools. L'utilisation forcée d'outils n'est pas prise en charge.
Pourquoi Claude est-il passé de Sonnet 5.5 à Sonnet 5 pendant ma conversation ?
Sonnet 5.5 renvoie vers Sonnet 5 les demandes que ses filtres jugent à risque, surtout en cybersécurité offensive. La conversation reste ensuite sur Sonnet 5, et vous pouvez revenir à Sonnet 5.5 depuis le sélecteur de modèle.
Les filtres lisent aussi les fichiers joints et les résultats de recherche. Une bascule peut donc venir d'un contenu que vous n'avez pas tapé vous-même.



