Claude Fable 5.1 est le modèle d'Anthropic pour le code, le travail de bureau et les tâches longues menées seul. Il existe en deux exemplaires identiques : Fable 5.1, ouvert à tous, et Claude Mythos 5.1, réservé à des programmes d'accès vérifiés. Anthropic annonce un coût inférieur d'environ 25 % à celui de Fable 5 sur une charge typique facturée au token.
Regardons d'où vient cette baisse et ce que valent les scores annoncés par le nouveau modèle annoncé le 1er septembre 2026.
Un seul modèle, deux jeux de garde-fous
Fable 5.1 et Mythos 5.1 sortent du même entraînement.
La seule différence tient aux garde-fous, ces filtres qui refusent certaines demandes. Fable 5.1 est la version publique, disponible sur l'API d'Anthropic ainsi que chez Amazon Web Services, Google Cloud et Microsoft Azure, sous l'identifiant claude-fable-5-1.
Mythos 5.1 porte des garde-fous plus permissifs, réservés à deux programmes de vérification :
- l'un pour la sécurité informatique défensive,
- l'autre pour les professionnels des sciences du vivant, monté avec le gouvernement américain.
Anthropic fait avancer plusieurs lignes de modèles en parallèle. Si vous cherchez à situer celle-ci, nous avons déjà détaillé le lancement de Claude Fable 5 et celui de Claude Opus 5, vers lequel Fable 5.1 redirige certaines demandes sensibles.
Les scores, et ce que les garde-fous coûtent
Tous les chiffres ci-dessous viennent des mesures d'Anthropic, publiées dans l'annonce de Fable 5.1 et Mythos 5.1. Sauf mention contraire, il s'agit de pourcentages de tâches réussies.
| Épreuve | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6 % | 24,7 % | 29,0 % | 22,4 % |
| Terminal-Bench 4.0 (dans Claude Code) | 55,8 % | 42,0 % | 52,3 % | 37,3 % |
| AutomationBench | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
| OSWorld 2.0 (notation stricte) | 41,7 % | 36,1 % | 39,6 % | non publié |
| Humanity's Last Exam, sans outils | 60,9 % | 57,8 % | 56,6 % | non publié |
| GDPval-AA v2 (indice, plus haut vaut mieux) | 1853 | 1723 | 1824 | 1711 |
Le saut le plus visible concerne la recherche scientifique conduite en autonomie. Fable 5.1 y marque 52,6 % contre 24,7 % pour Fable 5, soit 27,9 points d'écart.
27,9 points ne se lisent pas comme 27,9 %. Passer de 24,7 % à 52,6 %, c'est 113 % de progression relative, donc un score qui double. Attention toutefois : Anthropic annonce une erreur standard de 3,5 à 4,5 points par modèle sur cette épreuve. Deux résultats séparés par 3 points ne se départagent pas.
Le chiffre le plus instructif du lot n'apparaît pas dans le tableau. Sur Terminal-Bench 4.0, Mythos 5.1 atteint 60,9 % là où Fable 5.1 plafonne à 55,8 %.
C'est le même modèle. Les 5,1 points d'écart mesurent uniquement le prix des garde-fous de la version publique, pas une différence de capacité.
Anthropic précise que Fable 5.1 a été évalué garde-fous activés. Quand ces filtres sont intervenus, le modèle a reçu un zéro sur OSWorld 2.0, et Fable 5 également sur AutomationBench. Ces scores sous-estiment donc probablement les deux modèles.
Deux acteurs de la finance ont testé le modèle avant sa sortie.
![]()
D'où viennent les 25 % d'économie
Une seule ligne du tarif bouge, celle des lectures de cache de prompt.
Quand votre agent renvoie le même dépôt et les mêmes instructions à chaque tour, ce contexte déjà traité n'est plus facturé au tarif plein.
Anthropic descend ce tarif à 0,25 dollar par million de tokens, contre 1 dollar auparavant. Les tarifs d'entrée et de sortie ne changent pas, et la page tarifaire d'Anthropic donne les valeurs du jour.
« 25 % moins cher » ne veut pas dire que les prix baissent de 25 %. Seule la lecture de cache baisse, de 75 %. Les 25 % sont l'effet de cette baisse sur la facture d'une charge de travail où le cache pèse lourd. Si votre usage ne réutilise aucun contexte, vous ne verrez rien.
Que du marketing (ou presque). 😉
Moins d'arrêts en pleine session
Le deuxième changement se sent plus vite que le premier.
Les garde-fous de sécurité informatique de Fable 5.1 se déclenchent environ 60 % moins souvent par session dans Claude Code qu'avec ceux livrés sur Fable 5, selon les mesures d'Anthropic.
La raison principale : Fable 5.1 peut désormais chercher des failles dans du code source. Il ne peut toujours pas écrire le programme qui les exploite.
Trois familles de tâches restent redirigées vers les modèles Opus, parce qu'elles servent autant à défendre qu'à attaquer :
- Tests d'intrusion, où l'on simule une attaque réelle sur un système
- Génération d'exploits, le code qui transforme une faille en prise de contrôle
- Analyse de vulnérabilités sur binaires, sans accès au code source
Côté biologie, les garde-fous de Fable 5.1 se déclenchent 85 % moins souvent sur des questions bénignes de biologie élémentaire ou de médecine, par rapport à ceux livrés avec Fable 5. La recherche et le développement en sciences du vivant passent toujours par les modèles Opus, ou par Mythos 5.1 pour les professionnels vérifiés.
Fable 5.1 accepte cinq niveaux d'effort de réflexion, de low à max. Réglé sur bas ou moyen, il atteint des résultats comparables ou supérieurs à ceux de Fable 5 pour beaucoup moins cher. Au moment de l'annonce, le niveau par défaut était haut dans Claude Code, et moyen dans Claude Cowork et sur Claude.ai.
Si vous pilotez déjà vos projets depuis le terminal, notre formation Claude Code couvre la façon de cadrer ces sessions longues. Pour les tâches de bureau, documents et tableurs, nous avons une formation dédiée à Claude Cowork.
Ce que le modèle a produit en laboratoire
Anthropic met en avant trois travaux menés par le modèle, qui donnent une idée plus concrète que les scores. Les deux premiers ont été confiés à Mythos 5.1, le troisième à Fable 5.1.
Conception de protéines. Avec des outils libres de repliement et de design, Mythos 5.1 a dessiné des molécules capables de s'accrocher à une cible dans le corps, première étape de beaucoup de médicaments. Deux organismes extérieurs ont testé ces designs en laboratoire.
Sur trois cibles, l'affinité obtenue est dix fois supérieure à celle des meilleurs designs soumis aux concours d'Adaptyv Bio. Le taux de designs viables approche 50 % sur 12 cibles, contre 10 à 15 % habituellement dans ce domaine.
Une nouvelle carte de Vénus. Fable 5.1 a entraîné un réseau de neurones sur les images radar de la mission Magellan de la NASA, vieilles de plus de trente ans. Le résultat couvre un tiers de la planète, distingue des détails de 2 à 3 kilomètres au lieu de 10 à 20, et donne des altitudes jusqu'à 25 % plus justes. Anthropic publie cette carte sous licence Creative Commons.
Des calculs deux fois plus rapides. Mythos 5.1 a réécrit le code qui fait tourner sept modèles d'apprentissage profond libres sur cartes graphiques. Les sorties sont identiques, la vitesse grimpe jusqu'à 2,5 fois, et la facture de calcul estimée baisse de 30 à 60 % sur ce type d'analyse. Ce travail prend d'ordinaire des semaines à une équipe d'ingénieurs spécialisés.
Confidentialité, watermark et distillation
Trois changements touchent le cadre d'usage plutôt que les capacités. Le premier concerne les entreprises, les deux autres tous les développeurs.
Enterprise Frontier Safeguards stocke les données du client sur sa propre infrastructure cloud, et non chez Anthropic.
Toute relecture humaine est effectuée par le client par défaut. Anthropic dit avoir bâti ce dispositif avec plus de cent clients et ses partenaires cloud, pour un déploiement par phases à partir de l'automne 2026. En attendant, les clients éligibles peuvent utiliser Fable 5.1 sans conservation des données.
Les sorties des modèles publiés après le 2 août 2026 portent une marque numérique, invisible sans l'API de détection, et qui ne contient rien sur l'utilisateur ni sur ses conversations. Cette obligation vient du code de bonnes pratiques signé au titre de l'AI Act européen. Nous détaillons le mécanisme dans notre article sur le fonctionnement du watermark de Claude.
Les comptes API créés à partir de la sortie de Fable 5.1 ne peuvent plus modifier le contexte des tours précédents tout en conservant la transcription du raisonnement de Claude. Anthropic ferme ainsi une technique connue de copie de modèle. Les comptes existants ne sont pas touchés, mais Anthropic prévoit d'appliquer la règle à tous lors des sorties suivantes. Une intégration maison qui réécrit l'historique cassera ce jour-là.
Ce que les tests d'alignement ne couvrent pas
Anthropic publie aussi ce qui ne marche pas.
L'audit automatisé du comportement place Mythos 5.1 au-dessus de Mythos 5 sur la plupart des mesures : il tente moins de sortir de son environnement de test, se justifie moins par de faux raisonnements, ignore moins les contraintes explicites.
Mais le modèle contourne encore parfois des demandes d'approbation et les filtres du mode automatique. Deux angles morts sont assumés : l'audit voit mal le travail en très long contexte, et mal les situations à plusieurs agents.
Sur les injections de prompt, ces instructions malveillantes cachées dans un contenu que le modèle lit, Anthropic le décrit comme son modèle le plus résistant à ce jour sur un test externe. Le mécanisme est expliqué dans notre glossaire, à l'entrée injection de prompt.
Ce que ça change concrètement pour vous
Vous allez réorganiser vos prompts pour mettre le stable devant. L'économie ne tombe pas toute seule : elle récompense les sessions où le contexte figé, consignes de projet et fichiers de référence, arrive en premier et ne bouge plus. Un prompt que vous réécrivez au milieu à chaque tour casse le cache et vous fait payer plein tarif.
Vous pouvez descendre d'un cran d'effort au lieu de descendre de modèle. Le réflexe habituel, quand la facture monte, consiste à basculer sur un modèle plus petit et à accepter des réponses moins bonnes. Réglé sur effort bas ou moyen, Fable 5.1 fait aussi bien ou mieux que Fable 5, pour beaucoup moins cher.
Vous pouvez enfin demander un audit de failles sur votre propre code. Chercher les points faibles de son application était l'un des cas où les anciens garde-fous coupaient la session sans prévenir. Avec environ 60 % d'interruptions en moins par session, ce type de revue devient utilisable seul, sans budget d'audit externe.
Questions fréquentes
Quelle est la différence entre Claude Fable 5.1 et Claude Mythos 5.1 ?
C'est le même modèle avec des garde-fous différents. Fable 5.1 est la version publique, disponible sur l'API et les grands clouds. Mythos 5.1 s'obtient via deux programmes de vérification, l'un pour la sécurité informatique défensive, l'autre pour les sciences du vivant.
L'écart se mesure : sur Terminal-Bench 4.0, Mythos 5.1 marque 60,9 % contre 55,8 % pour Fable 5.1, soit 5,1 points que les filtres coûtent à la version publique.
Claude Fable 5.1 coûte-t-il vraiment 25 % moins cher que Fable 5 ?
Sur une charge typique facturée au token, oui, d'après les mesures d'Anthropic. Mais ce gain vient uniquement des lectures de cache, passées de 1 dollar à 0,25 dollar par million de tokens.
Les tarifs d'entrée et de sortie ne bougent pas. Un usage qui ne réutilise aucun contexte ne gagne donc rien, tandis qu'un agent très bavard peut atteindre environ 45 % d'économie.
Peut-on lui faire chercher des failles de sécurité dans son propre code ?
Oui. Fable 5.1 est autorisé à identifier des vulnérabilités logicielles, mais pas à écrire le code qui les exploite.
Trois types de demandes sont encore renvoyés vers les modèles Opus : les tests d'intrusion, la génération d'exploits et l'analyse de vulnérabilités sur des binaires.
Faut-il basculer de Claude Opus 5 vers Claude Fable 5.1 ?
Sur les épreuves publiées par Anthropic, Fable 5.1 devance Opus 5 partout : 52,6 % contre 29,0 % en recherche scientifique autonome, 55,8 % contre 52,3 % sur Terminal-Bench 4.0, 31,4 % contre 26,9 % sur AutomationBench.
Une nuance compte : certaines tâches de cybersécurité et de sciences du vivant sont automatiquement redirigées vers Opus. Ces modèles gardent donc un rôle même si vous travaillez avec Fable 5.1.




