SFEIR

Claude Fable 5.1 : Anthropic mise sur le travail long et baisse la facture du cache

Claude Fable 5.1 : Anthropic mise sur le travail long et baisse la facture du cache

Le 1er septembre 2026, Anthropic a mis en ligne Claude Fable 5.1 et Claude Mythos 5.1, trois mois après la sortie de Fable 51. Le prix affiché ne bouge pas, 10 $ le million de tokens en entrée et 50 $ en sortie. Le changement sur le pricing est ici : le cache read est divisé par quatre, les garde-fous interviennent beaucoup moins souvent, et le modèle double le score sur le benchmark de recherche scientifique. L'identifiant API est claude-fable-5-12.

Cet article s'adresse aux équipes qui font déjà tourner des agents sur Opus 5 ou Fable 5 et qui doivent décider quoi migrer, à quel prix, et pour qui. Pour la lecture d'ensemble de la gamme, notre carte des modèles Claude reste le point d'entrée.

Un modèle, deux niveaux de garde-fous

Fable 5.1 et Mythos 5.1 partagent les mêmes poids. La différence tient aux classifieurs de sécurité posés devant le modèle. Fable 5.1 est disponible pour tout le monde, avec des restrictions concentrées sur deux domaines : la cybersécurité offensive et la biologie. Mythos 5.1 retire une partie de ces filtres et reste réservé aux organisations validées par deux programmes de vérification d'Anthropic, l'un pour la défense cyber, l'autre pour les sciences de la vie. Ce second programme, monté avec le gouvernement américain, n'est ouvert qu'à des organisations américaines à cette date1. La documentation développeur, elle, continue de renvoyer l'accès Mythos à Project Glasswing2.

Cette architecture existait déjà avec Fable 5 et Mythos 5, sortis le 9 juin 2026, retirés dix-huit jours pour cause de contrôles à l'export américains, puis remis en ligne début juillet. Nous avions raconté cette suspension et détaillé le fonctionnement des classifieurs. Le changement du 1er septembre porte sur leur réglage. Anthropic annonce 60 % de faux positifs en moins sur le cyber, et des garde-fous biologie qui interviennent sur des requêtes bénignes 85 % moins souvent qu'au lancement de Fable 51. Boris Cherny, créateur et responsable de Claude Code, traduit le premier chiffre pour ses utilisateurs : environ 60 % d'interventions cyber en moins par session3.

La frontière reste nette côté cyber. Fable 5.1 identifie des vulnérabilités logicielles mais refuse de développer des exploits. Pentest, génération d'exploits et scan de binaires sont redirigés vers un modèle Opus. Même logique en biologie et en chimie pour les requêtes à double usage.

Les benchmarks : le saut est sur le travail long, pas sur le code ligne à ligne

Anthropic publie ses chiffres avec les garde-fous de Fable activés, ce qui pénalise parfois le modèle : une intervention peut valoir un zéro sur une tâche OSWorld1. Le tableau reprend les valeurs de l'annonce.

BenchmarkFable 5.1Fable 5Opus 5GPT-5.6 Sol
Recherche scientifique en terminal (Terminal-Bench-Science 0.1)52,6 %24,7 %29,0 %22,4 %
Codage agentique en terminal (Terminal-Bench 4.0)55,8 % (Mythos 5.1 : 60,9 %)42,0 %52,3 %37,3 %
Travail de la connaissance (GDPval-AA v2)1853172318241711
Usage d'ordinateur (OSWorld 2.0, strict / partiel)41,7 % / 77,9 %36,1 % / 72,9 %39,6 % / 75,4 %
Raisonnement multidisciplinaire (Humanity's Last Exam, sans / avec outils)60,9 % / 65,0 %57,8 % / 63,8 %56,6 % / 63,6 %
Workflows métier (AutomationBench)31,4 %17,1 %26,9 %19,6 %
Complétion de code en IDE (CursorBench 3.2.0)73,4 %70,5 %70,0 %67,2 %

Scores publiés par Anthropic le jour du lancement1 ; mesures constructeur, harnais internes, garde-fous Fable activés. Aucune mesure indépendante n'était disponible au 2 septembre 2026.

Sur CursorBench, Fable 5.1 gagne trois points sur Fable 5, l'écart d'une révision mineure. Sur Terminal-Bench-Science, le score passe de 24,7 % à 52,6 %, et sur AutomationBench de 17,1 % à 31,4 %. Le modèle progresse là où il faut enchaîner des dizaines d'étapes, garder le fil et ne pas tricher. Anthropic insiste sur la baisse des raccourcis, ce réflexe des agents de code qui désactivent un test en échec au lieu de corriger le bug1.

L'écart de cinq points entre Fable 5.1 et Mythos 5.1 sur Terminal-Bench 4.0 se lit avec les poids en tête : ils sont identiques. Les cinq points correspondent aux tâches interceptées par les classifieurs, comptées pour zéro dans le score de Fable.

L'exemple Millennium, rapporté par Anthropic, illustre le type de tâche visé1. Un crash survenant environ une fois par million d'exécutions, jamais expliqué en plusieurs années. Fable 5.1 a désassemblé une bibliothèque tierce, recoupé le résultat avec le core dump et localisé le bug. Ni les ingénieurs ni Fable 5 ne l'avaient trouvé. Le témoignage vient d'un client sélectionné par l'éditeur, il vaut comme démonstration, pas comme statistique.

La facture : même tarif, cache read divisé par quatre

Le prix API ne change pas : 10 $ par million de tokens en entrée, 50 $ en sortie, fenêtre de 1 million de tokens, 128 000 tokens de sortie au maximum, coupure de connaissances en juin 20262. Le levier économique se trouve ailleurs : le cache read passe de 1 $ à 0,25 $ par million de tokens. Les écritures en cache restent à 12,50 $ pour cinq minutes de durée de vie et 20 $ pour une heure2.

Grille tarifaire de Claude Fable 5.1, par million de tokensCinq barres horizontales : sortie 50 dollars, cache write une heure 20 dollars, cache write cinq minutes 12,50 dollars, entrée 10 dollars, cache read 0,25 dollar. Seule la dernière ligne change par rapport à Fable 5, où le cache read valait 1 dollar. PRIX PAR MILLION DE TOKENS, FABLE 5.1 Sortie 50 $ Cache write, 1 heure 20 $ Cache write, 5 minutes 12,50 $ Entrée 10 $ Cache read 0,25 $ 1 $ sur Fable 5, seule ligne qui bouge Le gain dépend de la part de relecture de contexte dans vos sessions, pas de la fiche tarifaire.
Grille tarifaire de Fable 5.1 au 1er septembre 2026, d'après la documentation Anthropic. Une seule ligne a changé depuis Fable 5, et c'est celle qui pèse le plus dans une session agentique longue.

Anthropic traduit cette baisse en coût réel : environ 25 % de moins qu'avec Fable 5 sur un workload typique, jusqu'à 45 % sur les usages très agentiques1. Boris Cherny avance un chiffre intermédiaire pour Claude Code, jusqu'à 38 % de moins sur une session type3. La mécanique est simple. Un agent qui travaille plusieurs heures sur un dépôt relit sans cesse le même contexte : fichiers, historique d'outils, instructions système. Plus la session est longue, plus la part du cache dans la facture grimpe, et plus la baisse compte.

Theo Browne apporte un contrepoint à partir de son usage réel : les écritures en cache représentent plus de 65 % de son coût Fable 5.1 dans Claude Code4. La baisse porte sur les lectures, pas sur les écritures. Le gain dépend donc du profil de vos sessions, et il se mesure sur vos propres traces d'usage. Nous avions développé ce raisonnement dans notre article sur le coût par outcome : le prix au token est une donnée d'entrée, pas un résultat.

Face à Opus 5, à 5 $ et 25 $, le rapport de force reste défavorable à Fable sur le tarif brut. Anthropic continue de recommander Opus 5 comme modèle de départ pour la majorité des workloads, et réserve Fable 5.1 aux cas où Opus à effort élevé ne passe pas vos évaluations2. Le décalage avec l'open-weights s'élargit aussi : un compte de veille relève que GLM-5.3-Flash atteindrait 95 % du score de Fable 5.1 sur un index agentique tiers, pour un coût d'entrée 133 fois inférieur5. Le chiffre n'a pas été recoupé, l'ordre de grandeur rejoint ce que nous observions sur GLM-5.3.

Accès : qui a Fable dans son abonnement

Le modèle est disponible sur la Claude API, Amazon Bedrock, Google Cloud et Microsoft Foundry2. L'inférence restreinte aux États-Unis est facturée 1,1 fois le tarif standard, comme sur les autres modèles de la gamme6.

Côté abonnements, les plans Max et les sièges premium Team et Enterprise incluent Fable 5.1 dans la souscription, jusqu'à 50 % de l'usage hebdomadaire. Sur les plans Pro et les sièges Team ou Enterprise standard, le modèle sort des quotas et se paie en crédits d'usage facturés au tarif API7. Plusieurs retours de terrain désignent ces limites d'usage comme le vrai goulot d'étranglement, devant les capacités du modèle8.

Pour les entreprises, Anthropic annonce Enterprise Frontier Safeguards : les données restent dans une infrastructure cloud contrôlée par le client, avec une confidentialité présentée comme équivalente au zero data retention, tout en conservant la détection d'usage adversaire. Le déploiement démarre à l'automne. En attendant, les clients éligibles peuvent obtenir le zero data retention sur Fable 5.11. Fable 5 imposait une rétention de trente jours qui écartait le modèle des données régulées, un point que nous avions relevé dans l'analyse d'Opus 5. Cette porte se rouvre pour les clients que l'éditeur juge éligibles, sans que les critères soient publiés. Sur Amazon Bedrock, le modèle reste classé Covered Model : rétention jusqu'à trente jours et revue humaine par du personnel Amazon, sauf pour les clients admis au zero data retention9.

Ce que le modèle sait faire en science

Anthropic présente trois démonstrations, à lire pour ce qu'elles sont : un modèle qui orchestre des outils existants, avec des validations confiées à des tiers1.

Sur Vénus, Fable 5.1 a entraîné un réseau de neurones sur trente ans d'images radar de la sonde Magellan et sur une carte d'élévation existante couvrant un cinquième de la planète. Résultat : une carte haute résolution d'un tiers de Vénus, avec des détails à deux ou trois kilomètres contre dix à vingt auparavant, et des altitudes jusqu'à 25 % plus précises. Elle est publiée sous licence Creative Commons, en amont des missions VERITAS et EnVision.

En conception de protéines, Mythos 5.1 a piloté des outils open source de design et de repliement. Deux organisations externes ont validé les designs en laboratoire. Les affinités mesurées sont dix fois supérieures aux meilleurs designs des compétitions Adaptyv Bio sur trois cibles, avec un taux de réussite proche de 50 % sur douze cibles, là où le taux habituel se situe entre 10 et 15 %.

Enfin, Mythos 5.1 a réécrit des kernels GPU et mis en cache des calculs intermédiaires sur sept modèles open source de biologie computationnelle : jusqu'à 2,5 fois plus rapide avec des sorties identiques, et 30 à 60 % de coûts GPU en moins sur des analyses de génome entier. Anthropic dit vouloir publier ces optimisations en open source.

Le ton, et ce que les benchmarks ne mesurent pas

Le post de Boris Cherny se termine sur un point absent des tableaux. Fable 5.1 écrit mieux et avec un meilleur ton. Anthropic dit avoir entendu les retours sur le « Claude-speak » et travailler à le réduire, avec des progrès solides sur 5.1 et d'autres à venir3. Le compte @ClaudeDevs ajoute que le modèle va plus loin dans une tâche longue avant de demander une intervention, et qu'il dit mieux quand il est bloqué10. Ethan Mollick, qui a eu un accès anticipé, résume l'ensemble ainsi : une vraie avancée sur le travail long qui demande jugement et goût, moins sur le reste11.

Ce que cela change pour vos équipes

Si vous utilisez déjà Opus 5 comme modèle quotidien, mesurez la part de cache read dans vos sessions agentiques les plus longues : le gain de 25 à 45 % se joue sur cette ligne de facture et nulle part ailleurs. Testez Fable 5.1 sur les tâches où Opus décroche : celles qui dépassent l'heure, traversent plusieurs dépôts ou demandent de reconstituer un bug intermittent. Vérifiez enfin qui, dans vos équipes, a Fable inclus dans son plan et qui devra passer par des crédits. Notre grille de routage par tâche reste valable, avec une case Fable désormais moins chère à occuper longtemps.

Pour la migration technique, la documentation liste trois changements cassants à examiner avant de basculer : le forced tool use renvoie une erreur, les blocs de raisonnement sont liés au modèle qui les a produits, et l'édition d'un tour antérieur les invalide2. Un agent de code autonome qui tourne des heures sur un dépôt a de bonnes raisons de basculer. Un assistant conversationnel n'en a guère : le tarif brut d'Opus 5 et sa latence gardent l'avantage sur les échanges courts.

FAQ

Claude Fable 5.1 coûte-t-il plus cher que Fable 5 ? Non. Entrée et sortie restent à 10 $ et 50 $ par million de tokens. Le cache read passe de 1 $ à 0,25 $, ce qui baisse la facture des sessions longues de 25 à 45 % selon Anthropic. Les écritures en cache ne changent pas.

Quelle différence entre Fable 5.1 et Mythos 5.1 ? Aucune sur les poids. Mythos 5.1 retire une partie des classifieurs cyber et biologie, et n'est accessible qu'aux organisations validées par les programmes de vérification d'Anthropic ou par Project Glasswing.

Faut-il remplacer Opus 5 par Fable 5.1 ? Pas par défaut. Anthropic recommande de partir d'Opus 5 et de passer à Fable 5.1 quand vos évaluations à effort élevé restent insuffisantes, en pratique sur les tâches agentiques de plusieurs heures.


Sources

  1. « Introducing Claude Fable 5.1 and Claude Mythos 5.1 », Anthropic, 1er septembre 2026 — annonce, tableau de benchmarks (garde-fous Fable activés), baisse du cache read (−75 %) et gains de 25 à 45 %, réglage des garde-fous (−60 % de faux positifs cyber, −85 % d'interventions biologie sur requêtes bénignes), programmes de vérification cyber et sciences de la vie pour Mythos 5.1, Enterprise Frontier Safeguards et zero data retention transitoire, démonstrations scientifiques (Vénus, protéines, kernels GPU), exemple Millennium. Chiffres constructeur, harnais internes, témoignages clients sélectionnés par l'éditeur. anthropic.com — Claude Fable 5.1 and Mythos 5.1
  2. « Claude Fable 5.1 overview » et « What's new in Claude Fable 5.1 », Claude Platform Docs, septembre 2026 — identifiant claude-fable-5-1, contexte 1M, sortie 128K, coupure de connaissances juin 2026, grille tarifaire (cache write 12,50 $ et 20 $, cache read 0,25 $), plateformes, recommandation de partir d'Opus 5, accès Mythos via Project Glasswing, trois changements cassants. platform.claude.com — Fable 5.1 overview · What's new
  3. Boris Cherny (Creator & Head of Claude Code, Anthropic), publication LinkedIn, 1er septembre 2026 — environ 60 % d'interventions cyber en moins par session dans Claude Code, jusqu'à 38 % de coût en moins sur une session type, travail sur le « Claude-speak ». Déclaration du responsable produit, sans mesure indépendante.
  4. Theo Browne (t3.gg), deux publications sur X, 1er et 2 septembre 2026 — les écritures en cache pèsent plus de 65 % de sa facture Fable 5.1 dans Claude Code ; retour sur le gain de productivité. Retour d'usage individuel. post 1 · post 2
  5. TheGitAI, publication sur X, 2 septembre 2026 — GLM-5.3-Flash à 95 % du score de Fable 5.1 sur un index agentique tiers, pour un coût d'entrée 133 fois inférieur. Source secondaire non recoupée à la date de publication. x.com — @thegitai
  6. « Pricing », Claude Platform Docs — résidence des données et inférence restreinte aux États-Unis facturée 1,1× (inference_geo). platform.claude.com — Pricing
  7. « Anthropic Ships Claude Fable 5.1, More Than Doubling Its Predecessor on Key Benchmark », Decrypt, 1er septembre 2026 — inclusion de Fable 5.1 dans les plans Max et les sièges premium Team et Enterprise jusqu'à 50 % de l'usage hebdomadaire, crédits d'usage au tarif API pour Pro et les sièges standard, rappel de la coupure de dix-huit jours pour contrôle à l'export. Source secondaire ; la page d'annonce d'Anthropic ne détaille pas les abonnements. decrypt.co
  8. ZypherHQ, publication sur X, 2 septembre 2026 — orchestration agentique et limites d'usage comme premier goulot d'étranglement. Retour d'usage d'une équipe. x.com — @ZypherHQ
  9. « Introducing Claude Fable 5.1 on AWS », AWS Machine Learning Blog, septembre 2026 — statut Covered Model (« subject to data retention for up to 30 days and human review by Amazon personnel »), mode aws_review, zero data retention pour les clients éligibles sur Amazon Bedrock et Claude Platform on AWS, Enterprise Frontier Safeguards avec rétention dans le compte AWS du client annoncée pour plus tard en 2026. aws.amazon.com
  10. @ClaudeDevs, publication sur X, 1er septembre 2026 — Fable 5.1 dans Claude Code et la Claude Platform, comportement en tâche longue. x.com — @ClaudeDevs
  11. Ethan Mollick (Wharton), deux publications sur X, 1er et 2 septembre 2026 — accès anticipé, « real advance in long-run work », comparaison de shaders Fable 5 / Fable 5.1. Retour d'usage individuel, accès fourni par Anthropic. post 1 · post 2
SFEIR AI Auteur

Articles similaires