Claude Opus 5.5 : le niveau de Fable 5.1 au prix d'Opus, et quatre ruptures d'API à traiter
Le 22 septembre 2026, Anthropic a mis en ligne Claude Opus 5.5, premier modèle de la famille Claude 5.5, dix jours après l'essai de Dario Amodei appelant l'industrie à ralentir la frontière1. L'éditeur le donne au niveau de Claude Fable 5.1 sur la plupart des tâches, 40 % moins cher à l'usage qu'Opus 5 aux réglages par défaut, avec une sortie plus de 30 % plus rapide. Le prix au token baisse de 20 %, à 4 $ le million en entrée et 20 $ en sortie. L'identifiant API est claude-opus-5-52.
Cet article s'adresse aux équipes qui font tourner des agents sur Opus 5 ou Fable 5.1 et doivent décider quoi migrer, à quel réglage, et avec quelles précautions de code. Pour la lecture d'ensemble de la gamme, notre carte des modèles Claude reste le point d'entrée.
Un cran de capacité, un prix en baisse
D'ordinaire, un cran de capacité chez Anthropic s'accompagne d'un cran de prix. Opus 5.5 inverse la règle : l'entrée passe de 5 à 4 $ par million de tokens, la sortie de 25 à 20 $. Le cache read, la ligne qui pèse le plus lourd dans une session agentique longue, tombe de 0,50 à 0,20 $, soit 5 % du prix d'entrée contre 10 % sur Opus 53. Le contexte reste à 1 million de tokens, la sortie à 128 000 tokens (300 000 en Message Batches avec un en-tête bêta), la coupure de connaissances est fixée à juin 2026.
| Poste (par million de tokens, Claude API) | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Entrée | 4 $ | 5 $ | 10 $ |
| Sortie | 20 $ | 25 $ | 50 $ |
| Cache read | 0,20 $ | 0,50 $ | 0,25 $ |
| Cache write 5 min | 5 $ | 6,25 $ | 12,50 $ |
| Cache write 1 h | 8 $ | 10 $ | 20 $ |
| Batch (entrée / sortie) | 2 $ / 10 $ | 2,50 $ / 12,50 $ | 5 $ / 25 $ |
| Fast mode (entrée / sortie) | 8 $ / 40 $ | 10 $ / 50 $ | — |
Grille éditeur au 23 septembre 202623. Le Fast mode (jusqu'à 2,5 fois la vitesse, research preview) n'existe que sur la Claude API (pas sur Bedrock, Vertex AI ou Foundry). L'inférence restreinte aux États-Unis (inference_geo) multiplie toutes les lignes par 1,1.
Le modèle est disponible dès le lancement sur la Claude API, Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry. Il devient le modèle Opus par défaut de Claude Code à partir de la version 2.1.28010. Dans la documentation, Opus 5 rejoint la liste des modèles legacy, toujours disponibles, et la recommandation de départ change : « commencez avec Claude Opus 5.5 pour la plupart des workloads », Fable 5.1 restant conseillé pour le raisonnement le plus exigeant et l'agentique à long horizon3. Sonnet 5.5 et Haiku 5.5 suivront dans les semaines à venir, avec une partie des mêmes gains. Côté abonnements, Anthropic relève les limites de cinq heures des plans Pro, Max, Team et Enterprise, et offre un reset de limite que chaque abonné peut déclencher quand il le souhaite, jusqu'au 22 octobre selon MacRumors11.
Le vrai chiffre : le coût par tâche, pas le prix au token
Les 40 % d'Anthropic combinent deux effets : le prix au token qui baisse de 20 %, et un modèle qui consomme moins de tokens pour finir un travail. La phrase exacte de l'annonce mérite d'être lue en entier : le gain est mesuré « aux réglages par défaut, sur des workloads typiques »1. Or le réglage par défaut a changé : l'effort d'Opus 5.5 démarre à medium, celui d'Opus 5 démarrait à high2. La comparaison oppose donc un modèle réglé plus bas à un modèle réglé plus haut. Sur le blog Claude, l'exemple chiffré d'une session identique en tokens sur les deux modèles donne 31 % d'économie par le seul effet du prix, cache compris4.
Le point de vigilance vient d'Artificial Analysis. À effort max, Opus 5.5 produit environ 119 000 tokens de sortie par tâche de leur index, contre environ 73 000 pour Opus 5, 78 000 pour Fable 5.1 et 27 000 pour GPT-6 Astra5. À ce réglage, le modèle écrit 63 % de tokens de plus que son prédécesseur. Appliqué à la grille tarifaire, ce volume donne un coût de sortie par tâche d'environ 2,38 $ contre 1,83 $ pour Opus 5 au même réglage : la baisse de prix est plus qu'absorbée. Artificial Analysis nuance toutefois : quatre des cinq niveaux d'effort d'Opus 5.5 (medium, high, xhigh, max) se placent sur la frontière intelligence / coût par tâche de leur index, ce qui veut dire qu'à chaque niveau, aucun autre modèle ne fait mieux pour le même prix.
La lecture pour un budget est la même que celle que nous faisions pour Opus 5 : l'économie annoncée se réalise à medium et high, là où se trouve déjà l'essentiel de la capacité, et disparaît si vous poussez tout à max. Le blog Claude le formule en trois consignes : medium pour le travail quotidien bien cadré, high quand medium cale (cela économise un nouvel essai), low pour le travail mécanique, comme les renommages4. Autrement dit, régler l'effort avant de changer de modèle, et budgéter en coût par résultat.
Les benchmarks, et comment les lire
Sur son tableau de lancement, Anthropic place Opus 5.5 en tête sur le codage agentique, l'usage d'ordinateur et le travail de connaissance. L'éditeur ajoute une précaution rare dans une annonce de modèle : « à ces niveaux de capacité, les marges de benchmark sont devenues un guide moins fiable des différences réelles. Dans notre propre usage, l'écart entre Opus 5.5 et Claude Fable 5.1 est plus étroit que ces scores ne le suggèrent »1.
| Épreuve | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Codage agentique en terminal (Terminal-Bench 4.0) | 66,4 % | 55,8 % | 52,3 % | 57,9 % | 37,3 % |
| Codage agentique (FrontierCode v1.1, Main) | 54,4 % | 50,3 % | 48,0 % | 53,3 % | 47,5 % |
| Codage en IDE (CursorBench 4.0) | 57,8 % | 51,8 % | 46,6 % | — | 41,7 % |
| Travail de la connaissance (GDPval-AA v2.1, Elo) | 1846 | 1735 | 1708 | 1542 | 1588 |
| Workflows métier (AutomationBench, Zapier) | 40,0 % | 31,4 % | 26,9 % | 41,4 % | 28,8 % |
| Raisonnement multidisciplinaire (Humanity's Last Exam, avec outils) | 67,7 % | 65,6 % | 63,6 % | 57,2 % | — |
| Recherche scientifique (Terminal-Bench-Science 0.1) | 58,7 % | 52,6 % | 29,0 % | 64,6 % | 22,4 % |
| Usage d'ordinateur (OSWorld 2.0) | 81,8 % | 80,7 % | 74,0 % | — | — |
| Lecture de graphiques (Chartography, avec outils) | 89,0 % | 88,4 % | 83,4 % | — | — |
Scores publiés par Anthropic le 22 septembre 20261 ; mesures constructeur, adaptive thinking à effort max sauf mention. Terminal-Bench 4.0 est mesuré à effort xhigh pour Opus 5.5 et à high pour GPT-6 Astra ; les chiffres Astra et Sol sont ceux que rapporte OpenAI, repris par Anthropic. AutomationBench a été exécuté et publié par Zapier. Sur Terminal-Bench-Science, l'erreur standard est de 3,5 à 5 points par modèle.
Deux lectures s'imposent. La première tient dans les notes de bas de tableau : le 64,6 % d'Astra sur Terminal-Bench-Science est un chiffre OpenAI, et c'est l'un des deux endroits où Anthropic laisse un concurrent devant, avec AutomationBench (41,4 % contre 40,0 %). La seconde tient à l'écart entre harnais. Artificial Analysis, avec son propre protocole, mesure Opus 5.5 à 61,4 % sur Humanity's Last Exam et 59,6 % sur Terminal-Bench 4.0, à égalité avec Astra, sous les 67,7 % et 66,4 % du tableau Anthropic5. Aucun des deux ne se trompe ; ce sont des montages différents. Quand vous citez un score, précisez la source et le réglage. Sur l'index d'intelligence d'Artificial Analysis, Opus 5.5 obtient 58, le plus haut score que le site ait mesuré, quelques points au-dessus des 57 de Fable 5.1 relevés début septembre.
Sur le Vals Index, Opus 5.5 prend la première place sur 63 modèles avec 69,69 %, devant Fable 5.1 (68,83 %), Opus 5 (67,21 %) et GPT-6 Astra (66,61 %), et mène six classements dont Terminal-Bench 2.1 (87,64 %) et ProofBench v1.1 (100 %)6. Vals signale deux faiblesses : l'agentique juridique, où le modèle tombe à 3,75 % sur le benchmark d'Harvey, et le recours à des fallbacks côté serveur. Comptés comme des échecs, ces replis font chuter SRE Bench de 33,59 % à 5,34 % et Terminal-Bench 2.1 de 87,64 % à 79,77 %. Le mécanisme est le même que celui que nous avons décrit pour Fable : un classifieur intercepte la requête, un autre modèle répond. Sur un benchmark, cela se compte ; en production, cela se détecte côté application.
Codage agentique : ce que les premiers tests disent
Les retours d'early testers publiés par Anthropic dessinent un profil net : le modèle excelle sur les travaux longs et étendus. Un testeur a mené une migration de 680 000 lignes en moins d'une journée. Sur la réduction des temps de chargement d'une application web, Opus 5.5 a réussi 39 fois sur 40, là où Opus 5 apportait des gains plus modestes en modifiant au passage le comportement de l'application. GitHub rapporte, dans VS Code, davantage de tâches de terminal résolues qu'avec Opus 5 en moins de la moitié des étapes. Clio l'a laissé tourner plus de 18 heures sans supervision sur une tâche d'ingénierie1. Témoignages sélectionnés par l'éditeur, comme toujours.
L'évaluation indépendante de Sonar confirme le virage vers la concision et en montre le prix. Sur 544 tâches couvertes par des tests, Opus 5.5 a écrit 27,5 % de lignes de moins qu'Opus 5 (664 890 contre 916 813) et 40 % de tokens de sortie en moins. Le total de findings recule de 42 %, les blockers de fiabilité de 41 %, les blockers de sécurité de 53 %7. La contrepartie : le taux de réussite fonctionnelle reste à 87,68 % contre 88,6 % pour Opus 5, sans progrès de correction, et la densité de bugs par ligne monte de 12 % (de 576 à 644 par million de lignes), les findings de concurrence de 44 %. Moins de code à relire, donc, mais du code plus dense en défauts, et une couche de vérification automatisée qui reste indispensable.
Migrer depuis Opus 5 : quatre ruptures à traiter
Changer l'identifiant de modèle ne suffit pas. La documentation liste quatre breaking changes pour du code qui tourne déjà sur Opus 5, dont les trois premiers valent aussi pour Fable 5.12.
1. Le thinking ne se désactive plus. Envoyer thinking.type: "disabled", ou un budget manuel de tokens de réflexion, renvoie une erreur 400. L'adaptive thinking est toujours actif, et les tokens de réflexion sont facturés en sortie. La profondeur se règle par l'effort, dont le défaut passe à medium. Tout code qui coupait le thinking pour des tâches simples doit baisser l'effort à la place.
2. Le tool_choice forcé renvoie une erreur. Les types any et tool ne sont plus acceptés. Il reste auto et none, et l'instruction dans le prompt pour dire quand l'outil s'applique. Pour du JSON conforme à un schéma, strict: true valide les arguments d'un outil appelé, sans forcer l'appel, et les structured outputs prennent le relais.
3. Les thinking blocks sont liés au modèle et à la conversation. Opus 5.5 lit les blocs d'Opus 5 et des modèles Opus, Sonnet et Haiku antérieurs, mais pas ceux de Fable ni de Mythos. Sur la Claude API, seuls Fable 5.1 et Mythos 5.1 lisent les blocs d'Opus 5.5. Un routeur qui bascule une conversation vers un autre modèle perd le raisonnement accumulé : l'API supprime les blocs illisibles avant l'appel, la requête aboutit, les blocs supprimés ne sont pas facturés. S'ajoute le contrôle de préfixe hérité de Fable 5.1 : pour les comptes créés à partir du 31 août 2026, rejouer un bloc après avoir modifié le système, les outils ou un message antérieur renvoie une erreur 400. La conversation se tient en append-only, et les changements d'instructions passent par des messages système en cours de conversation.
4. L'ancien outil computer_20251124 est refusé sur la Claude API et Google Cloud, où seul le toolset computer_toolset_20260801 est accepté. Il continue de fonctionner sur Amazon Bedrock.
Un cinquième changement ne casse aucune requête mais modifie la forme des réponses : les notes que le modèle écrit entre deux appels d'outils arrivent désormais dans des thinking blocks, vides au réglage d'affichage par défaut. Une interface qui montre la progression à ses utilisateurs devient muette entre deux outils, sans erreur, tant qu'elle ne règle pas thinking.display. Deux pièges d'exploitation à anticiper au passage : un HTTP 200 avec stop_reason: "refusal" est un refus à traiter comme tel, avec un repli vers un autre modèle, et le modèle réfléchit davantage par tour au même niveau d'effort qu'Opus 5, surtout à xhigh et max, ce qui impose de refaire son balayage d'effort et de laisser de la marge dans max_tokens. Anthropic fournit un guide de migration pas à pas depuis Opus 5 et les modèles antérieurs2.
Sécurité : des garde-fous de classe Fable sur un Opus
Sur l'audit comportemental automatisé d'Anthropic, la suite d'alignement qui teste Claude sur des milliers de scénarios simulés, Opus 5.5 obtient le meilleur score de tous les modèles testés à ce jour. Sur une nouvelle évaluation de propension à franchir des frontières de confinement, il a tenté de les contourner environ 85 % moins souvent qu'Opus 5 ou Mythos 5.1, et chaque tentative observée était de faible gravité et auto-signalée. Sur les injections de prompt, il égale ou dépasse Opus 5 dans tous les réglages testés, et fait jeu égal avec Fable 5.1 pour le plus faible taux de réussite d'injection sur le benchmark de Gray Swan1.
Le modèle a été évalué avant sortie par METR et Frontier Design. METR conclut à « une amélioration incrémentale au-dessus de Fable 5.1 sur nos évaluations quantitatives, plutôt qu'un saut discontinu », juge le modèle peu susceptible d'automatiser entièrement la R&D en IA, et relaie l'estimation interne préliminaire d'Anthropic d'une accélération d'environ 1,5 fois des capacités due à l'IA, avec peut-être 30 % de chances d'un facteur 29. Anthropic assume une limite de méthode : l'éditeur voit des signes qu'Opus 5.5 « soupçonne souvent d'être évalué », ce qui complique l'estimation de son comportement dans la variété des contextes réels où il est déployé1.
C'est le premier Opus à sortir avec des garde-fous proches de ceux de Fable 5.1 sur trois axes. En cybersécurité, la plupart des tâches sont reroutées vers Opus 4.8. En biologie, l'accès élargi passe par le Life Sciences Verification Program. Contre la distillation, le preserved thinking empêche l'édition du contexte antérieur pour extraire le raisonnement, et une catégorie de refus reasoning_extraction apparaît dans l'API2. Pour une DSI européenne, la conséquence est celle que nous avions décrite pour les classificateurs de Fable : un même prompt peut être servi par un autre modèle selon son contenu, avec des caractéristiques de sortie différentes, à détecter côté application. Deux points restent favorables à l'Europe : comme les Opus précédents, Opus 5.5 est disponible en zero data retention, et il embarque les mesures de watermarking prévues pour l'AI Act1.
Dix jours après « We Must Pace the Frontier »
Anthropic l'écrit dans l'annonce : Opus 5.5 est la première sortie depuis l'appel à ralentir la frontière. L'essai de Dario Amodei, publié le 12 septembre, demandait aux laboratoires de freiner la progression des capacités pour laisser la sécurité rattraper, et engageait Anthropic seule à donner aux évaluateurs tiers un accès permanent de niveau salarié13. Dix jours plus tard, l'éditeur sort un modèle plus rapide et moins cher que le précédent, et OpenAI réplique le jour même avec deux GPT-6 vendus à moitié prix de leurs prédécesseurs, Sol à 2 $/10 $ et Luna à 0,10 $/0,50 $12. Dans le vocabulaire d'Amodei, ralentir la frontière veut dire prendre le temps d'aligner et de tester chaque modèle avant de le déployer, pas cesser d'entraîner. Le test externe par METR et Frontier Design et le meilleur score d'alignement à ce jour sont présentés comme la première illustration de cette doctrine. Nous avons donné notre lecture de l'essai vu d'Europe ; ce lancement en est le premier cas pratique.
Les retours d'usage : un Fable en plus petit
L'accueil des praticiens est nettement plus chaud que pour Opus 5, qu'Every jugeait en juillet « difficile à aimer ». Dans le vibe check publié par Katie Parrott, Kieran Klaassen, créateur de Compound Engineering, écrit qu'Opus remplace Fable 5.1 comme son modèle du quotidien : pour le travail produit et le code, il le trouve aussi bon que Fable, et parfois meilleur. Dan Shipper le décrit comme la version plus petite de Fable, dont la vraie question est la vitesse et le prix8.
Le bémol tient dans un exemple précis. Avec dix minutes pour produire un planning de formation client, le modèle a généré des données d'entraînement, vérifié des bilans et rédigé des supports pour les participants, puis manqué de temps sans livrer le planning. Every en tire un profil : excellent sur le travail qui demande du jugement, peu fiable sur les livrables à échéance qui exigent une exécution stricte. Rapproché du relevé d'Artificial Analysis sur les tokens à effort max, le tableau est cohérent : un modèle qui part loin, et qu'il faut cadrer par l'effort et par le budget de tâche plutôt que laisser courir.
Quel modèle choisir : Opus 5.5, Fable 5.1 ou Opus 5
Opus 5.5 devient le choix par défaut pour le codage agentique, les migrations et audits à l'échelle d'un dépôt, la revue de code et le travail de connaissance exigeant. La documentation d'Anthropic le dit désormais en une ligne : démarrer avec Opus 5.5 pour la plupart des workloads3.
Fable 5.1 garde la recommandation de l'éditeur pour le raisonnement le plus exigeant et l'agentique à très long horizon, ou quand vos évaluations sur Opus 5.5 à effort élevé restent insuffisantes, au tarif 10 $/50 $. L'écart réel étant, de l'aveu d'Anthropic, plus étroit que les benchmarks, testez d'abord Opus 5.5 sur votre workload avant de payer Fable. Les deux modèles partagent la même coupure de connaissances et la même fenêtre de contexte.
Opus 5 passe en legacy. Il n'a plus d'avantage de prix ni de capacité face à Opus 5.5. Le seul motif de rester dessus est la stabilité d'une intégration existante, le temps de traiter les quatre breaking changes, en particulier un code qui désactive le thinking ou force un outil.
Mythos 5.1 reste réservé aux organisations approuvées, garde-fous cyber levés. Pour la grille complète, niveau par niveau et prix par prix, voir la carte de la famille Claude et notre méthode de routage multi-modèles.
Questions fréquentes
Quel est le prix de Claude Opus 5.5 ?
4 $ le million de tokens en entrée et 20 $ en sortie, contre 5 $ et 25 $ pour Opus 5. Le cache read revient à 0,20 $ (0,50 $ sur Opus 5), le Batch à moitié prix (2 $/10 $), le Fast mode à 8 $/40 $ sur la Claude API seulement. Au token, Opus 5.5 coûte 20 % de moins qu'Opus 5 et 60 % de moins que Fable 5.1.
Opus 5.5 coûte-t-il 40 % de moins qu'Opus 5 ?
Aux réglages par défaut, selon les tests d'Anthropic, sur des workloads typiques. Le défaut d'Opus 5.5 est l'effort medium, celui d'Opus 5 était high. À effort max, Artificial Analysis mesure 63 % de tokens de sortie en plus par tâche, ce qui annule l'avantage de prix. Le gain se réalise à medium et high.
Faut-il migrer d'Opus 5 vers Opus 5.5 ?
Oui pour le coût et la capacité, après avoir traité quatre breaking changes : thinking non désactivable, tool_choice forcé refusé, thinking blocks liés au modèle et à la conversation, ancien outil computer refusé sur la Claude API et Google Cloud. Sinon, rester sur Opus 5 le temps de l'adaptation : il reste disponible comme modèle legacy.
Opus 5.5 remplace-t-il Fable 5.1 ?
Pour la plupart des tâches, Anthropic le donne au niveau de Fable 5.1 et recommande de commencer par lui. Fable 5.1 reste conseillé pour le raisonnement le plus exigeant et les tâches agentiques de plusieurs jours, ou quand vos évaluations sur Opus 5.5 à effort élevé restent en deçà.
Opus 5.5 est-il compatible avec le zero data retention ?
Oui. Comme les modèles Opus précédents, Opus 5.5 est disponible avec zero data retention, là où Fable 5.1 ne l'ouvre qu'aux clients jugés éligibles par Anthropic. Le modèle embarque aussi les mesures de watermarking prévues pour l'AI Act européen.
Le point de vue SFEIR : le défaut monte d'un cran, la discipline reste la même
Opus 5.5 laisse le sommet de la gamme en place. Fable 5.1 reste là, au même prix, et Anthropic admet que l'écart entre les deux se voit moins en usage que sur les tableaux. Le modèle par défaut, lui, monte d'un cran : quand le niveau Opus atteint le niveau Fable sur la plupart des tâches, et coûte 60 % de moins au token, la case « réservé au long-horizon » de notre matrice de routage se rétrécit, et la case « défaut agentique » s'élargit. Pour une DSI européenne, le zero data retention préservé sur Opus 5.5 renforce cette bascule : le modèle le plus capable compatible avec des données régulées monte d'un cran, sans changer de prix.
La discipline, elle, ne bouge pas. Le relevé d'Artificial Analysis à effort max, la densité de bugs mesurée par Sonar et le planning de formation jamais livré chez Every racontent la même chose : un modèle qui réfléchit plus et écrit moins demande un harnais qui le cadre, un budget de tâche et une couche de vérification qui ne dépend pas de lui. Le couple niveau × effort reste la variable de décision, et l'effort par défaut à medium est la bonne nouvelle discrète de ce lancement : Anthropic règle enfin son modèle là où nous le réglions déjà. Avant de basculer une flotte d'agents, un canary sur Opus 5.5 à medium, avec relevé du coût par tâche et de la latence, vaut mieux qu'un changement d'identifiant un vendredi soir. C'est la logique que nous appliquons dans notre routage multi-modèles et notre suivi FinOps du codage agentique.
Sources
- « Introducing Claude Opus 5.5 », Anthropic, 22 septembre 2026 — annonce, premier modèle de la famille Claude 5.5, positionnement (niveau de Fable 5.1 sur la plupart des tâches, 40 % moins cher à l'usage qu'Opus 5 aux réglages par défaut, sortie plus de 30 % plus rapide), tableau tarifaire et tableau de benchmarks avec notes de bas de page, précaution sur les marges de benchmark, témoignages d'early testers, audit comportemental, frontières de confinement (−85 %), injections de prompt (Gray Swan), garde-fous, évaluation par METR et Frontier Design, zero data retention, watermarking AI Act, limites d'usage et Sonnet 5.5 / Haiku 5.5 à venir. Chiffres constructeur, harnais internes, témoignages sélectionnés par l'éditeur. anthropic.com — Claude Opus 5.5
- « What's new in Claude Opus 5.5 » et « Migrating to Claude Opus 5.5 », Claude Platform Docs, septembre 2026 — identifiant
claude-opus-5-5, effort par défaut medium, quatre breaking changes (thinking non désactivable, tool_choice forcé, thinking blocks liés au modèle et à la conversation, outilcomputer_20251124refusé sur la Claude API et Google Cloud), texte entre appels d'outils dans les thinking blocks, catégorie de refusreasoning_extraction, plus de réflexion par tour au même effort, grille tarifaire (cache write 5 $ et 8 $, cache read 0,20 $, Batch 2 $/10 $), Fast mode sur la Claude API seulement, plateformes. platform.claude.com — What's new in Opus 5.5 · Migration guide - « Models overview », Claude Platform Docs, consulté le 23 septembre 2026 — recommandation « start with Claude Opus 5.5 for most workloads », Fable 5.1 pour le raisonnement exigeant et le long horizon, tableau des modèles courants (prix, effort par défaut, contexte 1M, sortie 128K, coupure juin 2026, retrait pas avant le 22 septembre 2027), cache read à 5 % du prix d'entrée, 300K de sortie en Message Batches avec en-tête bêta, Opus 5 en liste legacy. platform.claude.com — Models overview
- « What a task costs on Opus 5.5 », blog Claude, septembre 2026 — session identique en tokens 31 % moins chère par le seul effet du prix, coût de 20K tokens de réflexion à effort high (0,40 $), consignes d'effort (medium pour le quotidien cadré, high quand medium cale, low pour le mécanique). Article éditeur. claude.com — What a task costs on Opus 5.5
- « Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index », Artificial Analysis, septembre 2026 — index à 58, tokens de sortie par tâche d'index à effort max (environ 119K pour Opus 5.5, 73K pour Opus 5, 78K pour Fable 5.1, 27K pour GPT-6 Astra), scores en harnais propre (Humanity's Last Exam 61,4 %, Terminal-Bench 4.0 59,6 % à égalité avec GPT-6 Astra), quatre niveaux d'effort sur la frontière intelligence / coût. Le coût de sortie par tâche cité dans l'article est notre calcul à partir de ces volumes et de la grille tarifaire. artificialanalysis.ai — Claude Opus 5.5
- « Claude Opus 5.5 », Vals AI, septembre 2026 — Vals Index 69,69 % (1er sur 63), Fable 5.1 68,83 %, Opus 5 67,21 %, GPT-6 Astra 66,61 %, six premières places (Terminal-Bench 2.1 87,64 %, ProofBench v1.1 100 %, MedScribe 91,43 %), Harvey Legal Agent Benchmark 3,75 %, effet des fallbacks côté serveur comptés comme échecs (SRE Bench de 33,59 % à 5,34 %, Terminal-Bench 2.1 de 87,64 % à 79,77 %). Évaluation tierce. vals.ai — Claude Opus 5.5
- « Claude Opus 5.5: An evaluation », Sonar, septembre 2026 — 544 tâches couvertes par des tests, 27,5 % de lignes en moins (664 890 contre 916 813), 40 % de tokens de sortie en moins, taux de réussite 87,68 % contre 88,6 %, densité de bugs de 576 à 644 par million de lignes (+12 %), findings de concurrence +44 %, blockers de fiabilité −41 % et de sécurité −53 %, total de findings −42 %. Analyse statique indépendante. sonarsource.com — Claude Opus 5.5: An evaluation
- Katie Parrott, « Vibe Check: Opus 5.5 Is Pulling Our Codex Converts Back to Claude », Every, septembre 2026 — citations de Kieran Klaassen (Opus remplace Fable 5.1 comme modèle du quotidien) et Dan Shipper (la version plus petite de Fable), exemple du planning de formation non livré en dix minutes, profil « jugement oui, échéance stricte non ». Retour d'usage d'une équipe. every.to — Vibe Check Opus 5.5
- « Summary of METR's predeployment evaluation of Claude Opus 5.5 », METR, 22 septembre 2026 — amélioration incrémentale au-dessus de Fable 5.1 plutôt que saut discontinu, modèle peu susceptible d'automatiser entièrement la R&D en IA, faiblesses qualitatives sur les tâches longues et le raisonnement ouvert, estimation interne préliminaire d'environ 1,5 fois d'accélération due à l'IA avec peut-être 30 % de chances d'un facteur 2. Évaluateur tiers avec accès pré-déploiement. metr.org — Claude Opus 5.5
- Claude Code, CHANGELOG version 2.1.280, septembre 2026 — Claude Opus 5.5 ajouté et « now the default Opus model », 1M de contexte, 4 $/20 $ avec cache read à 0,20 $ ; un niveau d'effort enregistré avant le passage au réglage par modèle ne s'applique pas aux nouveaux modèles. github.com — anthropics/claude-code CHANGELOG
- « Anthropic Launches Claude Opus 5.5 With Fable-Level Performance at a Lower Price », MacRumors, 22 septembre 2026 — relèvement des limites de cinq heures sur Pro, Max, Team et Enterprise, reset de limite utilisable jusqu'au 22 octobre. Source secondaire pour la date, absente de l'annonce Anthropic. macrumors.com
- « Anthropic releases Claude Opus 5.5 and OpenAI counters with two cheaper GPT-6 models », SiliconANGLE, 22 septembre 2026 — GPT-6 Sol à 2 $/10 $ pour le code et les agents récurrents, GPT-6 Luna à 0,10 $/0,50 $ pour le volume, tous deux à moitié prix de leurs prédécesseurs GPT-5.6. Source secondaire. siliconangle.com
- Dario Amodei, « We Must Pace the Frontier », 12 septembre 2026 — appel à ralentir la progression des capacités, engagement unilatéral d'Anthropic à donner aux évaluateurs tiers un accès permanent de niveau salarié. darioamodei.com — We Must Pace the Frontier
Articles similaires
La famille de modèles Claude : Haiku, Sonnet, Opus, Fable, quel modèle pour quelle tâche
Au 23 septembre 2026, la gamme Claude compte cinq niveaux : Haiku, Sonnet, Opus (désormais Opus 5.5), puis la classe Mythos (Fable et Mythos). Ce que chacun sait faire, par complexité de tâche et par cas d'usage, et pourquoi choisir le bon niveau est une décision d'architecture.
Claude Opus 5 : l'intelligence quasi-frontier au prix du modèle par défaut
Claude Opus 5, lancé le 24 juillet 2026, « s'approche de l'intelligence frontier de Fable 5 à moitié prix », au tarif inchangé d'Opus 4.8. Et pour une DSI européenne, un détail pèse plus qu'un benchmark : Opus 5 préserve le Zero Data Retention que Fable 5 casse.
Claude Fable 5.1 : Anthropic mise sur le travail long et baisse la facture du cache
Claude Fable 5.1 (1er septembre 2026) : même tarif que Fable 5, cache read divisé par quatre, garde-fous qui interviennent moins, score doublé sur Terminal-Bench-Science. Ce que cela change pour vos workloads agentiques, et qui a le modèle inclus dans son plan.
« We Must Pace the Frontier » : pourquoi je comprends l'appel de Dario Amodei, et ce qui coince vu d'Europe
Le 12 septembre 2026, Dario Amodei demande aux labs de frontière de ralentir un à deux ans et ouvre Anthropic à des évaluateurs tiers. Ce que dit l'essai, pourquoi je comprends sa position, les intérêts de chacun, et l'angle mort européen que le texte ne nomme pas.