✕ RETOUR AU DOSSIER
← → naviguer · F plein écran · Échap article
SFEIR · MODÈLES ANTHROPIC
Cinq niveaux,
une seule décision.
01WHAT · LE CONSTAT
02SO WHAT · L'ENJEU
03NOW WHAT · LE CADRE
La synthèse de douze articles sur les modèles Claude, en 16 slides. Les articles restent la référence.
SFEIR.COM · SEPTEMBRE 2026
01
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · LE CONSTAT
02 / 16
WHAT.
« En trois mois, Anthropic a rebattu quatre fois sa propre gamme. »
Fable 5 le 9 juin, Sonnet 5 le 30 juin, Opus 5 le 24 juillet, Fable 5.1 le 1er septembre 2026. Cinq niveaux, du sous-agent à la classe Mythos. Reste à savoir lequel pour quelle tâche.
5
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · LE CONSTAT
03 / 16
Cinq niveaux, une seule logique
« Plus la tâche est longue et complexe, plus l'écart entre les niveaux se creuse. »
01
Haiku 4.5 pour le volume et la faible complexité : classification, extraction, triage, sous-agents pilotés par un modèle supérieur. Contexte 200K, 1 $/5 $ par million de tokens.
02
Sonnet 5 pour la production courante à 3 $/15 $, Opus 5 pour le raisonnement lourd à 5 $/25 $ : architecture, refactoring de grande ampleur, sessions agentiques longues.
03
La classe Mythos au-dessus, à 10 $/50 $ : Fable 5.1 pour tous depuis le 1er septembre, Mythos 5.1 sur programme de vérification (cyber, sciences de la vie) ou via Project Glasswing.
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · LE CONSTAT
04 / 16
L'échelle de la gamme, du sous-agent à Mythos
« Les marches n'ont pas bougé le 1er septembre : mêmes prix, même contexte, Fable 5.1 remplace Fable 5. »
L'échelle de la gamme ClaudeCinq niveaux de modèles Claude classés par complexité de tâche croissante : Haiku 4.5, Sonnet 5, Opus 5, Fable 5 et Mythos 5. Chaque niveau porte sa fenêtre de contexte et son prix par million de tokens en entrée et en sortie, représenté par une barre proportionnelle au prix de sortie. NIVEAU · CONTEXTE PRIX PAR MILLION DE TOKENS (ENTRÉE / SORTIE) COMPLEXITÉ ET DURÉE DE LA TÂCHE Haiku 4.5 contexte 200K · sous-agents, volume 1 $ / 5 $ Sonnet 5 contexte 1M · production courante 3 $ / 15 $ Opus 5 contexte 1M · raisonnement lourd 5 $ / 25 $ Fable 5 contexte 1M · classe Mythos, publique 10 $ / 50 $ Mythos 5 accès restreint · Project Glasswing 10 $ / 50 $
3
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · LE CONSTAT
05 / 16
Trois sorties en sept semaines
« Chaque niveau a bougé, et chacun est arrivé avec ses propres chiffres. »
01
Fable 5, 9 juin : premier modèle de classe Mythos ouvert à tous, 80,3 % sur SWE-Bench Pro et 91/100 au Senior Engineer d'Every, contre 63 pour Opus 4.8.
02
Sonnet 5, 30 juin : le modèle le plus agentique de la maison, 80,4 % sur Terminal-Bench 2.1 contre 67 % pour Sonnet 4.6, et un accueil public très polarisé.
03
Opus 5, 24 juillet : quasi-frontier au prix d'Opus 4.8, 43,3 % sur Frontier-Bench v0.1 contre 33,7 % pour Fable 5 et 21,1 % pour Opus 4.8.
scores constructeur sur harnais internes ; sur DeepSWE, GPT-5.6 Sol mène à 72,7 %.
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · LE CONSTAT
06 / 16
Fable 5.1 : le saut est sur le travail long
« Trois points de plus sur CursorBench, vingt-huit sur Terminal-Bench-Science. »
01
Le 1er septembre, Terminal-Bench-Science passe de 24,7 % à 52,6 %, AutomationBench de 17,1 % à 31,4 %. Le gain est là où il faut enchaîner des dizaines d'étapes sans désactiver le test qui échoue.
02
Tarif inchangé à 10 $/50 $, mais le cache read tombe à 0,25 $ contre 1 $. Anthropic annonce 25 à 45 % de moins par session agentique, selon la part de contexte relu.
03
Garde-fous recalibrés : 60 % de faux positifs cyber en moins, 85 % d'interventions biologie en moins. Les cinq points d'écart avec Mythos 5.1 sont les tâches interceptées, comptées pour zéro.
chiffres constructeur, garde-fous activés ; les cache writes font 65 % de la note de Theo Browne.
02
SFEIR · MODÈLES ANTHROPIC
↗ SO WHAT · L'ENJEU
07 / 16
SO WHAT.
« Le prix affiché dit peu du coût, et rien du droit applicable. »
Trois choses décident en production : les tokens réellement consommés, le routage invisible des requêtes sensibles, le régime des données. Aucune ne se lit dans un benchmark.
$
SFEIR · MODÈLES ANTHROPIC
↗ SO WHAT · L'ENJEU
08 / 16
Ce que coûte vraiment une tâche
« Un modèle plus cher au token revient moins cher s'il finit en moins de tours. »
01
Simon Willison a dépensé 110,42 $ en une journée de test, dont 99,26 $ sur une seule session agentique, sur un abonnement Max à 100 $ par mois.
02
L'application avertit que Fable consomme les limites 2× plus vite qu'Opus. Le cache read moins cher de 5.1 allège les lectures ; les écritures, qui dominent chez certains, restent au même prix.
03
Dans l'autre sens, Anthropic rapporte 100 % sur Zapier AutomationBench avec Opus 5, sans dépenser plus de tokens que les modèles précédents, qui échouaient.
anecdote individuelle pour Willison ; chiffres et témoignages clients fournis par l'éditeur.
SFEIR · MODÈLES ANTHROPIC
↗ SO WHAT · L'ENJEU
09 / 16
L'intelligence est routée
« Un même prompt peut être servi par deux modèles différents, selon son contenu. »
01
Fable 5, puis 5.1, lancent des classifieurs sur chaque requête : cyber offensif, biologie et chimie, distillation, développement de LLM frontières. Ils mordent dans moins de 5 % des sessions.
02
Quand un classifieur se déclenche, un modèle Opus répond à la place, et l'utilisateur le voit. Le repli n'est pas facturé au tarif Fable.
03
La dégradation silencieuse prévue sur la quatrième catégorie a tenu 48 heures : Anthropic l'a rendue visible le 11 juin et a reconnu un mauvais arbitrage.
chiffre Anthropic, auto-déclaré ; le calibrage des classifieurs bouge à chaque mise à jour.
§
SFEIR · MODÈLES ANTHROPIC
↗ SO WHAT · L'ENJEU
10 / 16
La conformité tranche avant le benchmark
« Pour une DSI européenne, la ligne de partage passe par la rétention des données. »
01
Fable 5 et Mythos 5 sont classés Covered Models : 30 jours de rétention sur tout le trafic, sans Zero Data Retention. Depuis le 1er septembre, Fable 5.1 rouvre le ZDR aux clients qu'Anthropic juge éligibles.
02
Opus 5, Opus 4.8, Sonnet 5 et Haiku 4.5 restent éligibles au Zero Data Retention par défaut. Pour un dossier médical, la classe Mythos reste hors périmètre tant que l'éligibilité n'est pas écrite.
03
Opus 5 déclenche ses classificateurs environ 85 % moins souvent que Fable 5, et les requêtes de biologie bloquées sur Fable routent maintenant vers lui.
politique éditeur ; jusqu'à 2 ans si flagué ; critères d'éligibilité ZDR de 5.1 non publiés.
SFEIR · MODÈLES ANTHROPIC
↗ SO WHAT · L'ENJEU
11 / 16
Un modèle de pointe peut être coupé
« Le 12 juin 2026, Fable 5 et Mythos 5 disparaissent pour tous les clients du monde. »
01
Une directive d'export américaine vise les ressortissants étrangers. Faute de pouvoir filtrer les nationalités en temps réel, Anthropic coupe les deux modèles partout. L'accès revient le 1er juillet.
02
Les modèles à accès général, Haiku, Sonnet et Opus, n'ont pas été touchés. Le risque s'est concentré sur le niveau le plus haut de la gamme.
03
Le texte de la directive n'a jamais été publié. Anthropic parle d'un problème étroit, sur des vulnérabilités déjà connues et reproductibles ailleurs.
03
SFEIR · MODÈLES ANTHROPIC
↗ NOW WHAT · LE CADRE
12 / 16
NOW WHAT.
« Deux axes suffisent : la difficulté de la tâche et la sensibilité des données. »
Router chaque tâche vers le niveau qui suffit, régler l'effort avant de changer de modèle, garder une porte de sortie ouverte. Trois décisions d'architecture, pas d'achat.
SFEIR · MODÈLES ANTHROPIC
↗ NOW WHAT · LE CADRE
13 / 16
Router par difficulté et par sensibilité
« La case Fable coûte moins cher à occuper longtemps ; la ligne ZDR, elle, se négocie. »
Router par difficulté et par sensibilitéMatrice à deux axes : en abscisse la durée et la complexité de la tâche, en ordonnée la sensibilité des données. Quatre cellules : Haiku 4.5 pour les tâches courtes ordinaires, Fable 5 pour les tâches longues ordinaires, Sonnet 5 pour les tâches courtes en données régulées, Opus 5 pour les tâches longues en données régulées. Une bande basse rappelle le repli automatique de Fable 5 vers Opus quand un classifieur se déclenche. DURÉE ET COMPLEXITÉ DE LA TÂCHE SENSIBILITÉ DES DONNÉES Sonnet 5 production courante sur données régulées, Zero Data Retention possible Opus 5 sessions agentiques longues, quasi-frontier et ZDR préservé Haiku 4.5 classification, extraction, triage, sous-agents à haut volume Fable 5 projets long-horizon uniquement, rétention 30 jours assumée Repli : requête cyber, bio ou distillation → Opus répond à la place, et l'utilisateur le voit
×
SFEIR · MODÈLES ANTHROPIC
↗ NOW WHAT · LE CADRE
14 / 16
Effort, cache, harnais
« Ajuster l'effort est souvent un meilleur levier que changer de modèle. »
01
Opus 5 expose un effort réglable de low à max, adaptive thinking actif par défaut. Les premiers retours d'équipe le donnent meilleur à medium qu'à effort élevé.
02
Le prompt caching retire jusqu'à 90 % du coût d'entrée, le Batch API 50 %. Le cache read est divisé par quatre sur Fable 5.1 ; le minimum de cache tombe à 512 tokens sur Opus 5.
03
Changer de modèle casse les harnais : Opus 5 interrompt des flux autonomes bâtis pour Opus 4.8. Chez Every, le plugin Compound Engineering a dû être réécrit.
« A poor man's Fable » (Dan Shipper, Every) : retour d'usage sous accès anticipé.
SFEIR · MODÈLES ANTHROPIC
↗ NOW WHAT · LE CADRE
15 / 16
Rester libre d'en changer
« Une couche d'abstraction et un repli testé valent mieux qu'un pari sur un fournisseur. »
01
Documentez un repli par niveau, Fable vers Opus vers Sonnet, et testez-le. Le 12 juin 2026, les équipes qui l'avaient ont perdu une capacité, pas un service.
02
Choisissez vos régions explicitement : endpoints régionaux Bedrock et Google Cloud à environ +10 %, ou le paramètre inference_geo de l'API à ×1,1.
03
Au-delà de 30 % de vos charges IA critiques chez un fournisseur unique sous juridiction étrangère, le sujet remonte au conseil d'administration.
!
SFEIR · MODÈLES ANTHROPIC
↗ WHAT · SO WHAT · NOW WHAT
16 / 16
Synthèse
« What : cinq niveaux. So What : le coût et le droit tranchent. Now What : router, régler, sortir. »
01WHAT · LE CONSTAT
Cinq niveaux de Haiku à la classe Mythos, quatre sorties en trois mois, et un écart qui se creuse avec la durée des tâches.
02SO WHAT · L'ENJEU
Le coût se lit en tokens, en itérations et en cache ; la rétention de 30 jours écarte la classe Mythos du régulé, sauf ZDR négocié sur 5.1.
03NOW WHAT · LE CADRE
Router par difficulté et par sensibilité, régler l'effort avant le modèle, re-tester le harnais à chaque bascule, garder un repli testé.
Le modèle est une commodité. Ce qui dure, c'est le système qui l'entoure et la liberté d'en changer.
Lire le dossier complet →