La famille de modèles Claude : Haiku, Sonnet, Opus, Fable, quel modèle pour quelle tâche
Devant un nouvel arrivant, la gamme Claude d'Anthropic ressemble à un menu sans légende. Haiku, Sonnet, Opus : trois noms empruntés à la poésie, rangés par taille croissante. Puis, au-dessus, une classe à part (Mythos), déclinée en deux modèles qui partagent le même cerveau mais pas les mêmes garde-fous : Fable, accessible à tous, et Mythos, réservé à une poignée d'organisations. La première question qui vient est presque toujours la mauvaise : « lequel est le meilleur ? ». La bonne, celle qui structure une décision d'architecture, est « lequel pour quelle tâche ? ».
Cet article dresse la carte de la famille au 24 juillet 2026, jour où Anthropic a mis en disponibilité générale Claude Opus 51 et redistribué les cartes du haut de gamme. Pour chaque niveau : ce qu'il sait faire, ce qu'il coûte, le cas d'usage où il devient pertinent, et le principe qui commande tout le reste : plus la tâche est longue et complexe, plus l'écart entre les niveaux se creuse.
Cinq niveaux, une seule logique
La gamme s'ordonne du plus léger au plus puissant, et cette progression n'est pas qu'une affaire de vitesse : c'est une échelle de complexité de tâche. Tous les modèles courants acceptent le texte et l'image en entrée, gèrent la vision, l'appel d'outils et l'usage d'ordinateur (computer use), et sont disponibles via l'API Claude, Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry4.
Haiku 4.5 : le plus rapide et le moins cher, à « intelligence proche de la frontière ». C'est le modèle du haut volume et de la faible complexité : classification, routage, extraction de JSON depuis du texte non structuré, triage de documents en première passe, et surtout sous-agents parallélisés sous la supervision d'un modèle supérieur. Contexte 200K tokens, sortie 64K, prix 1 $/5 $ par million de tokens. Particularité : c'est le seul modèle courant à ne pas avoir l'adaptive thinking ; son raisonnement étendu s'active manuellement.
Sonnet 5 : le meilleur compromis vitesse/intelligence, et le cheval de trait de la production courante. Génération de code sur tout le cycle de vie, analyse de données, création de contenu, usage agentique d'outils. Anthropic le présente comme « le modèle Sonnet le plus agentique à ce jour », capable de tenir un plan sur plusieurs étapes, de suivre ce qu'il a fait et ce qui reste, et de résoudre les problèmes avec moins de tours de correction3. Contexte 1M, sortie 128K, prix standard 3 $/15 $, avec un tarif d'introduction à 2 $/10 $ jusqu'au 31 août 2026. C'est le modèle par défaut des offres Free et Pro. Notre lecture détaillée, ses forces et ses limites : Claude Sonnet 5, le modèle le plus agentique d'Anthropic.
Opus 5, le raisonnement lourd : architecture, refactoring de grande ampleur, sessions agentiques de plusieurs heures, ingénierie de systèmes complexes. Sorti le 24 juillet 2026 au prix inchangé d'Opus 4.8 (5 $/25 $), Anthropic le positionne comme un modèle qui « s'approche de l'intelligence frontière de Fable 5 à moitié prix »1. Contexte 1M, sortie 128K. Sa nouveauté marquante est un paramètre d'effort ajustable (de low à max, défaut high sur l'API et Claude Code), qui permet de doser la profondeur de raisonnement sans changer de modèle. Il devient le modèle par défaut de Claude Max et le plus puissant de Claude Pro.
La classe Mythos : Fable 5 et Mythos 5. Anthropic définit Mythos comme « un palier de modèles Claude qui se situe au-dessus de notre classe Opus en capacité ». Deux modèles y cohabitent, bâtis sur le même modèle sous-jacent et différenciés uniquement par les garde-fous. Fable 5 est la version publique, dotée de classificateurs de sécurité qui redirigent les requêtes à haut risque ; Mythos 5 est la version restreinte, garde-fous cyber levés, réservée sur invitation aux organisations approuvées via Project Glasswing (gouvernement américain, infrastructures critiques, cyberdéfense). Contexte 1M, sortie 128K, prix 10 $/50 $. La note officielle d'Anthropic précise l'étymologie : « Fable » (du latin fabula, « ce qui est raconté ») et « Mythos » (du grec) désignent le même modèle ; ce sont les garde-fous qui les séparent2.
La gamme en un coup d'œil
| Modèle | Niveau | Contexte | Prix (entrée / sortie /MTok) | Raisonnement | Accès |
|---|---|---|---|---|---|
| Haiku 4.5 | Léger / rapide | 200K | 1 $/5 $ | Thinking activable, pas d'adaptive | Général |
| Sonnet 5 | Équilibré | 1M | 3 $/15 $ (intro 2 $/10 $ → 31/08/2026) | Adaptive thinking | Général |
| Opus 5 | Raisonnement lourd | 1M | 5 $/25 $ | Adaptive + effort (low→max) | Général |
| Fable 5 | Classe Mythos (public) | 1M | 10 $/50 $ | Adaptive thinking | Général, avec garde-fous |
| Mythos 5 | Classe Mythos (restreint) | 1M | 10 $/50 $ | Adaptive thinking | Glasswing uniquement |
Une note sur les versions : la numérotation ne progresse pas au même rythme selon les niveaux. Haiku en est à sa version 4.5 (octobre 2025) quand Sonnet, Opus et la classe Mythos ont basculé en « 5 » au cours de l'été 2026. Opus 4.8, le prédécesseur d'Opus 5, garde un rôle actif : c'est le modèle vers lequel Fable 5 redirige les requêtes qu'il bloque (voir plus bas).
Choisir le niveau : une décision d'architecture
Anthropic structure elle-même sa documentation autour d'une grille « complexité de la tâche → modèle adapté »4. Lue par niveau, elle donne un cadre de décision net.
Le niveau Haiku couvre le haut volume et la faible complexité : applications temps réel, traitement intelligent à grande échelle, déploiements sensibles au coût, tâches de sous-agents. La recommandation d'Anthropic pour le prototypage et les tâches simples est « l'efficience d'abord » : commencer par Haiku et ne monter en gamme que si le résultat l'exige.
Le niveau Sonnet est celui du codage quotidien et des workflows multi-étapes : changements multi-fichiers dans une vraie base de code, débogage et refactoring menés à terme, avec une performance qu'Anthropic situe « proche de celle d'Opus 4.8 » à prix Sonnet3. C'est le point de départ raisonnable pour l'essentiel de la production.
Le niveau Opus vise les agents de codage autonomes de plusieurs heures, le refactoring à grande échelle, la recherche avancée et les workflows vision-intensifs. Anthropic met en avant sa capacité à vérifier son propre travail et à itérer jusqu'à réussir. Un exemple documenté : sur une tâche Frontier-Bench, Opus 5 a écrit son propre pipeline de vision par ordinateur pour reconstruire une pièce mécanique à partir de pixels bruts, là où aucun modèle concurrent n'y parvenait en cinq tentatives1.
Le niveau Mythos/Fable est celui des tâches frontière à long horizon, les projets autonomes de plusieurs jours. L'exemple phare du lancement : Stripe a pointé Fable 5 sur une base de code Ruby de 50 millions de lignes et a mené une migration à l'échelle du dépôt entier en une journée, un travail estimé à plus de deux mois pour une équipe humaine2.
Ce dernier exemple illustre le principe qui commande tout le reste, et qu'Anthropic écrit noir sur blanc : « plus la tâche est longue et complexe, plus l'avance de Fable 5 sur nos autres modèles se creuse »2. C'est le fondement de la thèse « choisir le niveau est une décision d'architecture » : sur les tâches courtes, Haiku ou Sonnet suffisent le plus souvent, et payer un niveau supérieur ne rapporte rien ; la valeur des niveaux hauts n'apparaît que sur les tâches longues et agentiques. Identifier ce point de bascule (la longueur et l'autonomie à partir desquelles l'écart justifie le surcoût) est le vrai travail de conception. Nous le développons dans notre méthode de routage multi-modèles, un modèle par tâche.
Un mot de prudence sur les benchmarks : les scores publiés par Anthropic dépendent de harnais de test propriétaires, et le tableau officiel de Fable 5 est diffusé sous forme d'image, donc non extractible du texte primaire. Les valeurs relayées par des trackers tiers (SWE-bench Verified ≈ 95 %, par exemple) sont à traiter comme des sources secondaires. Notre analyse dédiée détaille pourquoi le classement flatte une intuition que la production dément.
Le vrai coût n'est pas le prix au token
À l'entrée, la gamme s'échelonne de 1 $ (Haiku) à 10 $ (Fable/Mythos) par million de tokens ; à la sortie, de 5 $ à 50 $. Il serait tentant d'en déduire une hiérarchie de coût simple. C'est un piège. Le coût réel d'une tâche n'est pas le prix par token : un modèle plus cher au token, mais plus efficace en itérations et en tokens consommés, peut revenir moins cher au total.
Les témoignages clients rapportés par Anthropic vont tous dans ce sens. Sur Zapier AutomationBench, Opus 5 a atteint 100 % « sans dépenser plus de tokens que les modèles Claude précédents », qui, eux, échouaient. Sur des tâches de modélisation financière, un laboratoire de recherche rapporte +9 points de précision moyenne « avec un tiers de tours et d'appels d'outils en moins, et 60 % de temps en moins »1. La leçon budgétaire est contre-intuitive : mesurer le coût par résultat, pas le prix par token.
Anthropic documente trois leviers de réduction : le prompt caching (jusqu'à 90 % d'économie sur l'entrée), le Batch API (50 %), et surtout le paramètre d'effort. La documentation « Choosing a model » est explicite : « ajuster l'effort est souvent un meilleur levier que changer de modèle »4. Autrement dit, avant de monter d'un niveau, essayer d'abord Opus 5 à effort plus élevé, ou au contraire le baisser sur les tâches simples. C'est exactement la logique FinOps que nous instrumentons pour le codage agentique : mesurer tokens, itérations et latence par workflow, et traiter l'effort comme premier réglage avant tout changement de modèle.
Le safeguards routing de Fable 5
Un comportement de la classe Mythos mérite d'être anticipé côté produit, car il est invisible dans une grille tarifaire. Fable 5 embarque des classificateurs : des systèmes d'IA distincts qui détectent les usages potentiellement dangereux. Quand une requête touche à la cybersécurité, à la biologie/chimie ou à la distillation de modèle, Opus 4.8 prend le relais pour produire la réponse, et l'utilisateur en est informé.
Le calibrage est volontairement conservateur : ces garde-fous se déclenchent « en moyenne dans moins de 5 % des sessions », et plus de 95 % des sessions Fable ne subissent aucun repli2. Anthropic assume les faux positifs et s'engage à les réduire. Pour une équipe qui bâtit un produit sur Fable 5, la conséquence est concrète : un même prompt peut être servi par deux modèles différents selon son contenu, avec des caractéristiques de sortie distinctes. Il faut prévoir la détection de ce basculement dans l'application. Le mécanisme et ses implications sont détaillés dans notre article sur les classificateurs et safeguards de Fable 5.
Souveraineté et continuité : la leçon de juin 2026
Pour une DSI européenne, la gamme Claude soulève une question qui déborde la technique : celle de la continuité de service. Le fournisseur est soumis à la juridiction américaine, et un épisode récent a montré ce que cela implique.
Fable 5 et Mythos 5 sont lancés le 9 juin 2026. Le 12 juin, le gouvernement américain émet une directive de contrôle à l'export suspendant l'accès de « tout ressortissant étranger, à l'intérieur ou à l'extérieur des États-Unis ». N'ayant aucun moyen de vérifier la nationalité en temps réel, Anthropic suspend l'accès aux deux modèles pour tous les utilisateurs. Les contrôles sont levés le 30 juin, l'accès rétabli mondialement le 1er juillet5. Point capital pour la lecture du risque : les modèles « à accès général » (Haiku, Sonnet, Opus) n'ont pas été affectés. Seule la classe Mythos, la plus haute, l'a été.
S'ajoute une différence de gouvernance des données. Opus 5 n'impose aucune rétention pour l'accès général, « comme les modèles Opus précédents ». En revanche, Fable 5 et Mythos 5 imposent une rétention obligatoire de 30 jours en tant que « Covered Models », sur toutes les plateformes, à des fins de monitoring de sécurité (donnée non utilisée pour l'entraînement, supprimée après 30 jours sauf exception)6. Pour tout traitement de données personnelles ou sensibles, c'est un point à valider avec le DPO avant d'engager la classe Mythos.
La méthode qui en découle est celle que nous appliquons à tout fournisseur d'IA : une couche d'abstraction sur l'API, un plan de repli documenté entre niveaux (Fable → Opus → Sonnet), un choix explicite des régions de déploiement (endpoints régionaux Bedrock/Vertex, ou inférence US-only), et une veille sur les décisions réglementaires. C'est la doctrine que nous détaillons dans notre architecture multi-LLM souveraine et notre analyse du risque de coupure et de continuité de l'IA.
Questions fréquentes
Combien de modèles compte la gamme Claude en 2026 ?
Cinq niveaux de capacité au 24 juillet 2026 : Haiku 4.5 (léger), Sonnet 5 (équilibré), Opus 5 (raisonnement lourd), puis la classe Mythos au-dessus d'Opus, déclinée en Fable 5 (public, avec garde-fous) et Mythos 5 (accès restreint via Project Glasswing).
Quelle est la différence entre Fable 5 et Mythos 5 ?
C'est le même modèle sous-jacent. Fable 5 est la version publique, dotée de classificateurs qui redirigent les requêtes à haut risque vers Opus 4.8. Mythos 5 a ces garde-fous cyber levés et n'est accessible que sur invitation, pour des organisations approuvées (gouvernement, infrastructures critiques, cyberdéfense).
Quel modèle Claude choisir pour du codage ?
Sonnet 5 pour le codage quotidien et les changements multi-fichiers ; Opus 5 (à effort xhigh) pour l'architecture, le refactoring lourd et les sessions agentiques longues ; Fable 5 seulement pour les tâches à long horizon de plusieurs jours, où l'écart de capacité justifie le tarif. Haiku 4.5 sert aux sous-agents à haut volume, pas au codage principal.
Le modèle le plus cher est-il toujours le plus économique à éviter ?
Non. Le coût réel d'une tâche dépend des tokens consommés et du nombre d'itérations, pas seulement du prix au token. Un modèle plus cher qui réussit en moins de tours peut revenir moins cher au total. Le bon indicateur est le coût par résultat, et le premier levier d'optimisation est le réglage d'effort, avant tout changement de modèle.
Pourquoi Opus 4.8 existe-t-il encore à côté d'Opus 5 ?
Opus 4.8 est le prédécesseur d'Opus 5, mais il garde un rôle actif : c'est le modèle vers lequel Fable 5 redirige les requêtes que ses classificateurs de sécurité bloquent.
Le point de vue SFEIR : le niveau × l'effort, pas le nom
La vraie variable de décision n'est pas le nom du modèle affiché sur une plaquette, c'est le couple niveau × effort, réglé pour la tâche. La gamme Claude est bien conçue parce qu'elle rend ce réglage explicite : cinq niveaux, un paramètre d'effort sur Opus, un routage par sensibilité sur la classe Mythos. Bâtir une architecture qui exploite cette granularité (Haiku pour les sous-agents, Sonnet en production courante, Opus pour la planification et le refactoring lourd, Fable en dernier recours sur le long-horizon) vaut mieux que standardiser sur un seul modèle « au cas où ».
C'est la même conviction qui traverse toute notre approche « AI Only » : le modèle est une commodité, l'avantage durable est dans le système qui l'entoure. Le choix du niveau, la discipline du Context Engineering et la qualité du harnais pèsent davantage sur le coût et la qualité en production que la course au sommet d'un classement. Une gamme claire aide ; encore faut-il concevoir un système qui sait s'en servir, et rester libre d'en changer, comme l'impose la doctrine Design to Exit que l'épisode de juin 2026 a rendue concrète.
Sources
- « Introducing Claude Opus 5 », Anthropic, 24 juillet 2026 — annonce de la disponibilité générale, positionnement « s'approche de l'intelligence frontière de Fable 5 à moitié prix », paramètre d'effort, exemples Frontier-Bench et témoignages clients (Zapier, laboratoire de modélisation financière). Benchmarks publiés majoritairement en comparaisons relatives. anthropic.com — Claude Opus 5
- « Claude Fable 5 and Claude Mythos 5 », Anthropic, 9 juin 2026 — définition de la classe Mythos, étymologie Fable/Mythos, mécanisme des classificateurs et repli vers Opus 4.8 (« moins de 5 % des sessions »), principe « plus la tâche est longue, plus l'écart se creuse », exemple de migration Stripe (50 M lignes). Le tableau de benchmarks officiel est publié sous forme d'image ; les scores relayés par des trackers tiers sont à traiter comme secondaires. anthropic.com — Fable 5 & Mythos 5
- « Introducing Claude Sonnet 5 », Anthropic, 30 juin 2026 — « le modèle Sonnet le plus agentique à ce jour », performance « proche d'Opus 4.8 » à prix Sonnet, tarif d'introduction 2 $/10 $ jusqu'au 31 août 2026, modèle par défaut Free et Pro. anthropic.com — Claude Sonnet 5
- « Models overview » et « Choosing the right model », docs Claude Platform — cartographie de la gamme, disponibilité multi-plateformes, grille « complexité de la tâche → modèle », leviers de coût (prompt caching, Batch API), et la recommandation « ajuster l'effort est souvent un meilleur levier que changer de modèle ». platform.claude.com — Models overview · Choosing a model
- « Statement on the US government directive to suspend access to Fable 5 and Mythos 5 » (12 juin 2026) et « Redeploying Fable 5 » (30 juin 2026), Anthropic — chronologie de la suspension et du rétablissement, directive visant les ressortissants étrangers, modèles à accès général non affectés. anthropic.com — directive d'accès · Redeploying Fable 5
- « Data retention practices for Covered Models », support Claude — Opus 5 sans exigence de rétention pour l'accès général ; Fable 5 et Mythos 5 en rétention obligatoire de 30 jours en tant que « Covered Models », donnée non utilisée pour l'entraînement. support.claude.com — Covered Models
Articles similaires
Claude Opus 5 : l'intelligence quasi-frontier au prix du modèle par défaut
Claude Opus 5, lancé le 24 juillet 2026, « s'approche de l'intelligence frontier de Fable 5 à moitié prix », au tarif inchangé d'Opus 4.8. Et pour une DSI européenne, un détail pèse plus qu'un benchmark : Opus 5 préserve le Zero Data Retention que Fable 5 casse.
Claude Fable 5 : le premier modèle Mythos-class d'Anthropic disponible pour tous
Claude Fable 5, premier modèle Mythos-class d'Anthropic (9 juin 2026) : specs, benchmarks constructeur, sécurité, fallback Opus 4.8 et avis d'experts.
Claude Sonnet 5 : le modèle le plus agentique d'Anthropic, et pourquoi il divise
Sorti le 30 juin 2026, Claude Sonnet 5 est le modèle le plus agentique d'Anthropic : bonds nets en codage et tool use face à Sonnet 4.6, mais un accueil très polarisé. Benchmarks, prix, retours d'usage, et notre lecture : un instrument spécialisé, pas universel.
Comment choisir son modèle LLM en 2026 : la carte, pas le classement
Cinq laboratoires, des capacités qui convergent, des prix qui s'effondrent : en 2026, « quel est le meilleur modèle ? » devient la mauvaise question. Voici le cadre de décision qui remplace le classement : router par tâche, mesurer le coût par résultat, rester réversible, investir dans le système.