Advisor Claude Code : qui planifie, qui édite, qui lit entre Opus, Sonnet et Haiku 5.5
Le 7 octobre 2026, Claude Code v2.1.293 a ajouté Claude Haiku 5.5 à une session qui peut déjà faire travailler plusieurs modèles : un modèle principal, un advisor consulté aux points de décision, des subagents épinglés chacun sur son modèle91. La configuration ci-dessous a été relue ligne à ligne contre la documentation : Sonnet 5.5 en session principale, Opus 5.5 en advisor, Haiku 5.5 en lecture seule. Elle vaut pour les équipes sur l'API Anthropic. Sur Google Cloud, Amazon Bedrock ou Microsoft Foundry, l'advisor n'existe pas ; les voies de repli sont en fin d'article.
Ce que fait l'advisor de Claude Code, et ce qu'il ne fait pas
L'advisor est un outil serveur, exécuté chez Anthropic, qui permet au modèle principal de consulter un second modèle « typically stronger » à trois moments : avant de s'engager sur une approche, quand une erreur revient, avant de déclarer la tâche terminée. Le conseiller reçoit la conversation complète, appels d'outils et résultats compris, et renvoie une recommandation que le modèle principal applique avant de continuer. Vous choisissez le modèle conseiller ; Claude décide quand l'appeler. La fonction est marquée expérimentale, « Behavior, pricing, and availability may change », et fonctionne pour les comptes par abonnement comme pour les comptes facturés à l'API1.
Trois voies d'activation : la commande /advisor opus, sauvegardée dans le réglage advisorModel ; ce même réglage écrit dans le fichier de settings ; le flag --advisor, valable pour une session et prioritaire sur le réglage. Ce flag n'apparaît pas dans claude --help, qui ne liste pas tous les flags, mais il figure dans la référence CLI12. Depuis la v2.1.260, /advisor fonctionne aussi en mode -p, dans l'Agent SDK, l'application desktop et Remote Control. Au démarrage, une notification confirme l'état : Advisor Tool (experimental) is on and may use more tokens · /advisor. Pendant la tâche, une ligne Advising s'affiche, puis l'un de trois états : Reviewed (avis lisible avec Ctrl+O quand il est lisible), Declined, Unavailable avec un code d'erreur1.
Un point se perd souvent : « There is no setting to cap or force advisor calls ». Aucun réglage ne plafonne ni ne force les consultations. La seule prise est l'instruction, dans le prompt ou dans CLAUDE.md, du type « consult the advisor before you continue »1. Et l'advisor diffère de trois autres mécanismes avec lesquels on le confond :
| Mécanisme | Quand le modèle fort intervient | Qui déclenche |
|---|---|---|
| Advisor | Aux points de décision, en cours de tâche | Claude, quand il estime en avoir besoin |
opusplan | Pendant le plan mode ; Sonnet reprend pour l'exécution | Vous, en entrant en plan mode |
Subagent avec model | Pendant toute la sous-tâche déléguée | Claude délègue, ou vous invoquez le subagent |
/model | À partir de la requête suivante | Vous |
Source : documentation Claude Code, consultée le 8 octobre 20261.
Qui peut conseiller qui
Règle de base : le conseiller doit être classé au moins au niveau du modèle principal. Haiku 4.5 peut appeler l'advisor mais ne peut pas en être un. Haiku 5.5, lui, peut faire les deux depuis la v2.1.2931.
| Modèle principal | Conseillers acceptés |
|---|---|
| Haiku 4.5 | Fable, Opus, Sonnet, Haiku 5.5 |
| Sonnet 4.6 | Fable, Opus, Sonnet, Haiku 5.5 |
| Opus 4.6 | Fable, Opus, Sonnet 5 ou plus récent, Haiku 5.5 |
| Sonnet 5 ou Haiku 5.5 | Fable, Opus 4.7 ou plus récent, Sonnet 5 ou plus récent, Haiku 5.5 |
| Opus 4.7 ou 4.8 | Fable, Opus 4.7 ou plus récent, Sonnet 5.5 |
| Sonnet 5.5 | Fable, Opus 5 ou plus récent, Sonnet 5.5 |
| Opus 5 ou 5.5 | Fable, Opus 5 ou plus récent |
| Fable 5 | Fable 5.1 ou Fable 5 |
| Fable 5.1 | Fable 5.1 |
Table de la documentation Claude Code au 8 octobre 20261. Versions minimales : v2.1.257 pour Fable 5.1 en conseiller, v2.1.287 pour Sonnet 5.5 en conseiller d'Opus 4.7 ou 4.8, v2.1.293 pour Haiku 5.5 en modèle principal ou en conseiller.
Les alias fable, opus, sonnet désignent la version par défaut de chaque famille dans Claude Code, et cette version avance avec les releases. Un identifiant complet (claude-opus-5-5, claude-haiku-5-5) fige le choix1. Les subagents héritent de l'advisor configuré, avec la même vérification d'appariement sur leur propre modèle : un subagent Haiku 5.5 sous un advisor Opus 5.5 est un appariement valide, qui demande la v2.1.2931.
La configuration recommandée : Sonnet pilote, Opus conseille, Haiku lit
Objectif : à la fin, une session Claude Code où Sonnet 5.5 édite et teste, où Opus 5.5 n'est facturé qu'aux points de décision, et où l'exploration du dépôt passe par des subagents Haiku 5.5 qui ne peuvent rien écrire. Prérequis : Claude Code v2.1.293 ou plus récent, sur l'API Anthropic.
1. Les settings (~/.claude/settings.json pour un poste, .claude/settings.json pour un dépôt), avec des identifiants complets :
{
"model": "claude-sonnet-5-5",
"advisorModel": "claude-opus-5-5"
}
2. Un subagent d'exploration en lecture seule, versionné dans le dépôt (.claude/agents/explore.md). Le subagent Explore intégré à Claude Code tourne sur le modèle de la session principale, pas sur Haiku : avec la configuration ci-dessus, il lirait votre dépôt au tarif de Sonnet 5.5. Un subagent de projet nommé Explore remplace l'intégré et garde son propre champ model3. Les cinq champs utilisés sont ceux du frontmatter documenté : name, description, tools, model, effort.
---
name: Explore
description: Recherche en lecture seule dans le dépôt. À utiliser pour localiser fichiers, symboles et appels sans rien modifier.
tools: Read, Grep, Glob
model: claude-haiku-5-5
effort: low
---
Tu explores la base de code et tu rends un résumé structuré :
chemin du fichier, numéro de ligne, une phrase par résultat.
Tu ne modifies jamais aucun fichier.
Épinglez le modèle dans le frontmatter plutôt que par la variable CLAUDE_CODE_SUBAGENT_MODEL. Le champ model d'un subagent passe avant la variable, qui ne s'applique qu'aux subagents sans modèle déclaré, et la variable seule ne change pas le modèle des subagents Explore et Plan intégrés3. Haiku 5.5 n'édite pas : sur Terminal-Bench 4.0, le benchmark de coding agentique en terminal, il obtient 39,2 % à effort maximal contre 70,6 % pour Sonnet 5.5, et Anthropic écrit que « Sonnet 5.5 and Opus 5.5 remain better choices for complex agentic coding tasks »45. Retirez-lui Edit, Write et Bash dans tools, ce que fait le frontmatter ci-dessus par omission.
3. Une règle dans CLAUDE.md, puisqu'aucun réglage ne force l'appel :
## Advisor
Consulte l'advisor avant de valider un plan de plus de trois étapes,
quand la même erreur revient deux fois, et avant de déclarer
une tâche longue terminée.
Cette règle répond à une mesure d'Anthropic côté API : sur GPQA Diamond, en deux runs chacun, Haiku 5.5 et Sonnet 5.5 n'ont appelé le conseiller Opus 5.5 sur aucune des 198 questions tant qu'aucun prompt système ne les y incitait. La seule définition de l'outil a pourtant ajouté 12 % au coût par question de Haiku 5.5 et 25 % à celui de Sonnet 5.57. Un advisor jamais consulté coûte, sans rien rendre.
4. Un lancement ponctuel sans toucher aux settings, l'effort en ligne de commande :
claude --model claude-sonnet-5-5 --advisor claude-opus-5-5 --effort high
En mode automatisé, claude -p "…" --max-budget-usd 5 plafonne la dépense estimée côté client, subagents compris2.
5. Les vérifications au premier lancement : la notification Advisor Tool (experimental) is on s'affiche ; /usage montre la part de l'advisor dans la consommation ; DISABLE_TELEMETRY et CLAUDE_CODE_DISABLE_ADVISOR_TOOL ne sont pas positionnées ; les transcripts locaux montrent, pour chaque subagent, le modèle exécuté1.
Variante : Opus 5.5 + advisor Fable pour les chantiers critiques
Pour un refactoring de fond ou une base de code mal connue, passez le modèle principal à claude-opus-5-5 et l'advisor à fable, après le consentement via /model fable si votre plan le demande1. Réservez-la aux tâches où une erreur de conception coûte plus que les tokens : chaque tour est au tarif d'Opus, chaque consultation au tarif de Fable, parfois en usage credits.
Variante : Haiku 5.5 en principal + advisor Opus, pour les tâches étroites
La documentation liste cet appariement sous « Lowest-cost main model with strong planning », avec un coût attendu supérieur à Haiku seul mais inférieur au passage du modèle principal à Sonnet ou Opus1. Il convient aux tâches à périmètre fermé (une migration de schéma répétitive, un lot de classifications) et pas au développement courant, vu le score de Haiku 5.5 en coding agentique. Rappelez-vous la mesure GPQA : sans consigne explicite, Haiku 5.5 n'a jamais consulté7. Sur Haiku 4.5, Anthropic indique qu'un rappel injecté avant le deuxième tour, quand l'exécutant n'a pas encore consulté, a fait gagner environ 7 points de taux de réussite sur une évaluation interne, sans effet mesurable sur Sonnet, et que ce rappel ne s'applique pas à Opus6. Dans Claude Code, la règle dans CLAUDE.md en tient lieu.
Ce que ça coûte, et ce que l'API offre que Claude Code n'offre pas
Chaque appel à l'advisor relit le transcript entier au tarif du conseiller, sans cache : « Each advisor call processes the full transcript anew, with no reuse between calls ». La consultation numéro dix d'une longue session coûte donc plus que la première. Activer ou couper l'advisor en cours de session n'invalide pas le cache du modèle principal, contrairement à un changement de modèle. L'usage apparaît dans /usage ; sur abonnement, il s'impute aux limites du plan1.
L'outil API homonyme, en bêta sous l'en-tête advisor-tool-2026-03-01, expose ce que Claude Code tait : max_uses plafonne les consultations par requête, max_tokens borne la sortie du conseiller (minimum 1 024, 2 048 recommandé : sortie moyenne divisée par environ 7 sans dégradation détectée sur un benchmark interne de 40 cas), et caching met en cache la lecture côté conseiller entre appels. Un avis typique pèse 400 à 700 tokens de texte, 1 400 à 1 800 avec le raisonnement6. Rien de cela n'est réglable dans Claude Code au 8 octobre 20261. Pour une équipe qui industrialise des runs, c'est un argument pour passer par l'Agent SDK ou l'API directe, où le plafond existe.
Les gains mesurés par Anthropic datent de la génération 4.6 et donnent une direction, pas une garantie sur votre code. En avril 2026 : Sonnet avec conseiller Opus gagnait 2,7 points sur SWE-bench Multilingual pour un coût par tâche agentique réduit de 11,9 % ; Haiku 4.5 avec conseiller Opus passait de 19,7 % à 41,2 % sur BrowseComp, 29 % sous Sonnet seul, pour un coût par tâche inférieur de 85 %8. La règle de décision d'Anthropic tient en deux phrases : « An advisor saves money when a few short consultations, billed at the advisor's rate, replace running the advisor's model for the whole task », et « first price the advisor's model alone at low effort; that is the baseline to beat »7.
Côté subagents, Haiku 5.5 coûte 0,10 $ par million de tokens en entrée et 0,50 $ en sortie sous 100 000 tokens de prompt, 0,50 $ et 2,50 $ au-delà, contre 1 $ et 5 $ pour Haiku 4.5 et 2 $ et 10 $ pour Sonnet 5.5 (prix Anthropic du 7 octobre 2026). Le même jour, la lecture en cache de Sonnet 5.5 est passée de 0,20 $ à 0,10 $4. Deux bémols. Le tokenizer de Haiku 5.5 produit environ 30 % de tokens en plus que celui de Haiku 4.5 pour le même texte selon Anthropic11, environ 1,25 fois selon le compteur de Simon Willison, qui y voit « a hidden price increase »12. Et un subagent d'exploration à contexte long passe vite la barre des 100 000 tokens, où le tarif quintuple. La discipline FinOps du coding agentique s'applique au subagent le moins cher comme aux autres.
Ce qui casse
L'advisor est éteint et personne ne le voit. Un conseiller classé sous le modèle principal n'est pas attaché, avec une notification. Si l'API refuse l'appariement, Claude Code renvoie la requête sans advisor, sans erreur et sans appel. Un modèle non reconnu n'est pas attaché non plus1. Une faute de frappe dans advisorModel peut donc tourner des jours en silence. Le remède : la notification au démarrage et /usage, à chaque session de pilote.
La télémétrie coupée coupe l'advisor. La fonction dépend de feature flags récupérés chez Anthropic. DISABLE_TELEMETRY, ou toute variable qui bloque cette récupération, laisse l'advisor éteint. Via une passerelle configurée par ANTHROPIC_BASE_URL, il ne fonctionne que si la requête arrive intacte à l'API Anthropic1. Les postes d'entreprise verrouillés cumulent souvent les deux.
L'alias haiku ne désigne pas forcément Haiku 5.5. Le changelog de la v2.1.293 fait de claude-haiku-5-5 le Haiku par défaut « on the Anthropic API » et ne dit rien des autres fournisseurs9. Hors API Anthropic, nous n'avons pas vérifié ce que résout l'alias. Épinglez l'identifiant complet partout, settings et frontmatter.
Le subagent ne tourne pas sur le modèle déclaré. Le ticket #100082 du dépôt anthropics/claude-code, ouvert le 6 octobre 2026, décrit des subagents déclarés model: haiku ou model: sonnet exécutés sur l'Opus de la session parente, de façon intermittente, sur les versions 2.1.277 à 2.1.290 selon son titre : 279 exécutions sur 301 en claude-opus-5-5 depuis le 5 octobre, environ 85 % de l'usage des subagents en Opus pondéré par le prix du 2 au 6 octobre. L'auteur ne reproduit pas sur 2.1.291 et 2.1.292. Au 8 octobre, le ticket est encore ouvert, étiqueté duplicate, sans réponse de mainteneur : c'est un signalement d'utilisateur, pas un bug confirmé10. Il suffit à justifier un contrôle des transcripts après chaque mise à jour.
Le transcript grossit et la facture avec. Sans cache côté conseiller ni plafond d'appels, une session de plusieurs heures avec un advisor Opus ou Fable coûte de plus en plus cher à chaque consultation. Découpez les sessions longues, ou passez par l'API et son max_uses quand le run est automatisé.
Pour les clients sur Google Cloud : pas d'advisor, mais la hiérarchie tient
SFEIR est partenaire Google Cloud et partenaire Anthropic Preferred, et une partie de nos clients consomme Claude via Google Cloud. Pour eux, la documentation est sans ambiguïté : l'advisor de Claude Code exige l'API Anthropic et n'est disponible ni sur Amazon Bedrock, ni sur Claude Platform on AWS, ni sur Google Cloud's Agent Platform, ni sur Microsoft Foundry1. Les deux documentations divergent sur un point : l'outil advisor de l'API Messages est disponible sur Claude Platform on AWS, celui de Claude Code non6.
Ce qui fonctionne sur Google Cloud : la hiérarchie des subagents. Haiku 5.5 y est disponible depuis le lancement11, et rien n'empêche un modèle principal Sonnet ou Opus de déléguer l'exploration à des subagents Haiku épinglés par frontmatter. Ce qui reste sans effet : /advisor, advisorModel et --advisor, puisque l'outil tourne côté serveur chez Anthropic et dépend de feature flags que ces plateformes ne servent pas1. Une passerelle qui réécrit la requête vers Google Cloud ne change rien à cela.
Deux voies de repli, à mettre en place sans attendre. opusplan fait planifier Opus en plan mode avant de rendre la main à Sonnet pour l'exécution1. Un subagent reviewer épinglé sur Opus, invoqué explicitement aux trois moments clés, donne un second avis déclenché sous votre contrôle. Aucune des deux n'équivaut à l'advisor : le reviewer ne voit que ce qu'on lui transmet, quand l'advisor lit tout le transcript. Pour les équipes qui veulent l'advisor natif, la question devient contractuelle : ouvrir un accès direct à l'API Anthropic pour les postes de développement en gardant Google Cloud pour la production applicative. C'est un arbitrage de gouvernance et de résidence des données, à instruire au cas par cas avec le RSSI et les achats. Sur ce point, notre doctrine multi-harnais s'applique : un contexte de dépôt propre (CLAUDE.md, subagents versionnés) survit au changement de fournisseur, un flag de session non.
Une couche tierce comme Jev, le modèle de décision typée de TypeSafe, peut servir de routeur de décision. Il n'est intégré ni à Claude Code ni à l'advisor : c'est un fournisseur de plus, une clé API de plus, une surface de données de plus, à traiter comme n'importe quelle dépendance SaaS.
Comment tester en deux semaines
- Choisir dix à vingt tâches réelles déjà résolues dans le backlog (bugs, petits refactorings, ajout de tests), avec un critère de succès objectif : tests verts, revue humaine acceptée.
- Mesurer une base avec la configuration actuelle de l'équipe (Opus 5.5 seul, ou Sonnet 5.5 seul) : coût via
/usage, durée, taux de succès, nombre d'allers-retours humains. Si l'équipe tourne déjà sur Opus, chiffrez aussi Opus seul à effort low : c'est la base à battre selon Anthropic7. - Rejouer les mêmes tâches avec Sonnet 5.5 + advisor Opus 5.5 + explorateur Haiku 5.5, puis, pour les tâches les plus dures seulement, Opus 5.5 + advisor Fable.
- Contrôler les transcripts : nombre d'appels à l'advisor et taux de consultation, états Reviewed / Declined / Unavailable, modèle exécuté par chaque subagent d'après le transcript.
- Décider sur les chiffres. Adoptez la configuration si le taux de succès est au moins égal et le coût par tâche réussie en baisse. Sinon, gardez la plus simple.
Les crédits API mensuels annoncés le 7 octobre (100 $ pour Max 5x, 200 $ pour Max 20x, jusqu'à 500 $ mutualisés en Team, déploiement dans la semaine) couvrent un pilote de cette taille4.
Questions fréquentes
Haiku 5.5 peut-il servir d'advisor dans Claude Code ?
Oui depuis la v2.1.293, pour un modèle principal Haiku 4.5, Sonnet 4.6, Opus 4.6, Sonnet 5 ou Haiku 5.5. Il ne peut pas conseiller Sonnet 5.5 ni Opus 5.5, classés au-dessus de lui. L'intérêt reste limité : l'advisor sert à monter en intelligence aux points de décision, et Haiku 5.5 n'apporte ce gain qu'à des modèles d'une génération antérieure.
Comment forcer Claude Code à consulter l'advisor ?
Aucun réglage ne le permet. L'instruction dans CLAUDE.md ou dans le prompt est la seule prise. La mesure GPQA d'Anthropic montre que, sans consigne, Haiku 5.5 et Sonnet 5.5 n'ont consulté sur aucune des 198 questions, tout en payant la définition de l'outil.
L'advisor fonctionne-t-il avec un abonnement Max ou Team ?
Oui, l'outil est ouvert aux comptes par abonnement et aux comptes API. Sur abonnement, les tokens du conseiller s'imputent aux limites du plan, et Fable bascule en usage credits sur certains plans, après consentement via /model fable. Les crédits API mensuels annoncés le 7 octobre 2026 ouvrent une voie de test séparée.
Quelle différence entre l'advisor et opusplan ?opusplan fait planifier Opus pendant le plan mode, puis Sonnet exécute ; vous décidez quand entrer en plan mode. L'advisor intervient en cours d'exécution, aux moments que Claude juge décisifs, et lit tout le transcript. opusplan fonctionne sans l'API Anthropic ; l'advisor non.
Haiku 5.5 peut-il piloter une session avec un advisor Opus ?
Oui, depuis la v2.1.293, et la documentation présente l'appariement comme le moins cher avec une planification forte. Nous le réservons aux tâches à périmètre fermé : à 39,2 % sur Terminal-Bench 4.0 contre 70,6 % pour Sonnet 5.5, Haiku 5.5 reste un lecteur, pas un éditeur de code agentique.
L'advisor est-il disponible sur Google Cloud ou Bedrock ?
Non, ni sur Microsoft Foundry ni sur Claude Platform on AWS, au 8 octobre 2026. La hiérarchie de subagents, elle, fonctionne partout où Haiku 5.5 est servi. Les replis sont opusplan et un subagent reviewer épinglé sur Opus.
Le point de vue SFEIR : partir de la configuration documentée, mesurer, puis généraliser
« Sonnet 5.5 en session principale, Opus 5.5 en advisor, Haiku 5.5 en lecture seule » est la meilleure configuration par défaut disponible aujourd'hui dans Claude Code pour les équipes sur l'API Anthropic. C'est aussi la traduction directe de notre méthode de routage multi-modèles : le modèle cher arbitre, le modèle rapide exécute, le modèle le moins cher lit. Réservez Opus 5.5 + Fable aux chantiers où une erreur de conception coûte plus que les tokens, et laissez Sonnet 5.5 éditer le reste. Pour les clients sur Google Cloud, déployez la hiérarchie de subagents dès maintenant, utilisez opusplan ou un reviewer Opus explicite à la place de l'advisor, et instruisez l'accès direct à l'API Anthropic si le pilote montre un gain. Dans tous les cas, lisez les transcripts : le ticket des subagents exécutés en Opus montre qu'une configuration bien écrite ne garantit pas une facture maîtrisée. La gamme Claude compte désormais quatre niveaux utilisables dans une même session ; le travail consiste à vérifier, chiffres en main, que chacun fait ce qu'on lui a demandé.
Sources
- « Escalate hard decisions with the advisor tool », documentation Claude Code, Anthropic, consultée le 8 octobre 2026 : mécanisme, activation (
/advisor,advisorModel,--advisor), table des appariements et versions minimales, validation silencieuse, états Advising / Reviewed / Declined / Unavailable, absence de plafond, coût sans cache, feature flags etDISABLE_TELEMETRY, passerelles,CLAUDE_CODE_DISABLE_ADVISOR_TOOL,availableModels, comparaison avecopusplan, subagents et/model, plateformes exclues. code.claude.com : advisor - « CLI reference », documentation Claude Code, Anthropic, consultée le 8 octobre 2026 : flags
--advisor,--agent,--agents,--model,--effort,--max-budget-usd,--fallback-model; « claude --help does not list every flag ». code.claude.com : CLI reference - « Create custom subagents », documentation Claude Code, Anthropic, consultée le 8 octobre 2026 : champs de frontmatter
name,description,tools,model,effort; ordre de résolution du modèle (paramètre d'invocation, frontmatter,CLAUDE_CODE_SUBAGENT_MODEL, modèle principal) ; Explore intégré sur le modèle de la session, remplaçable par un subagent de projet nomméExplore. code.claude.com : sub-agents - « Introducing Claude Haiku 5.5 », Anthropic, 7 octobre 2026 : prix par palier de 100 000 tokens, Terminal-Bench 4.0 (39,2 % contre 70,6 % pour Sonnet 5.5), positionnement en subagent, vitesse « at each model's standard speed », baisse du cache read de Sonnet 5.5, crédits API mensuels. Chiffres constructeur. anthropic.com : Claude Haiku 5.5
- « Claude Haiku 5.5 System Card », Anthropic, octobre 2026 (PDF) : Terminal-Bench 4.0 mesuré en Claude Code
--bareà effort maximal, avec safeguards et sans modèle de repli ; Sonnet 5.5 70,6 %, Opus 5.5 66,4 % (xhigh), Haiku 4.5 0,0 %. anthropic.com : system card Claude Haiku 5.5 - « Advisor tool », Claude Platform Docs, Anthropic, consultée le 8 octobre 2026 : bêta
advisor-tool-2026-03-01, disponibilité (Claude API et Claude Platform on AWS ; pas Bedrock, Google Cloud, Foundry), paramètresmax_uses,max_tokens,caching, taille d'un avis, conseils de prompt et rappel au deuxième tour. platform.claude.com : advisor tool - « Optimizing for cost and intelligence », Claude Platform Docs, Anthropic, consultée le 8 octobre 2026 : runs GPQA Diamond sans consultation (0 sur 198), surcoût de la définition de l'outil (12 % Haiku 5.5, 25 % Sonnet 5.5), règle « first price the advisor's model alone at low effort ». platform.claude.com : cost and intelligence
- « The advisor strategy: Give Sonnet an intelligence boost with Opus », blog Claude, Anthropic, 9 avril 2026 : Sonnet + Opus (+2,7 points SWE-bench Multilingual, coût par tâche −11,9 %), Haiku 4.5 + Opus sur BrowseComp (41,2 % contre 19,7 %, coût −85 %). Mesures Anthropic, génération 4.6. claude.com : the advisor strategy
- Changelog Claude Code v2.1.293, dépôt anthropics/claude-code sur GitHub, 7 octobre 2026 : Haiku 5.5 « now the default Haiku model on the Anthropic API ». github.com : releases anthropics/claude-code
- Issue #100082, « Custom subagent frontmatter model (haiku/sonnet) ignored — subagents ran on parent Opus model (2.1.283–2.1.290) », anthropics/claude-code sur GitHub, ouverte le 6 octobre 2026, encore ouverte au 8 octobre, étiquette duplicate, sans réponse de mainteneur. Signalement d'utilisateur. github.com : issue #100082
- « Claude Haiku 5.5 overview » et « What's new in Claude Haiku 5.5 », Claude Platform Docs, Anthropic, consultées le 8 octobre 2026 : plateformes (Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS), effort par défaut medium, tokenizer (« approximately 30% more tokens » que Haiku 4.5). platform.claude.com : Haiku 5.5 overview
- Simon Willison, « Claude Haiku 5.5 », 7 octobre 2026 : compteur de tokens à environ 1,25× Haiku 4.5 sur un même long prompt, « a hidden price increase ». simonwillison.net
Articles similaires
Claude Haiku 5.5 : ce que le nouveau Haiku change pour vos sous-agents
Claude Haiku 5.5 (7 octobre 2026) rejoint le tarif de GPT-6 Luna sous 100 000 tokens et le devance sur les benchmarks constructeur. Seuil des 100k, tokenizer plus gourmand, verbosité à effort élevé, advisor, migration : à vérifier avant d'en faire le modèle de vos sous-agents.
La famille de modèles Claude : Haiku, Sonnet, Opus, Fable, quel modèle pour quelle tâche
Au 8 octobre 2026, la gamme Claude compte cinq niveaux et la famille Claude 5.5 est complète : Haiku 5.5, Sonnet 5.5, Opus 5.5, puis la classe Mythos (Fable et Mythos). Ce que chacun sait faire, par complexité de tâche, et pourquoi choisir le niveau est une décision d'architecture.
Claude Sonnet 5.5 : le travail cadré au niveau d'Opus 5.5, au prix de Sonnet
Claude Sonnet 5.5 (28 septembre 2026) garde le tarif de Sonnet 5, 2 $/10 $, et se place à deux ou trois points d'Opus 5.5 sur le travail cadré. Benchmarks, coût par tâche selon l'effort, premiers garde-fous cyber sur un Sonnet, ruptures d'API à traiter avant de migrer.
Claude Opus 5.5 : le niveau de Fable 5.1 au prix d'Opus, et quatre ruptures d'API à traiter
Claude Opus 5.5 (22 septembre 2026) ouvre la famille Claude 5.5 : niveau de Fable 5.1 sur la plupart des tâches, 20 % de moins au token qu'Opus 5, cache read à 0,20 $. Derrière l'annonce : quatre breaking changes, un thinking qu'on ne coupe plus, une facture qui dépend de l'effort.