écrits/blog/2026/08
Blog4 août 2026·6 min

Claude Opus 5 est verbose par conception : votre guide de migration

Opus 5 narre, vérifie et élargit la portée par défaut — vos anciens prompts aggravent les choses. Ce guide couvre les six changements comportementaux et les corrections officielles d'Anthropic.

Claude Opus 5 a été lancé le 24 juillet 2026, et en quelques jours les forums développeurs se sont remplis de plaintes : des réponses qui ne finissent pas, des passes de vérification que personne n'a demandées, des tâches qui s'élargissent d'elles-mêmes. Dan Shipper l'a qualifié de "très difficile à aimer". CodeRabbit a relevé "quatre fois plus de remarques futiles". Et les factures de tokens ne correspondaient pas aux tarifs annoncés.

Le paradoxe frustrant : Opus 5 fait exactement ce qu'Anthropic a conçu pour lui.

Ce modèle est conçu pour le travail agentique complexe à long horizon. Il vérifie ses propres sorties, narre sa progression et corrige les erreurs de manière proactive — sans qu'on le lui demande. Le problème est que la plupart des bibliothèques de prompts ont été écrites pour Opus 4.8, qui avait besoin qu'on lui demande de faire ces choses. Quand vous demandez à Opus 5 de faire ce qu'il fait déjà, vous obtenez le double du comportement, le double des tokens et une expérience plus lente et plus coûteuse.

La solution n'est pas de combattre le modèle. C'est de cesser de lui demander ce qu'il fait déjà.

Pourquoi réduire l'effort ne corrige pas la verbosité

La première chose que les développeurs essaient est de baisser le paramètre effort. C'est un réflexe logique — moins d'effort devrait signifier moins de travail, non ?

Pas tout à fait. Le paramètre effort contrôle la quantité de réflexion du modèle (tokens de thinking étendu). Il ne raccourcit pas de manière fiable la réponse visible. Pour contrôler la longueur des réponses, il faut le demander explicitement dans le prompt.

C'est l'idée reçue la plus répandue sur Opus 5.

Les six comportements à recalibrer

Le guide officiel d'Anthropic Prompting Claude Opus 5 identifie six changements comportementaux qui nécessitent le plus souvent un ajustement lors de la migration depuis Opus 4.8.

1. Longueur des réponses

Les réponses conversationnelles par défaut d'Opus 5 sont plus longues que celles d'Opus 4.8. Ajoutez une instruction de concision explicite dans votre prompt système :

Gardez les réponses ciblées, brèves et concises. Raccourcissez les avertissements
et réserves, et consacrez la majeure partie de la réponse à la réponse principale.
Quand on vous demande d'expliquer quelque chose, donnez un résumé de haut niveau
sauf si une explication approfondie est spécifiquement demandée.

Dans les prompts système longs, associez-le à un rappel court en bas du prompt :

<tone_preference>
Gardez les sorties raisonnablement concises.
</tone_preference>

2. Narration agentique

Pendant les tâches agentiques, Opus 5 annonce ce qu'il va faire, narre chaque étape et produit des sorties par message plus longues que les modèles précédents. Pour ramener la narration à un cadence minimale et orientée signal :

Avant votre premier appel d'outil, dites en une phrase ce que vous allez faire.
Pendant le travail, donnez une brève mise à jour uniquement quand vous trouvez
quelque chose d'important ou changez de direction. Quand vous terminez, commencez
par le résultat : votre première phrase doit répondre à "que s'est-il passé"
ou "qu'avez-vous trouvé", avec les détails après pour ceux qui veulent en savoir plus.

3. Longueur des livrables écrits

Les fichiers qu'Opus 5 écrit sur le disque — rapports, documents Markdown, résumés — sont également plus longs que ceux des modèles précédents. Ajoutez un calibrage explicite si votre produit génère des documents rédigés par Claude :

Adaptez la longueur des documents écrits à ce que la tâche nécessite :
couvrez la substance, mais ne rembourrez pas avec des sections inutiles,
des résumés redondants ou des formules génériques.

4. Portée des tâches et sur-vérification

Opus 5 vérifie son propre travail sans qu'on le lui demande. Si votre prompt contient des étapes de vérification explicites ("inclure une passe de vérification finale", "utiliser un sous-agent pour vérifier"), supprimez-les. Ces instructions se cumulent avec un comportement que le modèle a déjà. Les supprimer réduit les tokens gaspillés sans perte de qualité.

Le modèle élargit également la portée des tâches selon son propre jugement. Pour les tâches étroites, contraignez la portée explicitement :

Livrez ce qui a été demandé, dans la portée prévue. Prenez vous-même les décisions
de jugement courantes, et consultez uniquement quand des lectures différentes de la
demande mèneraient à un travail matériellement différent. Si la demande semble erronée
ou si une meilleure approche existe, dites-le en une phrase et continuez la tâche
telle que demandée plutôt que de la réduire, l'élargir ou la transformer silencieusement.

5. Délégation aux sous-agents

Opus 5 délègue aux sous-agents plus facilement que les modèles précédents. La délégation est puissante pour le travail véritablement parallèle, mais multiplie les coûts sur les petites tâches. Donnez des directives explicites sur quand elle est justifiée :

Déléguez à un sous-agent uniquement pour les tâches volumineuses véritablement
indépendantes et parallélisables, comme une investigation étendue sur plusieurs fichiers.
Ne déléguez pas un travail que vous pouvez terminer vous-même en quelques appels
d'outils, et n'utilisez pas de sous-agents pour vérifier votre propre travail. Si un
sous-agent peut accomplir la tâche, utilisez-en un seul et gardez le nombre de spawns bas.

6. Narration des auto-corrections

Opus 5 détecte et corrige ses propres erreurs sans instruction. Évitez les consignes comme "vérifiez votre réponse" ou "re-vérifiez avant de répondre" — elles se cumulent avec le comportement de correction intégré et ajoutent des coûts sans bénéfice.

Pour limiter la narration des corrections à celles qui comptent vraiment :

Corrigez une déclaration antérieure uniquement quand l'erreur changerait le code,
les conclusions ou les décisions de l'utilisateur. Énoncez les corrections clairement
et brièvement, puis continuez la tâche. Pour les erreurs sans conséquence pour
l'utilisateur, faites la correction et continuez sans le signaler.

L'éléphant dans la bibliothèque de prompts

L'équipe de Boris Cherny chez Anthropic a supprimé plus de 80% du prompt système existant de Claude Code lors de la migration vers Opus 5. C'est un chiffre frappant, et c'est le signal le plus clair de ce à quoi ressemble le vrai travail de migration.

Votre bibliothèque de prompts actuelle était un échafaudage construit pour un modèle moins capable. Des instructions comme "vérifiez votre travail", "réfléchissez étape par étape", "vérifiez les erreurs avant de répondre" étaient des contournements pour le comportement d'Opus 4.8. Opus 5 fait tout cela sans instruction. Conserver ces instructions demande au modèle de faire la chose deux fois.

Le travail de migration est essentiellement une soustraction, pas une addition.

Les niveaux d'effort à connaître

Une fois vos prompts allégés, les niveaux d'effort deviennent votre principal levier de coût :

  • low et medium — Qualité solide pour une fraction des tokens. Utilisez-les par défaut et ajustez à la hausse en fonction de vos évaluations.
  • high — Le paramètre par défaut. Un bon point de départ.
  • xhigh — Réservé au codage agentique exigeant et au travail complexe multi-fichiers où la différence de qualité justifie le coût.

Si vous avez conservé les paramètres d'effort d'Opus 4.8, relancez un balayage d'effort sur vos propres évaluations. Les niveaux recommandés pour Opus 5 diffèrent significativement.

Liste de contrôle de migration rapide

Avant de passer en production avec Opus 5 :

  • Supprimez toutes les instructions de vérification explicites ("verify", "double-check", "re-check")
  • Supprimez les instructions de réflexion étape par étape — Opus 5 raisonne par défaut avec le thinking activé
  • Ajoutez des directives explicites de longueur de réponse si vous avez besoin de sorties concises
  • Calibrez la cadence de narration pour les tâches agentiques
  • Auditez les règles de délégation aux sous-agents — ajoutez des plafonds explicites
  • Lancez un balayage d'effort : utilisez low ou medium par défaut, augmentez uniquement là où les évaluations l'exigent
  • Si le thinking est désactivé : supprimez les instructions "ne raisonnez pas" (elles causent des fuites de balises internes)

La vue d'ensemble

Le cadrage d'Anthropic est instructif. Opus 5 n'est pas un chatbot calibré pour des réponses courtes et percutantes. Il est conçu pour le type de travail où la profondeur, la vérification et la planification multi-étapes apportent une vraie valeur — des fonctionnalités complexes de codebase, des tâches agentiques à long horizon, de la génération de documents d'entreprise.

Pour les tâches simples, l'effort low associé à un prompt de concision bien réglé vous amènera à l'essentiel. Pour ce pour quoi Opus 5 a vraiment été conçu — codage agentique difficile, coordination multi-agents, génération de documents à grande échelle — la verbosité fait souvent un travail utile. Le bon calibrage consiste à orienter ce travail se manifeste, pas à l'éliminer.

Les développeurs qui obtiennent les meilleurs résultats avec Opus 5 ne combattent pas sa verbosité. Ils la redirigent.