MentorMe

Guide modèle · publié le 24 juillet 2026 · claude-opus-5

Le curseur est le modèle.

Opus 5 est le premier Claude où la principale chose que vous réglez n'est pas la formulation de votre prompt — c'est l'intensité de l'effort demandé. Une qualité de pointe à 5 $/25 $ par million de tokens, la moitié de Fable 5.

Voici ce qui a vraiment changé, ce qu'il faut supprimer de vos anciens prompts, et les neuf blocs de prompts qui valent la peine d'être gardés.

Compilé à partir de la documentation Opus 5 d'Anthropic et des retours du lancement · Des principes de prompting, pas des impressions.

01 — les chiffres

Ce que vous achetez.

Même prix qu'Opus 4.8. Environ le double du score sur le benchmark agentique le plus exigeant d'Anthropic.

Entrée
5 $ / M tokens
Sortie
25 $ / M tokens
Contexte
1M par défaut et max
Sortie max
128k tokens
Thinking
Activé par défaut
Mode rapide
2,5× à 10 $/50 $
BenchmarkRésultatÀ lire comme
Frontier-Bench v0.143,3 % vs 18,7 % (Opus 4.8)Plus du double, à coût par tâche inférieur
CursorBench 3.2À 0,5 % de Fable 5Moitié prix pour une quasi-parité en code
ARC-AGI 33× le meilleur autre modèleUn écart de raisonnement inédit, pas un arrondi
OSWorld 2.0 (usage ordinateur)Bat le meilleur score de Fable 5À environ un tiers du coût
Zapier AutomationBench~1,5× le meilleur autre modèle ; 100 % sur les tâches de churnAutomatisation métier réelle, pas des tâches jouets
Chimie organique (interne)+10,2 pts vs 4.8Le meilleur Claude généralement disponible pour la science
Relectures juridiques (premier jet)~2× Opus 4.8Premiers jets professionnels, pas de simples plans
Le chiffre qui compte le plus en production

Harvey a rapporté qu'Opus 5 égalait la qualité de sortie d'Opus 4.8 poussé au raisonnement maximal, tout en réduisant l'usage moyen de tokens de 26 %. L'économie n'est pas le prix affiché — c'est qu'un effort plus faible franchit désormais la barre que l'ancien modèle ne franchissait qu'à effort maximal.

02 — l'échelle d'effort

Choisissez un échelon, puis arrêtez d'ajuster.

L'effort gouverne chaque token de la réponse — thinking, appels d'outils et arguments — pas seulement le raisonnement. Un effort plus faible signifie moins d'appels d'outils, moins de préambule, des confirmations plus courtes.

NiveauÀ utiliser pourVerdict sur Opus 5
lowClassification, recherches simples, sous-agents, chat à haut volumeà utiliser librement — nettement plus solide que les anciens niveaux bas d'Opus
mediumTravail agentique de routine, équilibre coût/vitesseà utiliser librement — votre principal levier de coût
high (par défaut)Raisonnement complexe, la majorité du travail de connaissancevaleur par défaut sûre — identique à l'omission du paramètre
xhighCode, runs d'agents de plus de 30 minutes, recherche approfondieà privilégier pour le code — recommandation d'Anthropic elle-même
maxUniquement les problèmes vraiment à la pointeà mesurer d'abord — coût élevé, gain faible sur la plupart des tâches

Dans Claude Code et claude.ai

Tapez /effort xhigh pour une vraie session de code ou un run d'agent ; laissez high pour des modifications rapides et des questions. Passez à medium pour du travail répétitif où la vitesse compte. ultracode dans le menu Claude Code n'est pas un sixième niveau d'API — c'est xhigh plus une autorisation permanente de lancer des workflows multi-agents.

Dans l'API

0 · output_config.effort

{
  "model": "claude-opus-5",
  "max_tokens": 64000,
  "stream": true,
  "output_config": { "effort": "xhigh" },
  "messages": [{ "role": "user", "content": "..." }]
}

À xhigh ou max, réglez max_tokens haut — 64k est un point de départ raisonnable — car cette valeur plafonne le thinking et le texte de réponse ensemble. Et streamez : 64k de sortie peut dépasser la limite de temps du mode non-streaming.

Trois pièges

1. L'effort contrôle le volume de thinking, pas la longueur de la réponse visible. Le baisser ne raccourcira pas la réponse — il faut demander la brièveté explicitement. 2. Changer d'effort en cours de conversation invalide votre cache de prompt, car l'effort façonne le prompt rendu. Choisissez un niveau par session. 3. thinking: {"type":"disabled"} à xhigh ou max renvoie une erreur 400. C'est le changement cassant depuis 4.8.

03 — migration

Les instructions à supprimer.

La chose la plus rentable que vous puissiez faire avec un ancien prompt Opus 4.8, c'est d'en retirer des éléments. Opus 5 fait déjà plusieurs des comportements que votre prompt compensait, et le lui redemander le fait faire deux fois.

Si votre prompt dit…Faites ceciParce que
« Inclure une étape de vérification finale » / « utiliser un sous-agent pour vérifier »deleteIl s'auto-vérifie déjà. L'instruction provoque une sur-vérification et brûle des tokens sans gain de qualité.
« Revérifie ta réponse avant de répondre »deleteMême problème cumulatif — il détecte et corrige déjà ses propres erreurs.
« Ne signale que les problèmes de sévérité élevée » (relecture de code)deleteIl suit cette consigne littéralement et sous-rapporte. Demandez tout, filtrez dans une seconde passe.
« Ne réfléchis pas » / « ne raisonne pas »deleteAugmente le risque de fuite de balises XML internes dans la sortie visible.
Contournements de vision calibrés pour les anciens modèlesre-testLa précision sur graphiques, diagrammes et reproduction d'interfaces a fait un bond ; la béquille pourrait maintenant nuire.
Niveaux d'effort hérités de 4.8 / 4.7re-sweepLow et medium franchissent désormais des seuils qu'ils ne franchissaient pas avant. Relancez le test sur vos propres évaluations.
thinking: {"type":"adaptive"}keepToujours valide, désormais équivalent au défaut. Mais revoyez max_tokens : le thinking compte maintenant dedans.

Ce qu'il faut ajouter à la place

Les aspérités d'Opus 5 ont toutes la même forme — il en fait plus. Réponses plus longues, documents plus longs, plus de narration, plus de délégation, un périmètre plus large. Chaque prompt ci-dessous réduit l'un de ces excès.

04 — la bibliothèque de prompts

Neuf blocs à conserver.

À coller dans un system prompt, un CLAUDE.md, ou en tête d'une longue conversation. Chacun cible un comportement précis mesuré, pas une impression.

1 · Concision — produits orientés utilisateur

Keep responses focused, brief, and concise. Keep disclaimers and caveats short, and spend most of the response on the main answer. When asked to explain something, give a high-level summary unless an in-depth explanation is specifically requested.

Les réponses par défaut d'Opus 5 sont plus longues que celles de 4.8. Voici le correctif — ce n'est pas l'effort qui le fait.

2 · Le rappel en fin de prompt

<tone_preference>
Keep outputs reasonably concise.
</tone_preference>

Dans un long system prompt, associez l'instruction complète en haut à ce court rappel vers la fin.

3 · Cadence de narration pendant les runs d'agent

Before your first tool call, say in one sentence what you're about to do. While working, give a brief update only when you find something important or change direction. When you finish, lead with the outcome: your first sentence should answer "what happened" or "what did you find," with supporting detail after it for readers who want it.

Opus 5 annonce ce qu'il s'apprête à faire, souvent longuement. Décrivez la cadence voulue ; les exemples positifs valent mieux que les interdictions.

4 · Longueur des livrables écrits

Match the length of written documents to what the task needs: cover the substance, but do not pad with filler sections, redundant summaries, or boilerplate.

Les fichiers écrits sur disque — rapports, Markdown, résumés — gonflent indépendamment de la verbosité conversationnelle. C'est un levier distinct.

5 · Contrôle du périmètre

Deliver what was asked, at the scope intended. Make routine judgment calls yourself, and check in only when different readings of the request would lead to materially different work. If the request seems mistaken or a better approach exists, say so in a sentence and continue with the task as asked rather than quietly narrowing, widening, or transforming it. Finish the whole task, and stop short of actions that are clearly beyond what was asked.

Le meilleur bloc généraliste de cette page. Opus 5 appliquera son propre jugement sur ce que la tâche « devrait » être si vous ne tracez pas la ligne.

6 · Plafonner le lancement de sous-agents

Delegate to a subagent only for large tasks that are genuinely independent and parallelizable, such as a wide multi-file investigation. Do not delegate work you can finish yourself in a handful of tool calls, and do not use subagents to verify or double-check your own work. If one subagent can complete the task, use one rather than several, and keep spawn counts low.

La délégation multiplie coût et temps réel sur les petites tâches. Opus 5 y a recours plus volontiers que 4.8.

7 · Arrêter de narrer les corrections

Only correct an earlier statement when the error would change the user's code, conclusions, or decisions. State corrections plainly and briefly, then continue the task. For slips that change nothing for the user, make the fix and move on without noting it.

L'auto-correction est une fonctionnalité ; la narrer à chaque fois pour un client n'en est pas une.

8 · Relecture de code exhaustive

Review this change and report every issue you find, including low-severity ones and anything you are only moderately confident about. Do not filter for severity — I will triage in a separate pass. For each finding give the file and line, a one-sentence statement of the defect, and a concrete failure scenario with inputs and the wrong result.

Précision et rappel sont élevés chez Opus 5, et la justesse tient même à effort réduit — faites donc une passe rapide en medium au moment de la relecture, puis une passe approfondie en xhigh plus tard.

9 · Si vous devez désactiver le thinking

You may say a brief sentence before using a tool.
Do not include internal or system XML tags in your response.

Thinking désactivé, Opus 5 écrit parfois un appel d'outil en texte brut (qui ne s'exécute jamais et empoisonne les tours suivants) ou laisse fuiter des balises. Ces deux lignes atténuent les deux problèmes. Mieux : gardez le thinking activé et baissez plutôt l'effort.

Neuf prompts, c'est un début, pas un système

Le prompting n'est pas une stratégie. Vouloir un plan sur 90 jours qui fait tourner toute votre entreprise sur l'IA, ça en est une.

Construire ma feuille de route IA sur 90 jours →

05 — routage

Sur quoi le pointer.

Là où le modèle justifie son prix, et là où un modèle moins cher ferait aussi bien l'affaire.

Donnez-lui toute la spécification, puis partez

Opus 5 est le plus fort sur les fonctionnalités multi-fichiers, les gros refactors et le travail de bout en bout, et il termine au lieu de laisser des ébauches et des TODO. Donnez la spécification complète d'emblée plutôt que de distiller les étapes.

Relecture de code à deux vitesses

Un taux élevé de vrais bugs par passe, avec des trouvailles supplémentaires majoritairement réelles. La justesse tient même à effort bas — faites donc une passe économique au moment du commit et une passe approfondie avant la sortie.

Vision avec outils, pas seulement du thinking

Graphiques, documents denses, diagrammes, reproduction d'interfaces. Donnez-lui bash et des outils de recadrage pour qu'il puisse inspecter et vérifier visuellement — c'est plus efficace que de miser tout le budget sur le seul thinking.

Le million de tokens en entier

Le contexte de 1M est à la fois le défaut et le maximum, et le suivi des instructions, les appels d'outils et le raisonnement restent constants sur toute la fenêtre. Le travail sur des dépôts entiers ou des salles de données complètes est possible.

Tableurs et présentations

Classeurs multi-feuilles avec des formules non triviales, et des diapositives bien structurées. Il suivra un modèle maison — mais seulement si vous lui en fournissez un.

Orchestration

Les équipes de sous-agents rédacteur-vérificateur tiennent bien, avec peu d'agents qui se marchent dessus. Plafonnez le nombre d'agents pour le coût, pas pour la justesse.

06 — discrètement utile

Quatre changements absents des gros titres.

Le minimum du cache de prompt tombe à 512 tokens (contre 1 024). Les system prompts courts qui ne pouvaient jamais être mis en cache sur 4.8 le peuvent désormais, sans changer de code.

Changement d'outils en cours de conversation (bêta). Ajoutez ou retirez des outils entre les tours sans invalider le cache — en-tête mid-conversation-tool-changes-2026-07-01.

Mode de repli par défaut (bêta). fallbacks: "default" route les refus par catégorie vers les alternatives recommandées par Anthropic au lieu d'une liste que vous devez maintenir — en-tête server-side-fallback-2026-07-01.

Mode rapide. 2,5× le débit au double du tarif (10 $/50 $), uniquement via l'API Claude — pas encore sur Bedrock, Google Cloud ni Microsoft Foundry.

Fondateur —

Vous savez désormais faire tourner Opus 5 : le curseur d'effort, ce qu'il faut retirer de vos prompts, les neuf blocs qui tiennent face à de vrais délais.

Le prompting, c'est les 20 % faciles. Les 80 % restants, c'est décider où pointer le modèle en premier, dans quel ordre, dans une entreprise qui doit encore payer les salaires. C'est la partie qu'on construit avec vous — une feuille de route sur 90 jours, pas un pack de prompts de plus.

— Italo

Les outils changent. Les principes de prompting non.

— pourquoi ce guide ne sera pas obsolète le mois prochain

Des réponses franches · sans esbroufe

07 — des réponses franches

Les questions que tout le monde se pose.

Pas tout à fait, et c'est bien là l'intérêt. Opus 5 arrive à 0,5 % de Fable 5 sur CursorBench 3.2 et le bat sur OSWorld (usage d'ordinateur), pour moitié moins cher, voire un tiers du coût. Fable 5 garde l'avantage sur les tâches longues, multi-jours et ambiguës. Si une tâche prend des heures ou des jours à un humain et que personne ne l'a encore résolue, c'est pour Fable. Tout le reste, c'est Opus 5.

Encore des questions sur la mise en pratique dans votre entreprise

Passez au-dessus des essais-erreurs. Obtenez le plan sur 90 jours qui transforme ces réponses en revenu.

Obtenir ma feuille de route gratuite →

L'aventure, c'est l'ascension

Connaissez le modèle. Construisez maintenant l'entreprise.

Construire ma feuille de route sur 90 jours →
Feuille de route gratuite · 4 minutes · sans carteConstruite autour de votre entreprise — pas un modèle générique