▲ Guide modèle · publié le 24 juillet 2026 · claude-opus-5
Le curseur est le modèle.
Opus 5 est le premier Claude où la principale chose que vous réglez n'est pas la formulation de votre prompt — c'est l'intensité de l'effort demandé. Une qualité de pointe à 5 $/25 $ par million de tokens, la moitié de Fable 5.
Voici ce qui a vraiment changé, ce qu'il faut supprimer de vos anciens prompts, et les neuf blocs de prompts qui valent la peine d'être gardés.
Compilé à partir de la documentation Opus 5 d'Anthropic et des retours du lancement · Des principes de prompting, pas des impressions.
▲ 01 — les chiffres
Ce que vous achetez.
Même prix qu'Opus 4.8. Environ le double du score sur le benchmark agentique le plus exigeant d'Anthropic.
- Entrée
- 5 $ / M tokens
- Sortie
- 25 $ / M tokens
- Contexte
- 1M par défaut et max
- Sortie max
- 128k tokens
- Thinking
- Activé par défaut
- Mode rapide
- 2,5× à 10 $/50 $
| Benchmark | Résultat | À lire comme |
|---|---|---|
| Frontier-Bench v0.1 | 43,3 % vs 18,7 % (Opus 4.8) | Plus du double, à coût par tâche inférieur |
| CursorBench 3.2 | À 0,5 % de Fable 5 | Moitié prix pour une quasi-parité en code |
| ARC-AGI 3 | 3× le meilleur autre modèle | Un écart de raisonnement inédit, pas un arrondi |
| OSWorld 2.0 (usage ordinateur) | Bat le meilleur score de Fable 5 | À environ un tiers du coût |
| Zapier AutomationBench | ~1,5× le meilleur autre modèle ; 100 % sur les tâches de churn | Automatisation métier réelle, pas des tâches jouets |
| Chimie organique (interne) | +10,2 pts vs 4.8 | Le meilleur Claude généralement disponible pour la science |
| Relectures juridiques (premier jet) | ~2× Opus 4.8 | Premiers jets professionnels, pas de simples plans |
Harvey a rapporté qu'Opus 5 égalait la qualité de sortie d'Opus 4.8 poussé au raisonnement maximal, tout en réduisant l'usage moyen de tokens de 26 %. L'économie n'est pas le prix affiché — c'est qu'un effort plus faible franchit désormais la barre que l'ancien modèle ne franchissait qu'à effort maximal.
▲ 02 — l'échelle d'effort
Choisissez un échelon, puis arrêtez d'ajuster.
L'effort gouverne chaque token de la réponse — thinking, appels d'outils et arguments — pas seulement le raisonnement. Un effort plus faible signifie moins d'appels d'outils, moins de préambule, des confirmations plus courtes.
| Niveau | À utiliser pour | Verdict sur Opus 5 |
|---|---|---|
low | Classification, recherches simples, sous-agents, chat à haut volume | à utiliser librement — nettement plus solide que les anciens niveaux bas d'Opus |
medium | Travail agentique de routine, équilibre coût/vitesse | à utiliser librement — votre principal levier de coût |
high (par défaut) | Raisonnement complexe, la majorité du travail de connaissance | valeur par défaut sûre — identique à l'omission du paramètre |
xhigh | Code, runs d'agents de plus de 30 minutes, recherche approfondie | à privilégier pour le code — recommandation d'Anthropic elle-même |
max | Uniquement les problèmes vraiment à la pointe | à mesurer d'abord — coût élevé, gain faible sur la plupart des tâches |
Dans Claude Code et claude.ai
Tapez /effort xhigh pour une vraie session de code ou un run d'agent ; laissez high pour des modifications rapides et des questions. Passez à medium pour du travail répétitif où la vitesse compte. ultracode dans le menu Claude Code n'est pas un sixième niveau d'API — c'est xhigh plus une autorisation permanente de lancer des workflows multi-agents.
Dans l'API
0 · output_config.effort
{
"model": "claude-opus-5",
"max_tokens": 64000,
"stream": true,
"output_config": { "effort": "xhigh" },
"messages": [{ "role": "user", "content": "..." }]
}À xhigh ou max, réglez max_tokens haut — 64k est un point de départ raisonnable — car cette valeur plafonne le thinking et le texte de réponse ensemble. Et streamez : 64k de sortie peut dépasser la limite de temps du mode non-streaming.
1. L'effort contrôle le volume de thinking, pas la longueur de la réponse visible. Le baisser ne raccourcira pas la réponse — il faut demander la brièveté explicitement. 2. Changer d'effort en cours de conversation invalide votre cache de prompt, car l'effort façonne le prompt rendu. Choisissez un niveau par session. 3. thinking: {"type":"disabled"} à xhigh ou max renvoie une erreur 400. C'est le changement cassant depuis 4.8.
▲ 03 — migration
Les instructions à supprimer.
La chose la plus rentable que vous puissiez faire avec un ancien prompt Opus 4.8, c'est d'en retirer des éléments. Opus 5 fait déjà plusieurs des comportements que votre prompt compensait, et le lui redemander le fait faire deux fois.
| Si votre prompt dit… | Faites ceci | Parce que |
|---|---|---|
| « Inclure une étape de vérification finale » / « utiliser un sous-agent pour vérifier » | delete | Il s'auto-vérifie déjà. L'instruction provoque une sur-vérification et brûle des tokens sans gain de qualité. |
| « Revérifie ta réponse avant de répondre » | delete | Même problème cumulatif — il détecte et corrige déjà ses propres erreurs. |
| « Ne signale que les problèmes de sévérité élevée » (relecture de code) | delete | Il suit cette consigne littéralement et sous-rapporte. Demandez tout, filtrez dans une seconde passe. |
| « Ne réfléchis pas » / « ne raisonne pas » | delete | Augmente le risque de fuite de balises XML internes dans la sortie visible. |
| Contournements de vision calibrés pour les anciens modèles | re-test | La précision sur graphiques, diagrammes et reproduction d'interfaces a fait un bond ; la béquille pourrait maintenant nuire. |
| Niveaux d'effort hérités de 4.8 / 4.7 | re-sweep | Low et medium franchissent désormais des seuils qu'ils ne franchissaient pas avant. Relancez le test sur vos propres évaluations. |
| thinking: {"type":"adaptive"} | keep | Toujours valide, désormais équivalent au défaut. Mais revoyez max_tokens : le thinking compte maintenant dedans. |
Ce qu'il faut ajouter à la place
Les aspérités d'Opus 5 ont toutes la même forme — il en fait plus. Réponses plus longues, documents plus longs, plus de narration, plus de délégation, un périmètre plus large. Chaque prompt ci-dessous réduit l'un de ces excès.
▲ 04 — la bibliothèque de prompts
Neuf blocs à conserver.
À coller dans un system prompt, un CLAUDE.md, ou en tête d'une longue conversation. Chacun cible un comportement précis mesuré, pas une impression.
1 · Concision — produits orientés utilisateur
Keep responses focused, brief, and concise. Keep disclaimers and caveats short, and spend most of the response on the main answer. When asked to explain something, give a high-level summary unless an in-depth explanation is specifically requested.
Les réponses par défaut d'Opus 5 sont plus longues que celles de 4.8. Voici le correctif — ce n'est pas l'effort qui le fait.
2 · Le rappel en fin de prompt
<tone_preference> Keep outputs reasonably concise. </tone_preference>
Dans un long system prompt, associez l'instruction complète en haut à ce court rappel vers la fin.
3 · Cadence de narration pendant les runs d'agent
Before your first tool call, say in one sentence what you're about to do. While working, give a brief update only when you find something important or change direction. When you finish, lead with the outcome: your first sentence should answer "what happened" or "what did you find," with supporting detail after it for readers who want it.
Opus 5 annonce ce qu'il s'apprête à faire, souvent longuement. Décrivez la cadence voulue ; les exemples positifs valent mieux que les interdictions.
4 · Longueur des livrables écrits
Match the length of written documents to what the task needs: cover the substance, but do not pad with filler sections, redundant summaries, or boilerplate.
Les fichiers écrits sur disque — rapports, Markdown, résumés — gonflent indépendamment de la verbosité conversationnelle. C'est un levier distinct.
5 · Contrôle du périmètre
Deliver what was asked, at the scope intended. Make routine judgment calls yourself, and check in only when different readings of the request would lead to materially different work. If the request seems mistaken or a better approach exists, say so in a sentence and continue with the task as asked rather than quietly narrowing, widening, or transforming it. Finish the whole task, and stop short of actions that are clearly beyond what was asked.
Le meilleur bloc généraliste de cette page. Opus 5 appliquera son propre jugement sur ce que la tâche « devrait » être si vous ne tracez pas la ligne.
6 · Plafonner le lancement de sous-agents
Delegate to a subagent only for large tasks that are genuinely independent and parallelizable, such as a wide multi-file investigation. Do not delegate work you can finish yourself in a handful of tool calls, and do not use subagents to verify or double-check your own work. If one subagent can complete the task, use one rather than several, and keep spawn counts low.
La délégation multiplie coût et temps réel sur les petites tâches. Opus 5 y a recours plus volontiers que 4.8.
7 · Arrêter de narrer les corrections
Only correct an earlier statement when the error would change the user's code, conclusions, or decisions. State corrections plainly and briefly, then continue the task. For slips that change nothing for the user, make the fix and move on without noting it.
L'auto-correction est une fonctionnalité ; la narrer à chaque fois pour un client n'en est pas une.
8 · Relecture de code exhaustive
Review this change and report every issue you find, including low-severity ones and anything you are only moderately confident about. Do not filter for severity — I will triage in a separate pass. For each finding give the file and line, a one-sentence statement of the defect, and a concrete failure scenario with inputs and the wrong result.
Précision et rappel sont élevés chez Opus 5, et la justesse tient même à effort réduit — faites donc une passe rapide en medium au moment de la relecture, puis une passe approfondie en xhigh plus tard.
9 · Si vous devez désactiver le thinking
You may say a brief sentence before using a tool. Do not include internal or system XML tags in your response.
Thinking désactivé, Opus 5 écrit parfois un appel d'outil en texte brut (qui ne s'exécute jamais et empoisonne les tours suivants) ou laisse fuiter des balises. Ces deux lignes atténuent les deux problèmes. Mieux : gardez le thinking activé et baissez plutôt l'effort.
▲ Neuf prompts, c'est un début, pas un système
Le prompting n'est pas une stratégie. Vouloir un plan sur 90 jours qui fait tourner toute votre entreprise sur l'IA, ça en est une.
Construire ma feuille de route IA sur 90 jours →▲ 05 — routage
Sur quoi le pointer.
Là où le modèle justifie son prix, et là où un modèle moins cher ferait aussi bien l'affaire.
Donnez-lui toute la spécification, puis partez
Opus 5 est le plus fort sur les fonctionnalités multi-fichiers, les gros refactors et le travail de bout en bout, et il termine au lieu de laisser des ébauches et des TODO. Donnez la spécification complète d'emblée plutôt que de distiller les étapes.
Relecture de code à deux vitesses
Un taux élevé de vrais bugs par passe, avec des trouvailles supplémentaires majoritairement réelles. La justesse tient même à effort bas — faites donc une passe économique au moment du commit et une passe approfondie avant la sortie.
Vision avec outils, pas seulement du thinking
Graphiques, documents denses, diagrammes, reproduction d'interfaces. Donnez-lui bash et des outils de recadrage pour qu'il puisse inspecter et vérifier visuellement — c'est plus efficace que de miser tout le budget sur le seul thinking.
Le million de tokens en entier
Le contexte de 1M est à la fois le défaut et le maximum, et le suivi des instructions, les appels d'outils et le raisonnement restent constants sur toute la fenêtre. Le travail sur des dépôts entiers ou des salles de données complètes est possible.
Tableurs et présentations
Classeurs multi-feuilles avec des formules non triviales, et des diapositives bien structurées. Il suivra un modèle maison — mais seulement si vous lui en fournissez un.
Orchestration
Les équipes de sous-agents rédacteur-vérificateur tiennent bien, avec peu d'agents qui se marchent dessus. Plafonnez le nombre d'agents pour le coût, pas pour la justesse.
▲ 06 — discrètement utile
Quatre changements absents des gros titres.
Le minimum du cache de prompt tombe à 512 tokens (contre 1 024). Les system prompts courts qui ne pouvaient jamais être mis en cache sur 4.8 le peuvent désormais, sans changer de code.
Changement d'outils en cours de conversation (bêta). Ajoutez ou retirez des outils entre les tours sans invalider le cache — en-tête mid-conversation-tool-changes-2026-07-01.
Mode de repli par défaut (bêta). fallbacks: "default" route les refus par catégorie vers les alternatives recommandées par Anthropic au lieu d'une liste que vous devez maintenir — en-tête server-side-fallback-2026-07-01.
Mode rapide. 2,5× le débit au double du tarif (10 $/50 $), uniquement via l'API Claude — pas encore sur Bedrock, Google Cloud ni Microsoft Foundry.
Fondateur —
Vous savez désormais faire tourner Opus 5 : le curseur d'effort, ce qu'il faut retirer de vos prompts, les neuf blocs qui tiennent face à de vrais délais.
Le prompting, c'est les 20 % faciles. Les 80 % restants, c'est décider où pointer le modèle en premier, dans quel ordre, dans une entreprise qui doit encore payer les salaires. C'est la partie qu'on construit avec vous — une feuille de route sur 90 jours, pas un pack de prompts de plus.
— Italo
Les outils changent. Les principes de prompting non.
— pourquoi ce guide ne sera pas obsolète le mois prochain
▲ Des réponses franches · sans esbroufe
▲ 07 — des réponses franches
Les questions que tout le monde se pose.
Pas tout à fait, et c'est bien là l'intérêt. Opus 5 arrive à 0,5 % de Fable 5 sur CursorBench 3.2 et le bat sur OSWorld (usage d'ordinateur), pour moitié moins cher, voire un tiers du coût. Fable 5 garde l'avantage sur les tâches longues, multi-jours et ambiguës. Si une tâche prend des heures ou des jours à un humain et que personne ne l'a encore résolue, c'est pour Fable. Tout le reste, c'est Opus 5.
▲ Encore des questions sur la mise en pratique dans votre entreprise
Passez au-dessus des essais-erreurs. Obtenez le plan sur 90 jours qui transforme ces réponses en revenu.
Obtenir ma feuille de route gratuite →▲ L'aventure, c'est l'ascension