Mis à jour le 2026-09-10
Claude Opus 5 en faits (24 juil. 2026)
Anthropic a publié Claude Opus 5 le 24 juillet 2026, sous l'ID API claude-opus-5. Le prix annoncé reste identique à Opus 4.8: $5 en entrée et $25 en sortie par million de tokens. Le modèle offre une fenêtre de contexte de 1M tokens et jusqu'à 128k tokens de sortie, avec le thinking activé par défaut.
Le modèle est disponible sur l'API Claude, Amazon Bedrock, Google Cloud (Vertex) et Microsoft Foundry. Le fast mode monte à environ 2,5 fois la vitesse par défaut, au double du prix de base, sur la même logique qu'Opus 4.8.
Le message produit d'Anthropic tient en une phrase: un Opus « de tous les jours » qui se rapproche de Fable 5 sur le coding et le knowledge work, à environ la moitié du coût par tâche dans leurs évaluations internes (Frontier-Bench et CursorBench selon leur annonce). On ne reprend pas leurs classements comme une vérité absolue; on regarde ce que tu dois figer côté équipe.
Effort ladder: le vrai levier coût / qualité
Sur Opus 5, le choix du modèle passe au second plan derrière un nouveau curseur: effort, avec ses cinq niveaux low, medium, high, xhigh et max. Le niveau max reste réservé aux tâches où la capacité prime. Les release notes le disent clairement: l'effort devient le contrôle principal pour piloter le modèle.
Un breaking change mérite une note: désactiver le thinking n'est autorisé qu'à effort high ou moins. Un appel avec thinking: disabled et un effort xhigh ou max renvoie une erreur 400, ce qui change par rapport à Opus 4.8.
En pratique PME, une page de policy modèle suffit:
| Type de tâche | Effort |
|---|---|
| Routine: lint, résumé court, ticket simple | low ou medium |
| Review sensible, migration, debug multi-fichiers | high |
| Cas exceptionnels, avec plafond de tours et un owner | max, rarement |
Sans cette page, tu payes le plafond par défaut sur tout le backlog.
Agents longs: ce qui change, ce qui ne change pas
Anthropic positionne Opus 5 pour les agents long-running: le modèle vérifie mieux son travail, itère et tient un fil multi-étapes. Les retours early access citent le debugging, la recherche de root cause et des workflows métier de bout en bout. C'est utile, mais ça ne justifie pas d'ouvrir un accès complet en prod.
Un modèle plus fort ne change rien au contrat d'approbation, au HITL sur l'auth, le paiement, les PII et le push sur main, ni à la mesure des tokens et du pourcentage de livrables acceptés. Un transcript d'agent ne fait toujours pas une doc d'équipe.
Deux betas plateforme méritent un suivi si tu codes des agents custom. Les mid-conversation tool changes permettent d'ajouter ou de retirer des tools sans casser le prompt cache, derrière le header beta mid-conversation-tool-changes-2026-07-01. Les automatic fallbacks routent vers un autre modèle quand un classifieur de sécurité bloque, au lieu de couper net.
Si ton sujet est plutôt « Claude Code pourrit en session », le guide evergreen Claude Code reste la référence. Cette actu date le delta Opus 5 et la policy d'effort.
Checklist migration PME (1 page)
La migration tient sur une page:
- Inventorie les appels qui hardcodent
claude-opus-4-8(API, Bedrock, Vertex, Foundry, défaut Claude Code) - Mappe l'effort par type de tâche, dans une table de 4-5 lignes
- Pose des plafonds: tokens de sortie, tours d'outils, budget hebdo avec un owner
- Lance des tests de non-régression sur 5-10 workflows critiques, à prompts identiques, en comparant coût et acceptation
- Documente les fallbacks sécu: qui reçoit quoi si un classifieur cyber se déclenche
- Fixe une date de cutover et un ID de modèle de rollback
- Garde une alerte de coût hebdo, pas un dashboard vanity
Les sources sont l'annonce Anthropic Claude Opus 5 et les release notes plateforme du 24 juillet 2026. Relis le system card et le guide de prompting Opus 5 avant de basculer les agents sensibles.
Si vous voulez figer la policy modèle et effort sur un process réel, pas une démo, on peut cadrer en 20-40 minutes.
Questions fréquentes
Quel est le prix de Claude Opus 5 ?
Claude Opus 5 coûte $5 par million de tokens en entrée et $25 en sortie, comme Opus 4.8. Le fast mode double environ le prix de base pour à peu près 2,5 fois la vitesse.
Faut-il migrer tous les agents vers Opus 5 ?
Non. Migre d'abord les workflows où la qualité ou la longueur de session justifie le coût. Garde un modèle plus léger pour le volume trivial, avec une table d'effort par type de tâche.
C'est quoi l'effort ladder ?
C'est le curseur API qui va de low à max pour arbitrer entre intelligence, coût et latence. Sur Opus 5, il devient le contrôle principal, et le thinking ne se désactive qu'à effort high ou moins.
Lien avec Claude Code vs Codex ?
L'actu sur les contrôles et les tokens compare les surfaces d'agents de coding. Ici, on date le modèle Opus 5 et la policy d'effort. Les deux sujets restent distincts.
Où lire l'annonce officielle ?
L'annonce vit sur anthropic.com/news/claude-opus-5 (24 juillet 2026), avec les release notes Claude Platform publiées le même jour.
Sources et repères
- Introducing Claude Opus 5Anthropic
Documentation primaire à consulter pour les caractéristiques et évolutions du produit.



