Anthropic a publié Claude Opus 5 le 24 juillet 2026, deux mois après Opus 4.8. Le modèle garde exactement le même tarif que son prédécesseur, 5 $ le million de tokens en entrée et 25 $ en sortie, tout en approchant les scores de Claude Fable 5 pour environ deux fois moins cher par tâche. Voici ce qui change concrètement, les chiffres officiels, et les deux points à vérifier avant de migrer.

Où se situe Opus 5 dans la gamme Claude
Opus 5 prend la place d’Opus 4.8 comme modèle Opus de référence : c’est le niveau que vous choisissez quand la tâche demande de la profondeur, du raisonnement multi-étapes ou un agent qui travaille longtemps sans supervision. Opus 4.8 reste accessible par l’API pour ceux qui ne veulent pas bouger tout de suite.
Au-dessus, Claude Fable 5 reste le modèle le plus capable du catalogue. La nouveauté, c’est que l’écart s’est considérablement resserré, alors que Fable 5 coûte toujours deux fois plus cher. Si vous hésitez entre les quatre familles, notre guide sur quel modèle Claude choisir reprend la logique complète.
Les benchmarks, chiffre par chiffre
Anthropic publie ses résultats sous forme de courbes coût et performance plutôt que de barres, ce qui a le mérite de montrer le prix réel de chaque niveau d’effort.
Codage agentique
Sur Frontier-Bench v0.1, mesuré avec le harnais mini-SWE-agent et une moyenne sur cinq tentatives par tâche, Opus 5 culmine près de 44 % pour environ 14 $ la tentative. Opus 4.8 plafonne à 19 % en dépensant davantage, autour de 17 $. Le doublement annoncé se vérifie donc, et à coût inférieur.
Sur CursorBench, le résultat le plus commenté depuis l’annonce : à effort maximal, Opus 5 obtient 70,1 quand Fable 5 obtient 70,4. Trois dixièmes de point d’écart, pour environ 8 $ par tâche au lieu de 17 $. Opus 4.8 reste huit points en dessous, à 62,3.
Une nuance honnête pour finir : sur l’index indépendant Coding Agent d’Artificial Analysis, la hiérarchie se resserre nettement, Opus 5 pointant à 66,7 contre 66,6 pour GPT-5.6 Sol. Un écart qui tient dans la marge d’erreur.
Problèmes inédits et pilotage d’ordinateur
C’est là que le fossé se creuse le plus. Sur ARC-AGI-3, qui mesure la résolution de problèmes jamais vus, Opus 5 en effort high atteint environ 30 %, quand Opus 4.8 reste sous les 2 % et que GPT-5.6 Sol plafonne autour de 8 %.
Sur OSWorld 2.0, qui teste le pilotage d’un ordinateur, Opus 5 devance tous les modèles testés et atteint le résultat de Fable 5 pour un tiers du coût. Sur Zapier AutomationBench, qui mesure des tâches métier menées de bout en bout, il obtient environ 1,5 fois le taux de réussite du meilleur concurrent à coût par tâche identique.
Tarifs API, au moment où nous écrivons
C’est le point le plus simple de cette sortie : rien ne bouge. Opus 5 est facturé 5 $ le million de tokens en entrée et 25 $ en sortie, exactement comme Opus 4.8. La fenêtre de contexte reste à 1 million de tokens, et la sortie plafonne à 128 000 tokens.
Deux éléments jouent sur la facture réelle. Le seuil minimal du cache de prompt descend de 1 024 à 512 tokens, ce qui fait entrer dans le cache des préfixes qui payaient plein tarif jusqu’ici, sans changer une ligne de code. Et le fast mode, qui double le tarif à 10 $ et 50 $ pour un débit de sortie jusqu’à 2,5 fois supérieur, reste réservé à l’API Claude : ni Amazon Bedrock, ni Google Cloud, ni Microsoft Foundry ne le proposent.
Attention aussi aux quotas : ceux d’Opus 5 forment un pool séparé de celui que se partagent les modèles Opus 4.x. Basculer votre trafic ne libère aucune marge sur l’ancien pool et n’en hérite pas non plus. Pour le détail des abonnements et de la facturation à l’usage, voyez notre page sur combien coûte Claude.
Ce qui change sur claude.ai et Claude Code
Si vous passez par l’interface plutôt que par l’API, il n’y a rien à faire : Opus 5 est déjà déployé sur claude.ai, dans Claude Code et dans Claude Cowork. Vous le trouverez dans le sélecteur de modèle à la place d’Opus 4.8.
Le point le plus visible au quotidien est ailleurs : Opus 5 rédige plus long que ses prédécesseurs, et baisser le niveau d’effort ne raccourcit pas le texte visible de façon fiable. Si vous tenez à des réponses courtes, la consigne doit passer par le prompt ou par vos préférences, pas par un réglage technique.
Migrer depuis Opus 4.8 : les deux pièges
Changer l’identifiant du modèle pour claude-opus-5 ne suffit pas tout à fait. Deux comportements changent.
Le premier est le plus sournois : le raisonnement est actif par défaut sur Opus 5, alors qu’une requête sans paramètre thinking ne raisonnait pas sur Opus 4.8. Comme max_tokens plafonne le raisonnement et le texte de réponse ensemble, un appel calibré au plus juste se fait couper en pleine phrase. Vérifiez vos max_tokens avant tout le reste.
Le second : couper le raisonnement n’est autorisé qu’à un effort high ou en dessous. La combinaison thinking désactivé avec xhigh ou max renvoie une erreur 400, et la vérification se fait requête par requête. Les cinq niveaux vont de low à max, avec high par défaut, et Anthropic conseille xhigh pour le code et l’agentique.
Un retour d’expérience concret et les questions que se posent d’autres lecteurs sont dans le sujet de forum consacré à la migration d’Opus 4.8 vers Opus 5. Si vous n’avez jamais appelé l’API, commencez plutôt par notre guide sur votre premier appel à l’API Claude.
Quand préférer Fable 5 à Opus 5
Fable 5 garde l’avantage sur les tâches les plus exigeantes et les sessions d’agent les plus longues. Mais deux contraintes disparaissent en passant à Opus 5, et elles pèsent lourd en entreprise.
Opus 5 n’impose aucune durée de rétention de données, là où Fable 5 exige 30 jours, ce qui bloquait les organisations en rétention zéro. Et ses classifiers de sécurité se déclenchent environ 85 % moins souvent, ce qui compte si vos usages touchent à la sécurité défensive, aux sciences du vivant ou à de l’outillage réseau. Les blocages restent ciblés : l’analyse de vulnérabilités sur du code source passe, la génération d’exploits à partir de binaires reste bloquée.
En pratique, pour de la revue de code ou du développement au quotidien, l’écart de trois dixièmes de point sur CursorBench ne se voit pas, et la facture est divisée par deux. Fable 5 se justifie sur les cas où la qualité prime totalement sur le coût. Pour comparer avec le niveau en dessous, voyez notre analyse de ce que vaut Claude Sonnet 5.
Le détail complet des évaluations et des nouveautés d’API figure dans l’annonce officielle d’Anthropic.