Ce qu'Anthropic a lancé
Le 24 juillet 2026, Anthropic a lancé Claude Opus 5. En une phrase : le modèle phare se rapproche de Fable 5 sur pas mal de tâches, mais à moitié du coût par tâche, et sans augmenter le prix catalogue.
Les chiffres qui comptent, tout de suite. Prix identique à Opus 4.8 : 5$ par million de tokens en entrée, 25$ en sortie. State-of-the-art sur Frontier-Bench et sur GDPval-AA. Sur ARC-AGI 3 — le test sur les problèmes jamais vus auparavant — il obtient environ trois fois le score du modèle qui le suit. C'est déjà le modèle par défaut sur Claude Max et le plus puissant disponible sur Pro.
Mais la nouvelle qui fait vraiment bouger l'aiguille est ailleurs, et c'est une fonction, pas un benchmark. Elle s'appelle effort dial. Ci-dessous, ce que ça signifie en pratique, quand il vous faut encore un modèle plus grand et comment revoir votre configuration.
L'effort dial : la vraie nouveauté
Jusqu'ici, avec un modèle phare, vous payiez toujours pareil : puissance maximale sur chaque requête, même quand la requête était triviale. Opus 5 introduit une molette. C'est vous qui décidez combien faire "réfléchir" le modèle : effort élevé quand la tâche est complexe, effort bas quand il vous faut juste une réponse rapide.
À effort réduit, Opus 5 conserve l'essentiel de la qualité en consommant beaucoup moins de tokens, donc il coûte et met moins de temps. Traduit pour qui met l'IA en production : vous ne payez plus la Ferrari pour aller chercher le pain. C'est un levier de coût direct, pas un détail de geek. Dans la comparaison Opus 5 vs Opus 4.8, c'est le point qui pèse le plus.
Prix et Fast mode
Le prix catalogue ne change pas : 5$/25$ par million de tokens, comme Opus 4.8. Ce qui change, c'est le coût effectif par tâche, qui baisse grâce à l'effort dial et à un modèle qui gaspille moins pour arriver au résultat.
Il y a aussi un Fast mode : il tourne à environ 2,5 fois la vitesse par défaut, au double du prix de base. Utile quand la latence compte plus que le coût — pensez à un copilote dans un flux où l'utilisateur attend la réponse à l'écran. Si vous voulez estimer la dépense réelle sur vos volumes, le simulateur de prix Claude vous donne un ordre de grandeur en deux minutes.
Recevez les actualités Claude et IA pour les entreprises
Un email quand il y a quelque chose qui vaut la peine d'être lu. Pas de spam.
Vous évaluez Claude pour votre entreprise ? Découvrez combien ça coûte ou quel plan choisir
Combien il est meilleur (et où il ne l'est pas)
Le saut se voit sur le terrain qui pèse le plus aujourd'hui, l'agentique : planifier, utiliser des outils, mener des tâches à terme en autonomie. Sur CursorBench 3.2, à effort maximum, Opus 5 arrive à un demi-point de Fable 5 en payant moitié moins par tâche. Sur OSWorld 2.0, il bat tous les modèles à coût égal. Sur Zapier AutomationBench, il atteint environ 1,5 fois le taux de réussite du deuxième meilleur.
Anthropic le décrit aussi comme "l'Opus le plus aligné" : le score le plus bas sur son audit comportemental, le plus difficile à pousser vers des usages abusifs. Honnêteté intellectuelle, cependant : il reste en retrait par rapport à Mythos 5 sur la recherche biologique et la cybersécurité offensive. Ce n'est pas le modèle pour tout. C'est le modèle phare pour le travail d'entreprise.
Les deux bêtas pour les développeurs
En même temps que le modèle, Anthropic a livré deux fonctions bêta sur l'API qui intéressent qui construit des agents. La première : vous pouvez changer les outils disponibles pour Claude en milieu de conversation sans invalider le cache du prompt. En pratique, un agent peut gagner ou perdre des capacités en cours de route sans repayer le contexte — une économie concrète sur les flux longs.
La seconde : les fallbacks automatiques. Si une requête est bloquée par les classificateurs de sécurité, au lieu d'échouer sèchement elle est routée vers un autre modèle disponible. Moins d'interruptions en production. Ce sont des détails, mais ce sont les détails qui font la différence entre une démo et un agent qui tourne vraiment. On en parle plus en profondeur dans le guide Opus 5 pour le coding.
Ce qui change en pratique pour votre entreprise
Si vous faites déjà tourner Opus 4.8, le passage est presque obligé : même prix, plus de capacité, plus de contrôle sur le coût. Deux choses valent la peine d'être revues.
Premièrement, le routage des modèles : avec l'effort dial, vous pouvez garder Opus 5 sur plus de tâches qu'avant, en baissant l'effort là où vous auriez utilisé un modèle plus petit. Deuxièmement, vos agents : si vous en avez en production, Opus 5 à effort élevé boucle des tâches qui échouaient avant, et à effort bas vous fait économiser sur les tâches simples. Dans les deux cas, mieux vaut remesurer, ne pas tenir pour acquise la configuration d'il y a deux mois. Si vous voulez comprendre où Opus 5 déplace vraiment l'équation coût/qualité, nous avons écrit un guide dédié sur Opus 5 pour les entreprises.
Chez Maverick AI, nous travaillons précisément là-dessus : choisir le bon modèle pour chaque tâche et mettre les agents en production sans brûler le budget. Si vous évaluez comment intégrer Opus 5 dans vos processus, parlons-en.