Anthropic a lancé Claude Opus 5 aujourd'hui, 24 juillet 2026. L'argument n'est pas de battre OpenAI ou Google, mais de s'approcher de Fable 5, son propre modèle le plus puissant, pour moitié moins cher. Le tarif reste identique à celui d'Opus 4.8 qu'il remplace : 5 dollars en entrée et 25 en sortie par million de tokens. Il devient le modèle par défaut sur Claude Max et le plus performant accessible sur Claude Pro.
Il y a une phrase qui résume ce lancement mieux que n'importe quel benchmark : cette fois, Anthropic ne cherche pas à battre ses concurrents, mais son propre haut de gamme sur le terrain du prix. C'est un changement de discours notable, et il en dit long sur la phase dans laquelle est entrée la course à l'IA. Décryptons.
Ce qui sort aujourd'hui
Claude Opus 5 est disponible immédiatement sur l'ensemble des plateformes d'Anthropic : Claude.ai, la plateforme pour développeurs, Claude Code et Claude Cowork. Il devient le modèle par défaut sur l'abonnement Claude Max et le modèle le plus puissant accessible aux abonnés Claude Pro.
Le tarif est le point central de l'annonce : 5 dollars par million de tokens en entrée et 25 dollars en sortie, exactement le prix d'Opus 4.8. À titre de comparaison, Fable 5, lancé en juin, est facturé 10 dollars en entrée et 50 en sortie. D'où la formule d'Anthropic : approcher l'intelligence de pointe de Fable 5 pour la moitié du prix.
Deux ajouts techniques accompagnent la sortie. Un mode rapide, environ 2,5 fois plus véloce que le réglage par défaut, mais facturé le double. Et surtout une molette d'effort, qui permet d'arbitrer entre qualité de sortie, vitesse de réponse et consommation de tokens. On retrouve ici le mécanisme que nous avons expliqué dans notre article sur les modèles de raisonnement : plus un modèle réfléchit, meilleur il est, mais plus il coûte cher.
Les chiffres annoncés
Anthropic met en avant les tests de code et de travail de connaissance plutôt que les classements de raisonnement habituels, ce qui trahit sa cible : les usages qui apparaissent sur les factures des entreprises.
| Test | Ce qu'il mesure | Résultat annoncé |
|---|---|---|
| ARC-AGI-3 | Résolution de problèmes inédits | 30,2%, soit environ 3 fois le modèle suivant |
| CursorBench 3.2 | Code assisté | À 0,5% du score maximal de Fable 5, pour moitié moins cher par tâche |
| Zapier AutomationBench | Mener une tâche métier jusqu'au bout | Environ 1,5 fois le taux de réussite du concurrent le plus proche à coût égal |
| OSWorld 2.0 | Usage autonome d'un ordinateur | Dépasse le pic de Fable 5 avec environ un tiers du budget |
Les gains dépassent le code. Anthropic annonce des progrès sur toutes ses évaluations en sciences du vivant, avec un bond de plus de dix points en chimie organique, notamment sur la lecture de structures moléculaires à partir de données de spectroscopie.
Un témoignage de client en accès anticipé donne une idée plus concrète de ce que ça change au quotidien. Le responsable de la recherche appliquée chez Harvey, une entreprise d'IA juridique, rapporte qu'Opus 5 a égalé la qualité d'Opus 4.8 poussé à son raisonnement maximal, tout en réduisant la consommation moyenne de tokens de 26%.
Comme pour tout lancement, ces résultats sont publiés par Anthropic elle-même et n'ont pas encore été audités par des tiers indépendants. Ils indiquent une tendance, pas une vérité gravée. C'est le réflexe que nous recommandons systématiquement dans notre article sur les benchmarks : regarder qui a mesuré avant de regarder le score.
La molette d'effort, l'innovation qui compte vraiment
Derrière les benchmarks, la nouveauté la plus structurante est probablement la molette d'effort. Jusqu'ici, choisir un modèle revenait à choisir un niveau de qualité et à subir le coût correspondant. Avec un réglage d'effort, la même entreprise peut décider tâche par tâche combien elle est prête à dépenser en réflexion.
Ce n'est pas un détail cosmétique. C'est une réponse directe à la plainte la plus fréquente des acheteurs professionnels d'IA ces derniers mois : l'imprévisibilité des factures. Un agent qui tourne en boucle sur des milliers de tâches peut voir son coût exploser sans que personne ne comprenne pourquoi. Pouvoir plafonner l'effort transforme une dépense subie en dépense pilotée.
Ce qu'Anthropic reconnaît ne pas être
Un point mérite d'être souligné, parce qu'il est rare dans une annonce commerciale. Anthropic précise explicitement qu'Opus 5 n'est pas son modèle le plus avancé sur les capacités à double usage, comme la cybersécurité offensive et la recherche en biologie. Sur ces terrains, Mythos 5 reste devant.
De même, pour les tâches autonomes les plus longues, l'entreprise indique que Fable 5 demeure le meilleur choix. Opus 5 est positionné comme un modèle de travail quotidien professionnel, pas comme le champion absolu de toutes les catégories. Cette clarté dans la segmentation est appréciable, à une époque où chaque lancement prétend généralement écraser tout le reste.
Sur le plan du comportement, Anthropic annonce que son audit automatisé place Opus 5 au plus bas niveau qu'elle ait mesuré sur son échelle de comportements désalignés. L'entreprise indique par ailleurs poursuivre sa collaboration avec les agences gouvernementales dans ses phases de test avant déploiement, y compris pour Opus 5. Une précision qui n'a rien d'anodin après l'épisode de la suspension de Fable 5 et Mythos 5 en juin.
Ce que ce lancement révèle
Opus 5 est le quatrième modèle publié par Anthropic en moins de deux mois, après Mythos 5, Fable 5 et Sonnet 5. Ce rythme est en soi une information : la concurrence ne laisse plus le temps de souffler.
Mais le vrai signal est ailleurs. Pendant deux ans, la course à l'IA se jouait sur la capacité brute, chaque laboratoire cherchant à décrocher la première place d'un classement. Ce lancement raconte autre chose : la bataille se déplace vers l'économie de l'usage quotidien. Ce qui compte désormais n'est plus seulement quel est le modèle le plus intelligent, mais combien coûte une tâche accomplie. C'est exactement la logique que nous observions à propos de la stratégie d'Anthropic face à OpenAI, et c'est aussi ce qui pousse Google à baisser ses prix et les laboratoires chinois à inonder le marché de modèles ouverts très compétitifs.
Pour l'utilisateur, cette évolution est une excellente nouvelle. Quand un nouveau modèle arrive avec de meilleures performances au même prix, ou avec la qualité du haut de gamme pour moitié moins cher, c'est le signe d'un marché où la concurrence fonctionne. La question intéressante, désormais, n'est plus de savoir qui aura le modèle le plus puissant dans six mois, mais lequel rendra cette puissance abordable au point qu'on cesse d'y réfléchir avant de lancer une tâche.