Le nouveau modèle phare d’Anthropic, Claude Opus 5, vise à établir de nouveaux standards en matière de codage et de travail intellectuel, tout en se rapprochant de la performance de Claude Fable 5 à un prix réduit.
Face à la pression des prix exercée par GPT-5.6 Sol et la concurrence en Chine, Anthropic lance Opus 5 pour réduire l’écart de rapport qualité-prix avec le modèle Fable 5, nettement plus coûteux. Ce modèle devient la référence standard sur Claude Max et sera le plus puissant disponible sur Claude Pro.
Les caractéristiques tarifaires restent inchangées avec un coût de 5 dollars par million de tokens d’entrée et de 25 dollars pour les tokens de sortie. Un mode “rapide” est également proposé, augmentant la vitesse de 2,5 fois, mais au coût du double du prix.
| Modèle | Tokens d’entrée | Écriture cache (5 min) | Écriture cache (1 h) | Hits cache & mises à jour | Tokens de sortie |
|---|---|---|---|---|---|
| Claude Fable 5 | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Mythos 5 (disponibilité limitée) | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Opus 5 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
Cependant, le prix des tokens seul ne donne qu’une idée limitée de l’efficacité des modèles, car par exemple, Opus 4.7 pouvait coûter 30 à 40 % de plus par tâche qu’Opus 4.6, même avec un tarif de base identique.
Plus n’est pas toujours mieux
Les utilisateurs peuvent ajuster les réglages d’effort (faible, moyen, élevé, très élevé, max) pour trouver un équilibre entre intelligence et consommation de tokens. Selon Anthropic, Opus 5 offre un meilleur rapport qualité-prix à tous les niveaux d’effort par rapport à son prédécesseur.
Dans son guide de conseils, Anthropic suggère d’utiliser les niveaux “faible” et “moyen” de manière généreuse pour garantir une qualité élevée avec une consommation réduite de tokens et un temps d’attente minimal. Pour des tâches de codage, le niveau “très élevé” demeure la référence recommandée.
De manière intéressante, Opus 5 ne performe pas toujours mieux en réglage maximum ; dans deux benchmarks, il a montré des résultats inférieurs à ceux du deuxième niveau, même si les coûts étaient plus élevés.
Opus 5 surpasse Fable 5 dans le codage agentiel
Selon les propres benchmarks d’Anthropic, Opus 5 établit de nouveaux records dans plusieurs évaluations. Avec 43,3 % sur le benchmark Frontier-Bench v0.1, il surpasse Fable 5 (33,7 %), GPT-5.6 Sol (34,4 %) et Opus 4.8 (21,1 %). Sur d’autres compétences liées au travail intellectuel, Opus 5 affiche également une avance significative.
Malgré cela, Opus 5 n’est pas en tête dans tous les domaines : lors d’évaluations de codage sur DeepSWE v1.1, GPT-5.6 Sol a mené avec 72,7 % devant Fable 5 (69,7 %) et Opus 5 (68,8 %).
Opus 5 développe ses propres outils
Anthropic affirme qu’Opus 5 est désormais capable d’améliorer sa propre production de manière itérative, illustrant cette capacité avec plusieurs exemples pratiques.
Lors d’une tâche de benchmark, Opus 5 a su créer un modèle 3D à partir d’un dessin de pièce mécanique, en écrivant une pipeline de vision par ordinateur pour extraire la géométrie des pixels. Aucun autre modèle n’a réussi cette tâche après plusieurs tentatives.
Sur des cas pratiques, Opus 5 a également démontré une habileté à identifier des erreurs logicielles dans des systèmes open-source avec un succès supérieur à d’autres modèles concurrents.
Des filtres de sécurité moins restrictifs qu’avec Fable 5
Les mesures de sécurité d’Opus 5 permettent d’analyser le code source pour détecter des vulnérabilités, tout en restreignant certaines applications plus intrusives. Les interventions des filtres de cybersécurité sont considérablement réduites par rapport à Fable 5.
Pour la recherche scientifique, Opus 5 est présenté comme le modèle le plus performant à ce jour, avec des améliorations notables dans divers domaines, y compris la chimie organique.
Points à retenir
- Opus 5 cherche à réduire l’écart de prix tout en maintenant des performances similaires à Fable 5.
- Le nouveau modèle propose un mode rapide, augmentant la performance pour un coût supérieurs.
- Les réglages d’effort permettent de trouver un équilibre entre qualité et coût des tokens.
- Opus 5 a établi de nouveaux records dans plusieurs benchmarks, en particulier dans le codage.
- La réduction d’interventions des filtres de sécurité pourra faciliter certains usages.
En somme, l’innovation d’Anthropic avec Opus 5 ouvre des perspectives intéressantes dans le domaine de l’IA. À titre personnel, je trouve fascinant de voir comment un modèle peut non seulement rivaliser avec ses prédécesseurs, mais également innover dans sa manière de résoudre des problèmes complexes. Cela soulève la question de l’avenir de l’IA dans des tâches créatives et analytiques : pourrons-nous un jour compter entièrement sur ces intelligences pour accompagner notre réflexion et notre créativité, ou restera-t-on toujours les maîtres de notre propre inventivité ?
