Anthropic a dévoilé Claude Opus 5, un nouveau modèle d'IA qui, selon la société, offre une intelligence proche de la frontière pour environ la moitié du prix de son modèle haut de gamme Fable 5. Sorti le 24 juillet 2026, Opus 5 est désormais le modèle par défaut sur Claude Max et le modèle le plus puissant disponible sur Claude Pro, le positionnant comme le cheval de bataille quotidien d'Anthropic pour le codage, les agents autonomes et le travail de connaissances professionnelles.
Le lancement arrive à un moment où les entreprises scrutent les dépenses en IA. Selon CNBC, le nouveau modèle « rivalise avec Fable 5 et est moins cher car les entreprises s'inquiètent des coûts », tandis que Bloomberg le qualifie de « modèle plus rentable pour les tâches quotidiennes ». Pour les équipes qui suivent les derniers développements de l'IA, Opus 5 représente un pari délibéré que le prochain champ de bataille compétitif est la valeur, et non la suprématie brute des références.
Performance de référence : nouvel état de l'art en matière de codage et de travail de connaissances
Anthropic rapporte qu'Opus 5 publie des résultats de pointe sur les évaluations de codage et de travail de connaissances, notamment Frontier-Bench et GDPval-AA. Sur Frontier-Bench v0.1, la société affirme que l'Opus 5 surpasse tous les autres modèles et fait plus que doubler les performances de son prédécesseur, l'Opus 4.8, à un coût par tâche inférieur.
Sur CursorBench 3.2, Opus 5 se situe à 0,5 % du score maximum de Fable 5 tout en coûtant deux fois moins cher par tâche, selon les propres benchmarks d'Anthropic. Decrypt a noté que le modèle « surpasse Fable 5 sur la plupart des benchmarks – à moitié prix ».
Les gains s'étendent aux évaluations agentiques et de résolution de problèmes :
- ARC-AGI 3 : L'Opus 5 obtient des résultats environ trois fois supérieurs à ceux du deuxième meilleur modèle à ce nouveau test de résolution de problèmes.
- Zapier AutomationBench : Un taux de réussite environ 1,5 fois supérieur à celui du deuxième meilleur modèle pour le même coût, mesurant l'achèvement des tâches commerciales de bout en bout.
- OSWorld 2.0 (utilisation sur ordinateur) : L'Opus 5 surpasse le meilleur résultat de Fable 5 à un peu plus d'un tiers du coût.
Anthropic reconnaît notamment qu'Opus 5 « reste derrière Mythos 5 sur les tâches de cybersécurité », un domaine dans lequel un modèle frontière rival conserve la tête.
Agence et auto-vérification plus fortes
Un thème récurrent dans l'annonce est la capacité améliorée de l'Opus 5 à vérifier son propre travail et à itérer jusqu'à ce qu'il réussisse. Anthropic a décrit plusieurs exemples de tests à accès anticipé qui mettent en évidence cette autonomie.
Dans une tâche Frontier-Bench, le modèle a reçu un dessin d'une pièce de machine et a été invité à écrire du code pour la reconstruire sous forme de modèle FreeCAD 3D - mais n'a délibérément eu aucun moyen de visualiser directement le dessin. Opus 5 aurait écrit son propre pipeline de vision par ordinateur pour extraire la géométrie des pixels bruts, puis reconstruit la partie complète, réussissant à plusieurs reprises là où aucun modèle concurrent ne pouvait résoudre la tâche après cinq tentatives.
Étant donné un véritable bug dans un gestionnaire de paquets open source populaire, Opus 5 a trouvé la cause première et corrigé un cas critique que le propre correctif de la communauté avait manqué, alors qu'un modèle concurrent ne corrigeait que le symptôme superficiel et déclarait le bug résolu. Un ingénieur d'une société commerciale aurait utilisé Opus 5 pour créer un flux de données de marché pour une nouvelle bourse en une seule session – une tâche que les modèles précédents ne pouvaient pas accomplir du tout – et, ne trouvant aucun flux en direct pour valider, le modèle a construit son propre harnais de test.
Réception client
Les partenaires d'accès anticipé ont offert des évaluations largement positives. Scott Wu, PDG de Cognition (fabricant de l'agent de codage Devin), a déclaré que l'Opus 5 « s'approche des performances de niveau Fable à moitié prix » et montre « une force particulière dans les tâches difficiles de débogage et d'analyse des causes profondes ». Sualeh Asif, co-fondateur de Cursor, a déclaré que le modèle offre « une intelligence proche de celle de Fable 5 à la vitesse et au coût Opus ».
Wade Foster, PDG de Zapier, a rapporté que l'Opus 5 "est en tête du classement AutomationBench de Zapier sans dépenser plus de jetons que les modèles Claude précédents", complétant de bout en bout un flux de travail complet de prévention du désabonnement - signalant les comptes à risque, alertant le bon propriétaire et résumant pour les équipes de fidélisation. Les modèles précédents n’ont pas réussi ; L'opus 5 a atteint 100%.
Gains dans la recherche scientifique
Anthropic a également souligné les améliorations de l'Opus 5 pour le travail scientifique. Le modèle surpasse Opus 4.8 dans chacune des évaluations des sciences de la vie d'Anthropic, couvrant la biologie structurale, la chimie organique et la bioinformatique. La société a souligné une amélioration de 10,2 points de pourcentage par rapport à un benchmark interne de chimie organique (déduisant les structures moléculaires à partir des données de spectroscopie) et un gain de 7,7 points sur les tâches de prédiction de la fonction des protéines. Un client du secteur de la génomique a décrit le modèle comme se comportant « davantage comme un scientifique attentif », recherchant les bons tests statistiques et recoupant ses propres résultats.
La stratégie de tarification
En fixant le prix de l'Opus 5 au même niveau que celui de l'Opus 4.8 tout en se rapprochant de l'intelligence de Fable 5, Anthropic réduit efficacement l'écart entre ses offres milieu de gamme et phare. VentureBeat a présenté la version comme « un modèle d'IA moins cher pour le codage, les agents et les flux de travail d'entreprise », et Seeking Alpha a observé que l'Opus 5 est « plus proche et moins cher du modèle frontière Fable 5 ». La société propose un paramètre « d'effort » réglable qui permet aux clients d'échanger des informations contre de la vitesse et des coûts de jetons inférieurs, en ajustant ainsi le rapport coût/performance par tâche.
Ce que cela signifie pour la course à l'IA
L’opus 5 souligne la rapidité avec laquelle le coût de l’IA proche des frontières diminue. Un modèle qui se rapproche des systèmes les plus performants disponibles – à la moitié du prix symbolique – pousse les concurrents à justifier des prix plus élevés pour des gains marginaux. Alors qu'Anthropic, OpenAI, Google et d'autres s'efforcent de créer des modèles performants suffisamment abordables pour un déploiement quotidien à grande échelle, la question pour les entreprises passe de « quel modèle est le plus intelligent ? à « quel modèle offre le plus d'intelligence par dollar ? »
Pour Anthropic, le message est clair : le raisonnement haut de gamme n’est plus un produit de luxe. L’Opus 5 apporte une capacité adjacente à la frontière à un prix qui rend réaliste un déploiement quotidien soutenu – et cela pourrait s’avérer être le détail le plus important de tous.
Gardez une longueur d'avance sur l'IA
Claude Opus 5 est disponible dès aujourd'hui sur Claude Pro, Claude Max, et via l'API d'Anthropic. Pour en savoir plus sur cette histoire et sur le paysage plus large de l’intelligence artificielle, restez au courant des dernières actualités sur l’IA au fur et à mesure.
Lire plus d'actualités sur l'IA →