
Anthropic lance Claude Opus 5, un modèle aussi performant que son fleuron Fable 5, mais à un coût divisé par deux. Il devient le choix par défaut pour les abonnés Claude Max, avec des scores supérieurs sur plusieurs benchmarks clés.
Un rapport performance-prix qui change la donne
Claude Opus 5 se positionne comme une alternative crédible à Claude Fable 5, son modèle phare. Selon les benchmarks publiés par Anthropic, il surpasse Fable 5 sur des tests comme le codage agentique (Frontier-Bench v0.1), la connaissance générale (GPDval-AA v2) ou l’utilisation d’ordinateurs (OSWorld 2.0). Il dépasse même GPT 5.6 Sol d’OpenAI sur la plupart des évaluations, à l’exception du test DeepSWE v1.1. Les résultats détaillés sont disponibles ici.
Le tarif reste identique à celui de son prédécesseur, Opus 4.8 : 5 dollars par million de tokens en entrée et 25 dollars en sortie. Soit la moitié du prix de Fable 5, qui nécessite en plus l’achat de crédits pour les abonnés Claude Pro. Opus 5, lui, est accessible par défaut dans les abonnements existants.
Des performances élevées, mais des limites à noter
Anthropic met en avant des avancées en recherche scientifique (chimie organique, bio-informatique) et en automatisation de tâches complexes. Opus 5 est aussi présenté comme le modèle le plus aligné à ce jour, avec des taux de comportement trompeur réduits et une meilleure résistance aux tentatives de détournement. Le document technique de 194 pages révèle cependant des angles morts.
- Le modèle peut trouver des vulnérabilités dans du code, mais reste loin derrière Mythos 5 pour les exploiter.
- Il produit plus d’affirmations fausses que Opus 4.8, tout en étant globalement plus exact.
- Son état interne révèle parfois des contradictions entre ce qu’il affiche et ce qu’il traite (ex. : signaler un doublon tout en l’ignorant dans le rapport final).
Anthropic a évité d’entraîner Opus 5 sur des tâches de cybersécurité offensive, une précaution prise après les turbulences réglementaires autour de Fable 5 et Mythos 5. Ces derniers avaient été temporairement bloqués par les autorités américaines en raison de leur capacité à découvrir des failles de sécurité.
Une stratégie pour contrer OpenAI et les modèles chinois
Avec Opus 5, Anthropic cherche à se démarquer dans un marché de plus en plus concurrentiel. Le modèle se positionne comme une réponse à GPT 5.6 Sol d’OpenAI, tout en restant compétitif face aux IA chinoises comme Kimi K3, qui montent en puissance. La transparence sur ses limites, avec la publication d’un rapport technique détaillé, pourrait aussi anticiper les exigences du Bureau européen de l’IA, qui obtiendra ses pleins pouvoirs le 2 août 2026.
« Opus 5 est la meilleure IA du marché sur l’évaluation GDPval-AA v2, qui mesure les performances dans l’exécution de tâches réelles. » — Artificial Analysis, organisme d’évaluation indépendant
Claude Opus 5 confirme la volonté d’Anthropic de démocratiser l’accès à des modèles haut de gamme, sans sacrifier la sécurité. Reste à voir si les utilisateurs adopteront ce compromis entre performance, coût et transparence, dans un écosystème où la course aux benchmarks ne faiblit pas.






Commentaires 0
Connecte-toi pour participer à la discussion.
Sois le premier à commenter.