Anthropic lance Claude Opus 5, une IA quasi-frontière à moitié prix

Anthropic a publié Claude Opus 5 le 24 juillet 2026, son quatrième modèle en deux mois, mais celui-ci est différent des autres. Là où Fable 5 et Mythos 5 repoussent la frontière absolue des capacités à des prix premium, Opus 5 est conçu pour être le modèle que les équipes utilisent réellement chaque jour, et les benchmarks suggèrent qu’Anthropic a peut-être réussi son pari.

À 5 dollars par million de tokens d’entrée et 25 dollars par million de tokens de sortie, soit le même prix que l’ancien Opus 4,8, le nouveau modèle offre des performances qui rivalisent avec Fable 5 sur plusieurs évaluations clés. Sur Frontier-Bench v0.1, un test de codage agentique, Opus 5 a obtenu 43,3 %, battant les 33,7 % de Fable 5 et les 34,4 % de GPT-5.6 Sol. Sur ARC-AGI-3, qui mesure la résolution de problèmes inédits, il a atteint 30,2 %, soit environ quatre fois le score du concurrent le plus proche. Sur OSWorld 2.0, un test de capacités d’utilisation d’ordinateur, il a surpassé Fable 5 pour un peu plus d’un tiers du coût par tâche.

Les chiffres phares masquent une histoire plus intéressante sur la façon dont Anthropic envisage le déploiement. Opus 5 est livré avec un cadran de contrôle d’effort, bas, moyen ou élevé par requête, qui permet aux utilisateurs d’échanger la profondeur du raisonnement contre la vitesse et le coût. Une tâche de saisie de données courante peut fonctionner avec un effort faible pour économiser les tokens, un problème d’architecture complexe peut monter au maximum. Il s’agit d’une approche flexible qui reconnaît que la plupart des charges de travail de production n’ont pas besoin d’un raisonnement maximal à chaque appel.

Architecture de sécurité : un repli, pas un blocage strict

Le système de sécurité introduit un choix architectural novateur : lorsque les garde-fous d’Opus 5 signalent une requête comme potentiellement problématique, comme une invite impliquant une analyse de vulnérabilités binaires ou la génération d’exploits, le système peut automatiquement basculer vers Opus 4,8 plutôt que de rejeter la requête purement et simplement. Cela préserve le flux de travail de l’utilisateur tout en routant les opérations à haut risque vers un modèle aux capacités offensives moins avancées.

We believe news should be guided by evidence, not sensationalism. Your support helps make that possible.

Soutenir 1ban.news

Anthropic décrit Opus 5 comme son « modèle le plus aligné à ce jour » sur la base de tests comportementaux automatisés, avec un taux de comportement trompeur inférieur à celui des versions récentes. Dans les tâches de cybersécurité offensive, il suit le Mythos 5 spécialisé mais l’égale dans l’identification des vulnérabilités.

Auto-correction et le cadran d’effort

Anthropic met en avant une capacité qui pourrait s’avérer la plus importante pour les utilisateurs professionnels : l’auto-correction. Dans des démonstrations internes, Opus 5 a détecté des erreurs d’exécution en cours de tâche et a construit ses propres solutions de contournement, construisant dans un cas un pipeline de vision par ordinateur à partir de zéro pour extraire la géométrie de pixels bruts lorsque le modèle ne pouvait pas visualiser directement un objet. Les modèles concurrents ont échoué après cinq tentatives dans des conditions identiques.

Le modèle prend en charge l’ensemble des fonctionnalités pour développeurs d’Anthropic, notamment le changement d’outils en cours de conversation sans invalider les caches de prompt, et la capacité de router automatiquement les requêtes API signalées vers un autre modèle. Il est le modèle par défaut des abonnés Claude Max et l’option la plus puissante disponible pour les utilisateurs de Claude Pro.

Traduit par Lydie

Sources: « Claude Opus 5 delivers top coding scores at half the per-task cost » (Interesting Engineering, 24 juil. 2026) ; « Anthropic Introduces Claude Opus 5 » (TheWinCentral, 24 juil. 2026) ; annonce officielle d’Anthropic

Scroll to Top