Claude Opus 5 devient le nouveau modèle haut de gamme d’Anthropic pour le code et les agents IA. Il promet des performances proches de Fable 5 pour un tarif divisé par deux.
Anthropic a officiellement lancé Claude Opus 5 le 24 juillet 2026. Disponible dès aujourd’hui, le modèle remplace Opus 4.8 dans le haut de la gamme accessible au grand public et vise les tâches complexes qui exigent du raisonnement, des outils et de longues phases de vérification.
Claude Opus 5 vise le meilleur rapport entre intelligence et coût
Opus 5 n’est pas présenté comme le modèle le plus puissant jamais développé par Anthropic. Cette place reste occupée par Claude Fable 5, tandis que Mythos 5 demeure réservé à certaines organisations dans le cadre du Project Glasswing. Anthropic cherche plutôt à proposer une intelligence proche de Fable 5 dans un modèle moins cher, plus rapide et moins contraignant au quotidien.
Selon l’annonce officielle d’Anthropic, Opus 5 atteint des performances proches de Fable 5 sur plusieurs évaluations de programmation. Sur CursorBench 3.2, avec le niveau d’effort maximal, le nouveau modèle se situerait à seulement 0,5 % du meilleur résultat de Fable 5, tout en coûtant deux fois moins cher par tâche.

Cette comparaison doit néanmoins être interprétée avec prudence. Les graphiques publiés par Anthropic reposent principalement sur ses propres exécutions ou sur les benchmarks de partenaires qui utilisent déjà Claude. Les résultats donnent une indication sur les progrès du modèle, mais ils ne remplacent pas des tests indépendants menés sur des usages réels et reproductibles.
Le gain semble tout de même important face à la génération précédente. Sur Frontier-Bench v0.1, Anthropic affirme qu’Opus 5 fait plus que doubler les performances d’Opus 4.8, avec un coût inférieur par tâche. L’entreprise précise que ce résultat provient d’une exécution interne réalisée avec le framework mini-SWE-agent, sur cinq tentatives par problème.
Cette progression intervient moins de deux mois après le lancement de Claude Opus 4.8 et de ses workflows composés de centaines de sous-agents. Anthropic maintient donc un rythme de mise à jour particulièrement rapide pour répondre à la concurrence d’OpenAI, Google et des nouveaux modèles open weight.
Un modèle conçu pour vérifier son propre travail
La principale évolution de Claude Opus 5 ne se résume pas à une hausse des scores. Anthropic insiste sur sa capacité à vérifier ses résultats, à corriger ses erreurs et à poursuivre une tâche jusqu’à son aboutissement, sans déclarer trop rapidement qu’un problème est résolu.
Lors d’une évaluation, le modèle devait reconstruire dans FreeCAD une pièce mécanique à partir d’un dessin qu’il ne pouvait pas consulter directement. Opus 5 aurait alors créé son propre pipeline de vision par ordinateur pour extraire la géométrie depuis les pixels bruts, avant de générer le modèle 3D. D’après Anthropic, aucun modèle concurrent placé dans les mêmes conditions n’a réussi la tâche en cinq tentatives.
Dans un autre test, Opus 5 devait corriger un véritable bug découvert dans un gestionnaire de paquets open source. Le modèle aurait identifié la cause profonde ainsi qu’un cas limite oublié par le correctif proposé par la communauté. Le concurrent testé par Anthropic se serait contenté de traiter le symptôme visible avant de considérer le problème comme résolu.
Ces exemples restent sélectionnés par l’entreprise, mais ils illustrent clairement son objectif. Opus 5 doit être capable de prendre en charge des tâches plus ouvertes, dans lesquelles le chemin vers la solution n’est pas fourni à l’avance. Ce positionnement correspond directement au développement des agents IA destinés aux entreprises, capables de naviguer entre plusieurs applications et de produire un résultat complet.
Des progrès dans le code, la bureautique et la recherche scientifique
Sur ARC-AGI 3, qui mesure la capacité d’un système à résoudre des problèmes nouveaux, le score communiqué pour Opus 5 serait trois fois supérieur à celui du deuxième modèle du classement. Sur AutomationBench de Zapier, son taux de réussite serait environ 1,5 fois plus élevé que celui du meilleur concurrent pour un coût équivalent par tâche.
Anthropic affirme également qu’Opus 5 dépasse les autres modèles sur OSWorld 2.0, une évaluation centrée sur l’utilisation autonome d’un ordinateur. Il parviendrait à surpasser le meilleur résultat de Fable 5 pour un peu plus du tiers de son coût. Ces progrès sont importants pour Claude Cowork et les agents qui doivent manipuler des interfaces, des fichiers et des outils professionnels.
Le modèle progresse aussi dans les sciences de la vie. Sur les évaluations internes d’Anthropic, il obtiendrait de meilleurs résultats qu’Opus 4.8 en biologie structurale, en bio-informatique et en chimie organique. L’écart atteindrait 10,2 points de pourcentage pour l’interprétation de données de spectroscopie et 7,7 points pour certaines tâches liées aux variations de séquences de protéines.
Ces mesures n’indiquent pas qu’Opus 5 peut remplacer un chercheur ou conduire seul une étude scientifique. Anthropic reconnaît d’ailleurs que le modèle conserve des limites sur les recherches autonomes de longue durée. Il pourrait toutefois accélérer l’analyse de données, la vérification de résultats et la création d’outils scientifiques spécialisés.
Une fenêtre de contexte d’un million de tokens
D’après la documentation technique de Claude, Opus 5 accepte une fenêtre de contexte pouvant atteindre un million de tokens. Il peut générer jusqu’à 128 000 tokens en sortie avec l’API Messages synchrone, ou jusqu’à 300 000 tokens dans certains traitements par lots utilisant un en-tête bêta.
Cette capacité permet au modèle d’analyser de grandes bases de code, des ensembles de documents ou des historiques de conversation particulièrement longs. Son niveau d’effort peut également être réglé afin d’équilibrer la qualité, la vitesse et la consommation de tokens. Le réglage « high » est sélectionné par défaut dans l’API et Claude Code.
Les données d’entraînement d’Opus 5 couvrent une période allant jusqu’en mai 2026, qui correspond également à la date annoncée pour ses connaissances les plus fiables. Le modèle accepte du texte et des images en entrée, produit du texte et prend en charge les usages multilingues.
Claude Opus 5 conserve le prix d’Opus 4.8
Le tarif constitue l’un des principaux arguments de cette version. Au 24 juillet 2026, la grille officielle d’Anthropic fixe le prix de Claude Opus 5 à 5 dollars par million de tokens en entrée et 25 dollars par million de tokens en sortie. Il coûte donc exactement le même prix qu’Opus 4.8.
Fable 5 est facturé 10 dollars par million de tokens en entrée et 50 dollars en sortie. À volume égal, Opus 5 revient ainsi deux fois moins cher. Son prix reste toutefois supérieur à celui de Sonnet 5, proposé temporairement à 2 dollars en entrée et 10 dollars en sortie jusqu’au 31 août 2026.
Un Fast mode permet de faire fonctionner Opus 5 environ 2,5 fois plus rapidement. Ce mode est facturé 10 dollars par million de tokens en entrée et 50 dollars en sortie sur la plateforme Claude. Le traitement par lots réduit pour sa part le coût à 2,50 dollars en entrée et 12,50 dollars en sortie.
Opus 5 devient le modèle par défaut de l’abonnement Claude Max et le modèle le plus puissant disponible avec Claude Pro. Il est également accessible dans Claude Code, Claude Cowork, l’API Claude, Amazon Bedrock, Google Cloud et Microsoft Foundry sous l’identifiant claude-opus-5.
Des garde-fous moins restrictifs que sur Fable 5
Les restrictions imposées à Fable 5 depuis son lancement ont provoqué des critiques, notamment chez les chercheurs en cybersécurité. Claude Opus 5 conserve des protections contre la génération d’exploits, les tests d’intrusion et l’analyse de vulnérabilités à partir de fichiers binaires, mais il peut toujours rechercher des failles directement dans du code source.
Anthropic estime que les classificateurs de sécurité devraient intervenir environ 85 % moins souvent qu’avec Fable 5. Lorsqu’une demande est bloquée dans Claude, Claude Code ou Claude Cowork, le système peut automatiquement la rediriger vers Opus 4.8.
Une nouvelle fonction Automatic Fallbacks est également proposée en bêta dans l’API. Elle permet de transférer automatiquement une requête refusée vers le meilleur modèle autorisé disponible, afin d’éviter une interruption complète du workflow.
Anthropic affirme enfin qu’Opus 5 obtient un score de 2,3 sur son audit automatisé des comportements non alignés, le niveau le plus bas parmi ses modèles récents. Il serait moins susceptible d’adopter un comportement trompeur, de faciliter un usage abusif ou d’effectuer une action difficilement réversible sans vérification. Ces résultats proviennent cependant des évaluations internes de l’entreprise et devront être confrontés à l’utilisation réelle du modèle.
Claude Opus 5 apparaît ainsi comme le modèle le plus équilibré de la gamme Anthropic pour les développeurs et les entreprises. Fable 5 conserve un avantage pour les projets autonomes les plus exigeants, mais Opus 5 pourrait devenir le choix logique pour la majorité des tâches complexes grâce à son prix inférieur, sa grande fenêtre de contexte et sa capacité renforcée à contrôler son propre travail.



No Comment! Be the first one.