Anthropic lance Claude Opus 4.8 ce 28 mai 2026, avec un outil inédit de coordination de centaines de sous-agents et des améliorations marquées en fiabilité. Disponible immédiatement, aux mêmes tarifs qu’Opus 4.7.
Un cycle de publication accéléré dans un marché sous pression
Quarante et un jours. C’est le délai qui sépare la sortie d’Opus 4.7 de celle de ce nouveau modèle, un rythme inhabituellement rapide pour Anthropic. À titre de comparaison, les modèles Sonnet et Haiku actuellement en service ont respectivement trois et sept mois d’ancienneté. Cette cadence trahit une pression concurrentielle qui s’est intensifiée ces dernières semaines : OpenAI a mis à jour son outil Codex et Google a lancé une nouvelle version de son modèle Gemini Flash dans l’intervalle, obligeant Anthropic à répondre rapidement.
La réception mitigée d’Opus 4.7 par une partie de la communauté a pu jouer un rôle dans cette décision. Sur les réseaux sociaux, plusieurs utilisateurs avaient exprimé leur déception vis-à-vis du prédécesseur. La réponse d’Anthropic ne se limite pas à un rattrapage de benchmark : elle s’attaque à un problème de fond qui touche l’ensemble de l’industrie, à savoir la gestion des incertitudes et des erreurs dans les workflows autonomes.
Claude Opus 4.8 et l’honnêteté comme priorité technique
L’amélioration la plus notable d’Opus 4.8 ne porte pas sur un classement dans un tableau comparatif. Elle concerne la manière dont le modèle gère ce qu’il ne sait pas. Selon l’annonce officielle d’Anthropic, Opus 4.8 est environ quatre fois moins susceptible que son prédécesseur de laisser passer sans signalement des failles dans le code qu’il produit.
Cette caractéristique a été particulièrement remarquée lors des tests avant lancement. Michael Ran, associé en investissement senior chez Bridgewater Associates, a déclaré dans l’annonce officielle d’Anthropic : « La plus grande différence était la tendance d’Opus 4.8 à signaler de manière proactive les problèmes liés aux entrées et aux sorties d’une analyse, quelque chose que les autres modèles manquaient systématiquement et laissaient aux utilisateurs à détecter. » (The biggest differentiator was Opus 4.8’s tendency to proactively flag issues with the inputs and outputs of an analysis, something other models routinely missed and left to the users to catch.)
Sur le plan de l’alignement, l’équipe Alignement d’Anthropic conclut qu’Opus 4.8 « atteint de nouveaux sommets sur nos mesures de traits prosociaux, comme le soutien à l’autonomie des utilisateurs et le fait d’agir dans leur meilleur intérêt. » (reaches new highs on our measures of prosocial traits like supporting user autonomy and acting in the user’s best interest.) Le taux de comportements non alignés, incluant la déception ou la facilitation d’usages abusifs, serait nettement inférieur à celui d’Opus 4.7, et comparable au niveau atteint par Claude Mythos Preview, le modèle le plus avancé de la société.
Dynamic Workflows : piloter des centaines de sous-agents en parallèle
La nouveauté technique la plus structurante de cette version est le Dynamic Workflows, disponible en préversion de recherche dans Claude Code. Le principe est le suivant : Claude peut désormais écrire dynamiquement des scripts d’orchestration qui font tourner des dizaines à des centaines de sous-agents en parallèle dans une seule session, puis vérifier ses propres résultats avant de les transmettre à l’utilisateur.
Anthropic illustre le cas d’usage le plus ambitieux dans son annonce : « Claude Code combiné à Opus 4.8 peut désormais réaliser des migrations à l’échelle d’une base de code entière, portant sur des centaines de milliers de lignes, depuis le démarrage jusqu’à la fusion, en utilisant la suite de tests existante comme critère de validation. » (Claude Code alongside Opus 4.8 can now carry out codebase-scale migrations across hundreds of thousands of lines of code from kickoff to merge, with the existing test suite as its bar.)
La fonctionnalité est accessible dès aujourd’hui dans le CLI Claude Code, l’extension VS Code et l’application desktop, pour les abonnements Max, Team et Enterprise, ainsi que via l’API Claude, sur Amazon Bedrock, Google Vertex AI et Microsoft Foundry. Anthropic précise que les Dynamic Workflows peuvent consommer un volume de tokens nettement supérieur à une session Claude Code standard, et recommande de commencer par des tâches bien délimitées avant de traiter des projets d’envergure.
Ce que les premiers testeurs rapportent
Les retours publiés dans l’annonce officielle d’Anthropic couvrent plusieurs secteurs d’activité. Michael Truell, cofondateur et PDG de Cursor, indique dans l’annonce officielle d’Anthropic qu’Opus 4.8 surpasse les précédents modèles Opus sur l’ensemble des niveaux d’effort mesurés par le CursorBench, en effectuant les appels d’outils de façon plus efficace et en utilisant moins d’étapes pour atteindre le même niveau de résultat.
Pour les usages juridiques, Niko Grupen, responsable de la recherche appliquée, indique qu’Opus 4.8 est le premier modèle à franchir la barre des 10 % sur le critère le plus strict du Legal Agent Benchmark, celui qui exige que chaque étape d’un raisonnement soit correcte pour qu’un cas soit considéré comme validé. Sur le pilotage de navigateur, Miguel Gonzalez, responsable technique, signale un score de 84 % sur le benchmark Online-Mind2Web, supérieur à la fois à Opus 4.7 et à GPT-5.5.
Tarification et nouvelles fonctionnalités
La tarification d’Opus 4.8 est identique à celle d’Opus 4.7 pour l’usage standard. Le mode rapide (fast mode), qui permet au modèle de fonctionner à 2,5 fois la vitesse normale, est désormais trois fois moins cher que pour les versions précédentes. Voici la structure tarifaire en vigueur à la date du 28 mai 2026 :
Usage standard : 5 $ par million de tokens en entrée, 25 $ par million en sortie
Mode rapide : 10 $ par million de tokens en entrée, 50 $ par million en sortie
Deux autres mises à jour accompagnent Opus 4.8. Un contrôle du niveau d’effort est désormais disponible sur claude.ai et dans Cowork : à effort plus élevé, le modèle raisonne de façon plus approfondie pour produire de meilleures réponses ; à effort réduit, les réponses arrivent plus vite et consomment moins de quota. L’API Messages accepte par ailleurs désormais des entrées de type « system » directement dans le tableau de messages, ce qui permet aux développeurs de mettre à jour les instructions ou les autorisations d’un agent en cours d’exécution sans rompre le cache de prompt.
Claude Mythos : une disponibilité annoncée pour les prochaines semaines
Anthropic profite de l’annonce d’Opus 4.8 pour donner un premier calendrier sur Claude Mythos, son modèle le plus puissant. Une préversion limitée avait été déployée dans le cadre du Project Glasswing, exclusivement pour des usages liés à la cybersécurité, avant d’être suspendue en raison de préoccupations de sécurité. Dans son annonce officielle du 28 mai 2026, Anthropic écrit : « Nous progressons rapidement dans le développement de ces protections et espérons pouvoir mettre les modèles de la classe Mythos à disposition de l’ensemble de nos clients dans les prochaines semaines. » (We’re making swift progress on developing these safeguards and expect to be able to bring Mythos-class models to all our customers in the coming weeks.)
Avec Opus 4.8, Anthropic revendique une amélioration ciblée plutôt qu’une rupture : la société elle-même qualifie cette version de « modeste mais tangible » par rapport à son prédécesseur. L’accent mis sur la fiabilité des agents autonomes et la capacité à signaler les incertitudes donne cependant une direction concrète aux équipes qui gèrent des tâches longues et complexes. Les Dynamic Workflows méritent une évaluation rapide, en particulier pour les migrations de base de code. Et pour les organisations qui attendent Mythos, l’annonce d’aujourd’hui confirme que l’échéance se rapproche.




No comments! Be the first one.