Anthropic a lancé Claude Opus 5 le 24 juillet 2026, avec un positionnement officiel délibérément modeste : quasiment toute l'intelligence de Fable 5 à moitié prix — 25 par million de tokens contre 50 pour Fable — se situant, dans le propre système de niveaux d'Anthropic, une classe en dessous de son modèle phare de la gamme Mythos.
Puis les chiffres indépendants sont arrivés, et le positionnement modeste n'a plus tenu. Opus 5 a débuté à la première place de l'Artificial Analysis Intelligence Index — 61, devançant de peu les 60 de Fable 5 et reléguant GPT-5.6 Sol à la troisième place. Sur les benchmarks propres d'Anthropic, il surpasse Fable 5 en codage et en travail de connaissance : 43.3% sur Frontier-Bench (codage agentique en terminal), plus du double des 18.7% d'Opus 4.8 et largement au-dessus des 33.7% de Fable 5 ; à moins d'un demi-point du meilleur score de Fable 5 sur CursorBench, pour environ moitié moins cher par tâche ; devant tout le monde, à n'importe quel niveau de prix, sur l'usage informatique OSWorld.
Les classements vérifiés d'ARC Prize rendent le constat encore plus frappant. Sur ARC-AGI-1, Opus 5 obtient 97.5% à 2.06/tâche — les deux, selon ARC Prize, « compétitifs avec les performances SOTA précédentes pour un coût légèrement plus élevé ». Solide, sans plus. Mais ARC-AGI-3 — le benchmark le plus récent, construit autour d'environnements de puzzles interactifs et agentiques plutôt que statiques — est là où l'écart devient franchement étrange : Opus 5 établit un nouveau SOTA à 30.2%, contre un précédent record de seulement 7.8% établi par GPT-5.6 Sol (Max). Opus 5 ne mène pas d'une courte tête, il quadruple presque le plafond précédent. La doublure est, selon plusieurs mesures, désormais en tête — tout en restant officiellement une classe en dessous.
Transformer un puzzle en équation
Le détail le plus frappant dans le compte-rendu d'ARC Prize n'est pas le score — c'est la façon dont Opus 5 y est parvenu. Les environnements d'ARC-AGI-3 sont des puzzles visuels et interactifs, pas des problèmes mathématiques. Mais au fil de sa transcription, à l'action 23, le modèle a décrit une scène à l'aide d'une notation algébrique explicite : 4_center = 2×axis − 5_center — une équation de réflexion, dérivée de lui-même, pour représenter ce qu'il observait. ARC Prize indique que c'est la première fois qu'ils observent un modèle produire une équation de réflexion explicite dans ce type d'analyse.
Cela ne s'est pas arrêté là. À l'action 248, Opus 5 avait généralisé le motif à deux dimensions : "ghost = reflection about axis strips: br' = 2·br_axis − br, bc' = 2·bc_axis − bc." C'est un modèle qui découvre et formalise spontanément une règle générale de transformation géométrique en pleine tâche, plutôt que de faire du filtrage de motifs à partir des données d'entraînement — exactement le type de comportement qu'ARC-AGI-3 a été conçu pour révéler, et qu'aucun modèle de pointe précédent n'avait manifesté sur ce benchmark.
Les fonctionnalités qui comptent
La fenêtre de contexte de 1M tokens confirme la fuite d'avant-lancement, et la fonctionnalité phare du produit est le contrôle de l'effort : faible/moyen/élevé, plus un nouveau mode de raisonnement « xhigh », réglable à chaque tour — le curseur coût/capacité passant du statut de détail d'infrastructure à celui de contrôle utilisateur de premier plan. Il a été déployé partout en même temps : API, applications Claude, Claude Code, Bedrock, Vertex, et GitHub Copilot dès le premier jour, devenant le nouveau réglage par défaut sur Claude Max.
La fiche système contient une inversion intéressante : Opus 5 s'est révélé moins capable en cyber-exploitation que Fable 5, il est donc livré avec des garde-fous allégés — et, contrairement à Fable 5, il ne porte pas le régime de rétention des données de 30 jours que Fable a hérité de son épisode lié au contrôle des exportations. Anthropic le qualifie de « modèle Opus le plus aligné » et de son modèle généralement disponible le plus capable pour la recherche scientifique.
Le registre des prédictions, encore
L'article sur les tendances avait signalé qu'Anthropic était en retard sur son rythme de sortie — projeté pour le 12 juillet — et avançait, après le succès de FLUX 3, que le silence au-delà de la date projetée d'un laboratoire a tendance à précéder une sortie plus importante. Opus 5 est arrivé le 24 juillet, douze jours après la projection : une sortie véritablement importante, arrivée en retard, exactement conforme au schéma. Cela fait deux sur deux pour les calculs de cadence en une semaine — d'abord Black Forest Labs, maintenant Anthropic. (La projection de mi-août de Google est la prochaine sur la liste.)
Ce que le lancement ne dit manifestement pas
Deux jours après que la Maison-Blanche a accusé Moonshot d'avoir distillé Fable d'Anthropic, et trois jours avant la publication prévue des poids ouverts de Kimi K3, les documents de lancement d'Anthropic ne disent rien de la distillation, de la sécurité des poids, ou du conflit sur les restrictions dont Anthropic est la prétendue victime et le bénéficiaire présumé. Le commentaire le plus proche est venu d'un responsable produit qui, interrogé sur K3, s'est contenté de dire qu'il « reste à voir » comment les modèles à poids ouverts se comportent sur des projets réels complexes. Que ce silence relève de la prudence juridique, de la patience stratégique, ou d'une gêne face à une interdiction plaidée en son nom, c'est la partie silencieuse la plus bruyante d'un lancement par ailleurs très bruyant — et la tarification raconte sa propre histoire : réduire de moitié le coût effectif d'une intelligence proche de Fable, trois jours avant la plus grosse sortie à poids ouverts de l'année, est une réponse concurrentielle qui n'a besoin de rien dire du tout.
Liens
- Annonce : Claude Opus 5 — Anthropic
- Scores vérifiés : ARC Prize — Claude Opus 5 results