Mise à jour du 25 juillet : Claude Opus 5 passe désormais devant Fable 5. Fable garde de petites victoires maximales sur FrontierCode, CursorBench, HLE sans outils et un test juridique ; Opus 5 mène des évaluations plus larges d’agents et de travail professionnel à moitié prix et avec moins de contraintes. Le texte ci-dessous conserve les preuves du lancement de juin ; lisez ses superlatifs dans ce contexte historique.
Si Opus 4.8 était la promotion, Fable 5 est le bureau d’angle. Le changement de nomenclature d’Anthropic, des registres musicaux (Haiku, Sonnet, Opus) aux registres littéraires (Fable, Mythos), n’est pas juste du branding — il signale une nouvelle classe de modèle. Fable 5 tourne sur la même architecture de classe Mythos qui propulse le Mythos 5 restreint, mais avec des classifieurs de sécurité qui le rendent utilisable par tous. Imaginez une supercar avec le limiteur de vitesse enclenché — toujours la plus rapide sur la route, juste avec des garde-fous dans certains virages.
Les chiffres parlent d’eux-mêmes. SWE-Bench Pro à 80,3% ne se contente pas de battre GPT-5.5 (58,6%) — il humilie tout le peloton. FrontierCode Diamond à 29,3% signifie que Fable 5 écrit du code de qualité production cinq fois plus efficacement que GPT-5.5 (5,7%). Sur le Hebbia Finance Benchmark — raisonnement documentaire de niveau senior, lecture de graphiques, analyse des causes racines — il est n°1. Sur CursorBench, il a ouvert « une classe de problèmes à long horizon qui étaient hors de portée des modèles précédents. »
Mais les démonstrations les plus parlantes ne sont pas des benchmarks. Stripe a migré une base de code Ruby de 50 millions de lignes en une seule journée — un travail qui aurait pris deux mois à une équipe complète. Le modèle a complété Pokémon Rouge Feu en utilisant uniquement des captures d’écran brutes — pas de cartes, pas d’outils auxiliaires, pas de données d’état du jeu. Et avec une mémoire persistante basée sur des fichiers en jouant à Slay the Spire, ses performances se sont améliorées 3× de plus que celles d’Opus 4.8.
L’histoire de la sécurité mérite d’être comprise. Les requêtes touchant à la cybersécurité, la biologie, la chimie ou la distillation de modèles sont automatiquement redirigées vers Opus 4.8 — toujours un modèle de premier plan, mais pas l’architecture Mythos complète. Cela se produit dans moins de 5% des sessions, et Anthropic reconnaît quelques faux positifs sur des requêtes inoffensives. C’est le prix à payer pour publier un modèle aussi capable rapidement et en toute sécurité. Le Mythos 5 sans restriction est réservé aux partenaires accrédités via le Project Glasswing — où il contribue déjà à défendre des infrastructures logicielles critiques.
La vraie question est de savoir si le prix en vaut la peine. À 10 $/50 $ par million de tokens, Fable 5 coûte environ 2× ce que coûte Opus 4.8. Mais l’efficacité en tokens compense partiellement — atteindre les meilleurs résultats FrontierCode à effort modéré signifie moins de calcul par tâche. Pour les professionnels dont le temps vaut plus que leur facture API, le calcul est simple. Pour tous les autres, Opus 4.8 reste excellent. Mais si vous voulez le meilleur modèle IA généralement disponible sur la planète — celui dont l’avance se creuse à mesure que la tâche se complexifie — c’est celui-là.