Claude Opus 5.5 est le modèle auquel nous confierions un dossier embrouillé et à fort enjeu en sachant qu'il reviendra avec la bonne réponse. Selon Anthropic, il atteint le niveau de son modèle haut de gamme, Fable 5.1, sur la plupart des tâches, tout en coûtant moins de la moitié par token. Et il écrit désormais comme un collègue posé, plus comme un jeune diplômé nerveux.
Meilleur score de l'indice indépendant Artificial Analysis Intelligence Index à sa sortie (58, effort maximal). En tête de GDPval-AA v2.1, un test de vrai travail professionnel, avec 1846 Elo, devant Fable 5.1 (1735). Le prix des tokens baisse de 20 %, à 4 $/20 $, et la lecture en cache de 60 %, à 0,20 $ ; selon Anthropic, une charge de travail typique revient ainsi environ 40 % moins cher qu'avec Opus 5. La génération est plus de 30 % plus rapide, et les plafonds d'usage sur cinq heures ont été relevés dans les forfaits payants.
En effort maximal, il réfléchit énormément à voix haute : Artificial Analysis a mesuré environ 119 000 tokens de sortie par tâche, contre environ 27 000 pour GPT-6 Astra. Le prix affiché n'est donc avantageux que si le travail courant reste au niveau d'effort par défaut. Pas de génération d'images, le raisonnement ne peut plus être désactivé, et la plupart des demandes de cybersécurité sont discrètement confiées à l'ancien Opus 4.8.