Le 22 septembre 2026, Anthropic a officiellement annoncé Claude Opus 5.5 via son Newsroom officiel — le premier modèle de la nouvelle famille 5.5. Selon l'entreprise, il atteint sur la plupart des tâches le niveau du modèle haut de gamme Claude Fable 5.1, tout en coûtant 40 % moins cher à exécuter sur des charges typiques que son prédécesseur Opus 5, en générant les sorties plus de 30 % plus vite, et en faisant passer les prix API de 5/25 dollars à 4/20 dollars par million de tokens d'entrée/sortie — une baisse de 20 %.
Plus fort, pas plus cher : l'argument, c'est l'efficacité
Ce n'est pas une simple mise à niveau « plus grand, plus fort ». Le tableau comparatif d'Anthropic place Opus 5.5 en tête de plusieurs benchmarks de codage agentique et de travail intellectuel — Terminal-Bench 4.0 (66,4 %), FrontierCode v1.1, GDPval-AA v2.1 — devant notamment GPT-6 Astra d'OpenAI. L'évaluateur indépendant Artificial Analysis lui a attribué 58 points à son Intelligence Index — le score le plus élevé jamais mesuré, environ cinq points devant Fable 5.1 et GPT-6 Astra.
Mais ces prix méritent un astérisque. Artificial Analysis a aussi constaté qu'au réglage maximal, Opus 5.5 consomme environ 119 000 tokens par tâche de benchmark, bien plus que les 27 000 de GPT-6 Astra. Les prix unitaires ont baissé de 20 %, mais le modèle dépense les tokens plus généreusement, si bien que le coût par tâche au réglage maximal reste à peu près au niveau d'Opus 5. Les vraies économies se font aux réglages moyens et inférieurs : quatre des cinq niveaux se situent sur la frontière de Pareto entre intelligence et coût par tâche — parmi les modèles notés plus de 50, Opus 5.5 est donc soit moins cher, soit plus fort.
Pour une fois, le rapport de sécurité est publié avec le modèle
Aussi notable que le prix : Anthropic a mis l'évaluation de sécurité sur le même plan que les performances. Avant sa sortie, Opus 5.5 a été testé par deux organismes externes, METR et Frontier Design, et a obtenu le score le plus élevé jamais enregistré lors de l'audit comportemental automatisé d'Anthropic. Les tests de la société de sécurité Gray Swan montrent qu'il partage avec Fable 5.1 le plus faible taux de réussite des injections de prompt parmi tous les modèles testés. La carte système qui l'accompagne divulgue l'évaluation dans son intégralité : ses capacités en biologie et en cybersécurité approchant celles de Fable 5.1, des protections équivalentes s'appliquent — les organismes de recherche agréés peuvent postuler au Life Sciences Verification Program pour l'utiliser en recherche biologique.
Le point de vue : la première réponse après le manifeste du ralentissement
C'est la première sortie majeure depuis que le PDG d'Anthropic, Dario Amodei, a publiquement appelé l'industrie à ralentir le rythme du développement de l'IA de pointe. La posture de cette réponse est claire : égaler le fleuron sur les capacités, faire baisser les prix, mettre la transparence sécuritaire en avant. La nouvelle version de Claude Code en fait déjà le modèle Opus par défaut, les limites d'utilisation sur cinq heures des formules Pro, Max, Team et Enterprise ont été relevées, et Sonnet 5.5 et Haiku 5.5 suivront dans les prochaines semaines.
Pour l'industrie, le signal est direct : la compétition des modèles de pointe passe des simples scores de benchmark au coût d'achèvement d'une tâche réelle. Quand le modèle le plus fort devient aussi moins cher et plus transparent, les développeurs devront refaire leurs calculs.