Ce qui change
Anthropic a publié Claude Opus 5.5 le 22 septembre 2026 : sous l’identifiant claude-opus-5-5 sur la Claude Platform, et chez Amazon Web Services, Google Cloud et Microsoft Azure 1. Entrée et sortie coûtent 20 % de moins qu’avec Opus 5, les lectures en cache 60 % de moins 1. L’économie annoncée a un périmètre précis : 40 % de moins qu’Opus 5 sur des charges typiques, avec les réglages par défaut 1.
Où tombe la remise
| Prix par million de jetons | Opus 5 | Opus 5.5 |
|---|---|---|
| Lectures en cache 1 | 0,50 $ | 0,20 $ |
| Entrée 1 | 5 $ | 4 $ |
| Sortie 1 | 25 $ | 20 $ |
C’est la ligne du cache qui compte. Anthropic indique que les lectures en cache forment la majorité des coûts du travail agentique et du code 1, et Simon Willison note que plus de 90 % des jetons d’entrée d’une longue conversation agentique sont facturés au tarif du cache 3. Artificial Analysis y voit une remise de 95 % par rapport à l’entrée hors cache, contre 90 % pour les Opus précédents 2. Je pense que l’effet de second ordre compte davantage : un défaut de cache coûte désormais relativement plus cher, donc tout ce qui casse votre préfixe (un horodatage dans le prompt système, des outils réordonnés) ronge davantage l’économie.
L’effort max consomme la remise
Max a ses arguments. En effort max, Artificial Analysis donne à Opus 5.5 un score de 58 sur son Intelligence Index, le meilleur qu’il ait mesuré, avec plusieurs points d’avance 2. La facture suit. En max, Opus 5.5 consomme environ 119k jetons de sortie par tâche de l’index, contre environ 73k pour Opus 5 en max, ce qui le place au niveau d’Opus 5 en coût par tâche 2. Les 40 % valent pour les réglages par défaut, où l’effort est medium 1.
Simon Willison a lancé max sur une seule requête : deux fois, le modèle a buté sur la limite de 128 000 jetons de sortie (commune aux autres modèles Claude) en plein raisonnement 3. Chaque échec lui a coûté 2,56 $ et près de 20 minutes 3. Il soupçonne max d’être inutile en pratique 3. Sur une seule requête, je n’irais pas jusque-là, mais je n’en ferais pas un réglage par défaut.
Impact pour une équipe
Opus 5.5 n’est plus disponible avec le mode thinking désactivé 1 : toute requête qui le coupe est à modifier avant de basculer sur claude-opus-5-5. Pour un compte API créé à partir du 31 août 2026, le mécanisme preserved thinking s’applique ; il empêche les utilisateurs de l’API de modifier le contexte antérieur de Claude pour tenter d’en extraire le raisonnement 1. Je testerais en premier tout harnais qui réécrit ou élague les tours précédents de l’assistant. Côté budget, partez de medium, le réglage par défaut, et ne routez vers max que les tâches où vos évaluations montrent un gain : en max, Artificial Analysis ne mesure aucune économie par tâche face à Opus 5 en max 2. Et suivez votre taux de succès du cache, car votre part de la baisse en dépend.