Opus 5.5 fait baisser de 40 % le coût d’un agent Claude

Opus 5.5 fait baisser de 40 % le coût d'un agent Claude

L’essentiel

  • Anthropic a lancé le 22 septembre Claude Opus 5.5, premier modèle de la famille 5.5, annoncé au niveau de Fable 5.1 sur la plupart des tâches.
  • Le prix des tokens baisse de 20 % (4 dollars en entrée, 20 dollars en sortie par million) et la lecture de cache de 60 % ; le coût par tâche recule d’environ 40 % face à Opus 5.
  • Les limites sur cinq heures des abonnés Claude augmentent de 20 %, et Sonnet 5.5 et Haiku 5.5 sont attendus dans les prochaines semaines.
  • Les requêtes sensibles en cybersécurité sont routées vers Opus 4.8, celles touchant à la biologie vers Opus 5.

Ce mois-ci, Dario Amodei appelait à modérer le rythme de la frontière de l’IA. À peine deux mois après Opus 5, Anthropic sort pourtant Opus 5.5, et l’argument qu’elle met en avant ne parle pas de puissance : une tâche coûte environ 40 % de moins qu’avec le prédécesseur, pour un niveau que l’éditeur situe à hauteur de Fable 5.1.

La baisse est taillée pour un usage précis : les agents qui tournent des heures, bien plus que la question isolée posée à un chatbot.

20 % sur la grille, 40 % sur la facture

La baisse affichée sur la grille tarifaire est de 20 % : 4 dollars le million de tokens (les unités de texte sur lesquelles le modèle est facturé) en entrée contre 5 pour Opus 5, 20 dollars en sortie contre 25. Pour atteindre 40 % sur le coût d’exploitation, Anthropic ajoute un second levier, la sobriété. Le modèle consomme moins de tokens pour la même tâche et produit ses réponses plus de 30 % plus rapidement, selon l’éditeur.

Faisons le calcul. Si le prix unitaire tombe à 80 % de l’ancien et la facture à 60 %, le volume de tokens par tâche doit reculer d’environ un quart. Anthropic ne publie pas ce ratio : il se déduit de ses deux annonces. Box, parmi les premiers clients à témoigner, rapporte sur ses propres évaluations une consommation réduite à un tiers de celle d’Opus 5, avec des réponses 40 % moins verbeuses sans perte de précision.

L’économie réelle dépend donc de votre charge de travail plus que de la grille. Un workflow qui produit de longues analyses en profitera davantage qu’un classifieur qui renvoie trois mots.

Côté abonnements, la même arithmétique s’applique. Les limites sur cinq heures gagnent 20 %, et le modèle moins gourmand les fait durer 25 % plus loin : 1,2 multiplié par 1,25, soit environ 50 % d’usage en plus à tâche égale. Les abonnés Pro, Max et Team disposent aussi d’une remise à zéro de leurs quotas, à déclencher jusqu’au 22 octobre dans les réglages, rubrique Utilisation.

Un agent passe son temps à relire son contexte

La ligne la plus parlante du tarif est la moins commentée : la lecture de cache (la mémoire tampon où le modèle garde le contexte déjà traité) passe de 0,50 à 0,20 dollar le million de tokens, soit 60 % de baisse. L’écriture en cache suit, de 6,25 à 5 dollars. Un agent de longue durée relit son contexte (instructions, historique, fichiers déjà ouverts) à chaque étape. Sur une session de plusieurs heures, ces relectures peuvent peser plus lourd que les tokens nouvellement produits.

Anthropic argumente d’ailleurs en coût par tâche plutôt qu’en score. Sur FrontierCode, Opus 5.5 dépasserait GPT-6 Astra d’OpenAI (54,4 % contre 53,3 %) pour environ 20 % de son coût par tâche. Sur Terminal-Bench 4.0, l’éditeur revendique la performance d’Astra pour 40 % de son coût. Un point d’écart sur un benchmark ne fait pas changer d’outil. Un coût divisé par cinq, si.

Claire Vo, qui a testé le modèle une semaine pour son émission How I AI, arrive au même constat : le prix compte davantage pour les travaux agentiques que pour les prompts uniques. Elle place Opus 5.5 en tête sur les agents de longue durée et en fait son outil de prédilection pour le prototypage frontend.

L’équipe ClaudeDevs donne la consigne qui va avec : confier une tâche entière, définir ce que « terminé » veut dire et quand vérifier l’avancement, supprimer les « réfléchis soigneusement » devenus inutiles puisque le modèle réfléchit toujours avant de répondre. Des prompts hérités d’Opus 5 peuvent donc gonfler la facture pour rien. Avant de comparer deux modèles, relisez vos gabarits.

Là où Astra garde l’avantage

Le tableau publié par Anthropic ne place pas Opus 5.5 en tête partout. Sur AutomationBench, qui mesure les workflows métier, GPT-6 Astra garde 41,4 % contre 40,0 %. Sur Terminal-Bench-Science, consacré à la recherche scientifique agentique, l’écart se creuse : 64,6 % pour Astra, 58,7 % pour Opus 5.5. La comparaison avec Fable appelle la même prudence : l’éditeur écrit « sur la plupart des tâches », sans dire lesquelles font exception.

Ces scores sont ceux de l’éditeur, mesurés sur ses propres réglages. Claire Vo en fournit elle-même le contrepoint : si Opus 5.5 a dominé sa semaine d’essais, son test à l’aveugle a penché pour Astra, et un juge automatique (un grand modèle de langage, ou LLM, chargé de noter les réponses) n’a pas validé son classement. Un benchmark donne un ordre de grandeur. Votre charge réelle tranche.

Ralentir, version Anthropic

Opus 5.5 est le premier modèle livré depuis l’appel d’Anthropic à un rythme modéré pour la frontière. Le calendrier, lui, n’a pas bougé : deux mois séparent Opus 5, sorti le 24 juillet, de son successeur, et deux autres modèles arrivent dans les semaines qui viennent. Le frein porte sur les garde-fous. Les requêtes jugées sensibles en cybersécurité sont routées automatiquement vers Opus 4.8, celles touchant à la biologie ou au développement de LLM de pointe vers Opus 5. Sur son test d’alignement le plus complet, Anthropic affirme que le modèle a tenté de contourner ses limites 85 % moins souvent qu’Opus 5 ou Claude Mythos 5.1. Le modèle a par ailleurs été évalué avant sa sortie par des organismes externes, dont METR et Frontier Design.

Pour une équipe qui fait tourner des agents d’audit de sécurité, ce routage a une conséquence directe : une partie des requêtes sera traitée par un modèle plus ancien. Mieux vaut le mesurer sur un échantillon de vos propres tâches avant de migrer un pipeline.

OpenAI a lancé le même jour GPT-6 Sol à 2 dollars en entrée et 10 en sortie par million de tokens, deux fois moins qu’Opus 5.5 sur la grille. La modération réclamée prend, pour l’instant, la forme d’une guerre des prix. Le prochain point de mesure viendra de Sonnet 5.5 : si la même sobriété descend d’un cran de gamme, le coût d’un agent autonome tombera sous le seuil où beaucoup d’équipes le cantonnent encore à l’expérimentation.

Mon avis

Anthropic a trouvé la seule forme de ralentissement compatible avec une entreprise qui doit continuer à vendre : figer le plafond de capacité et faire chuter le prix de ce plafond. Pour ceux qui construisent des agents, c’est la meilleure nouvelle de l’année et la plus ambiguë, car un niveau Fable 40 % moins cher multiplie les agents qui tournent sans surveillance, soit la surface que visait l’appel à la prudence. Je tiens le routage vers Opus 4.8 pour le test décisif : s’il reste discret et fiable, Opus 5.5 deviendra d’ici la fin de l’année la base par défaut des agents d’entreprise.

Sources

Ils m’ont fait confiance

« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »

Évaluation client · projet WordPress · septembre 2026

5,0/5 sur 16 évaluations

Faire appel à mes services →

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *