
L’essentiel
- Anthropic lance Claude Haiku 5.5 à 0,10 dollar l’entrée et 0,50 dollar la sortie par million de jetons pour les prompts de moins de 100 000 jetons, contre 1 et 5 dollars pour Haiku 4.5.
- Au-delà de 100 000 jetons, la grille est multipliée par cinq (0,50 et 2,50 dollars), et le nouveau tokenizer consomme davantage de jetons pour un même texte.
- Anthropic annonce un coût moyen inférieur d’environ 75 % à celui de Haiku 4.5, et recommande le modèle comme sous-agent d’Opus 5.5 ou de Sonnet 5.5.
Sur la page de tarifs, la ligne de Haiku 5.5 ramène la facture à un dixième de celle de Haiku 4.5. Sur le compteur de jetons, le même texte pèse plus lourd qu’avant. Entre les deux se trouve la somme que vous paierez réellement, et elle dépend de trois paramètres que la grille ne montre pas.

Complétez votre site, carte par carte
J’ai conçu TresoRank pour détecter ce qui manque à votre visibilité SEO & GEO : contenus, enrichissements, maillage ou optimisations techniques. Chaque opportunité devient une carte à activer.
Analyser mon site gratuitement →De 90 % à 87,5 % : ce que le tokenizer reprend
Les chiffres de départ sont nets. Haiku 4.5 facturait 1 dollar l’entrée et 5 dollars la sortie par million de jetons. Haiku 5.5 descend à 0,10 et 0,50 dollar pour les prompts jusqu’à 100 000 jetons, soit une baisse de 90 %. Les lectures de cache tombent à 0,01 dollar, contre 0,10 auparavant.
Anthropic précise toutefois que Haiku 5.5 utilise un tokenizer (le découpeur qui transforme le texte en jetons) mis à jour, qui consomme un peu plus de jetons par tâche. Une mesure indépendante sur un long prompt donne environ 1,25 fois plus de jetons qu’avec Haiku 4.5. Un précédent existe : sur les modèles Opus 4.x, le seul changement de tokenizer avait fait grimper la consommation d’environ 30 %.
Appliquons ce facteur de 1,25. Un texte qui pesait un million de jetons de sortie en pèse désormais 1,25 million, à 0,50 dollar le million : 0,625 dollar au lieu de 5, soit 87,5 % de baisse et non 90 %. Sur cette zone de prix, le tokenizer ne grignote que deux points et demi, et la remise tient.
Au-delà de 100 000 jetons, la remise fond
Plus haut dans les volumes, l’écart se resserre. Pour les prompts de plus de 100 000 jetons, la grille passe à 0,50 dollar l’entrée et 2,50 dollars la sortie. Face aux 1 et 5 dollars de Haiku 4.5, la baisse n’est plus que de 50 % ; avec le même facteur de 1,25, elle tombe à 37,5 %.
Anthropic indique que les prompts de moins de 100 000 jetons représentaient environ 90 % des requêtes Haiku précédentes. On peut en déduire l’écart avec l’annonce de 75 % de coût moyen en moins : les requêtes longues sont minoritaires en nombre mais pèsent davantage dans une facture. Si vos workloads reposent sur de gros contextes (documents entiers, historiques d’agents, dépôts de code), votre baisse se situera plutôt vers le bas de la fourchette.
Le niveau de raisonnement pèse plus lourd que la grille
Haiku 5.5 est le premier modèle de la gamme à proposer des niveaux de raisonnement réglables. Le raisonnement ne peut pas être désactivé : le niveau par défaut est medium. Or ces jetons de réflexion se facturent comme des jetons de sortie.
Un test public sur la génération d’une image SVG donne un ordre de grandeur. Au niveau low, la tâche a coûté 0,0936 centime et pris 7 secondes. Au niveau max, elle a coûté 3,3826 centimes et pris 5 minutes 9 secondes, soit un facteur 36 entre les deux réglages, sur le même modèle et la même consigne. Haiku 4.5, sans niveaux de raisonnement, avait facturé 0,7583 centime la même tâche : Haiku 5.5 en low est environ huit fois moins cher, en max environ quatre fois et demie plus cher. Une seule tâche, donc un repère, pas une moyenne.
Ce qui fait la facture, c’est le nombre de jetons que le modèle produit avant de répondre, bien plus que le prix du jeton.
Un sous-agent à un vingtième du prix de Sonnet
Reste la question du placement. Anthropic décrit Haiku 5.5 comme adapté aux tâches circonscrites : compaction, résumé, travail de sous-agent. Le compte Claude Developers de l’éditeur le dit sans détour : il s’accorde bien avec Opus 5.5 ou Sonnet 5.5 dans ce rôle. Pour le développement agentique complexe, ces deux derniers restent recommandés.
Les écarts de prix sont considérables : Sonnet 5.5 est facturé 2 et 10 dollars, soit vingt fois plus cher en entrée comme en sortie, et dix fois plus sur les lectures de cache (0,10 dollar, après la division par deux annoncée cette semaine). Les benchmarks publiés par Anthropic dessinent le compromis :
- OSWorld 2.1 (utilisation d’un ordinateur, sous-ensemble hors ligne) : 72,4 % pour Haiku 5.5, 83,9 % pour Sonnet 5.5, 15,7 % pour Haiku 4.5 ;
- GDPval-AA v2.1 (travail intellectuel) : 1 620 contre 1 840 pour Sonnet 5.5 et 735 pour l’ancien Haiku ;
- Terminal-Bench 4.0 (programmation agentique) : 39,2 % contre 70,6 % pour Sonnet 5.5, et 0 % pour Haiku 4.5.
En utilisation d’ordinateur, Haiku 5.5 atteint 86 % du score de Sonnet 5.5 pour un vingtième du prix par jeton. En programmation agentique, il n’atteint plus que 56 % du score. Un sous-agent chargé de naviguer, d’extraire ou de classer se justifie donc très bien ; un sous-agent chargé d’écrire le code du chantier principal beaucoup moins. Les lectures de cache à 0,01 dollar jouent aussi en sa faveur : un sous-agent relit sans cesse le même contexte, et ce poste-là est justement celui que la baisse allège.
Face à GPT-6 Luna, un prix jumeau et un seuil différent
Sur la grille, Haiku 5.5 s’aligne exactement sur GPT-6 Luna d’OpenAI : 0,10 et 0,50 dollar. Anthropic le compare à Luna dans ses propres tableaux, et Haiku 5.5 le devance sur toutes les catégories testées : 1 620 contre 1 437 sur GDPval-AA, 72,4 % contre 48,9 % sur OSWorld, 39,2 % contre 16,4 % sur Terminal-Bench.
Le seuil de bascule joue en sens inverse. Luna relève ses prix à 272 000 jetons, mais seulement à 0,20 et 0,75 dollar, quand Haiku 5.5 multiplie les siens par cinq dès 100 000. Pour un prompt de 150 000 jetons, Luna reste nettement moins cher. Le choix entre les deux dépend donc de la longueur de vos contextes avant leurs scores.
Le tableau de bord à construire avant de migrer
Pour comparer honnêtement Haiku 4.5 et Haiku 5.5, quatre mesures suffisent, à relever sur vos propres traces plutôt que sur la grille :
- le nombre de jetons consommés par tâche avec le nouveau tokenizer, à recompter et non à déduire de l’ancien ;
- la part de vos requêtes qui dépasse 100 000 jetons ;
- le niveau de raisonnement réellement utilisé, et le nombre de jetons de réflexion qu’il génère ;
- le taux de réussite à la première passe, car une tâche ratée puis relancée coûte deux fois.
Côté essai, Anthropic déploie cette semaine un crédit API mensuel pour les abonnés Max et Team de la plateforme Claude : 100 dollars pour Max 5x, 200 dollars pour Max 20x, jusqu’à 500 dollars mutualisés pour Team. Les crédits ne se reportent pas d’un mois sur l’autre. De quoi chiffrer un coût par tâche réel sans engager de budget.
Mon avis
Quand deux éditeurs affichent le même 0,10 dollar, la grille ne départage plus rien, et personne ne publie encore le chiffre qui compterait : le coût d’une tâche réussie. Je le réclame comme critère de comparaison dès la prochaine génération de modèles, faute de quoi les équipes continueront à choisir sur un prix par jeton que le tokenizer et le raisonnement rendent presque décoratif. Haiku 5.5 sera un excellent sous-agent pour qui l’aura mesuré, et une mauvaise surprise de facturation pour les autres.
Sources
Ils m’ont fait confiance
« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »
Évaluation client · projet WordPress · septembre 2026
5,0/5 sur 17 évaluations
Faire appel à mes services →