Gemini 4 Argon coûte moins cher au token, pas à la tâche

Gemini 4 Argon coûte moins cher au token, pas à la tâche

L’essentiel

  • Google présente Gemini 4 Argon, son premier modèle de pointe depuis Gemini 3.1 Pro, réservé pour l’instant aux défenseurs en cybersécurité du programme Fairwind.
  • Le tarif de lancement est fixé à 2 dollars par million de tokens en entrée et 10 dollars en sortie, soit la moitié du tarif normal annoncé.
  • Artificial Analysis lui attribue 53 points sur son Intelligence Index, à égalité avec GPT-6 Astra et Claude Fable 5.1, derrière Claude Opus 5.5 (58 points).
  • Pour obtenir ce score, Argon produit plus de deux fois plus de tokens de sortie qu’Astra : il reste 40 % moins cher par tâche au tarif de lancement, mais devient environ 20 % plus cher au tarif normal.

Google a dévoilé Gemini 4 Argon mercredi, et le billet d’annonce affiche son prix bien avant sa date de sortie. Le tarif est chiffré au centime, la disponibilité se résume à trois mots : « dès que possible ».

Sur une grille tarifaire, Argon écrase la concurrence. Mesuré sur une tâche complète, l’écart fond, et il s’inversera dès que la remise de lancement prendra fin.

Une grille tarifaire taillée pour la comparaison

Google annonce 2 dollars par million de tokens (les fragments de texte que le modèle lit et produit, unité de facturation des API) en entrée et 10 dollars en sortie. Les tokens d’entrée mis en cache (le contexte déjà transmis que le modèle relit sans le retraiter) coûtent 95 % de moins, soit environ 10 centimes le million. En face, GPT-6 Astra d’OpenAI et Claude Fable 5.1 d’Anthropic sont facturés 10 dollars en entrée et 50 dollars en sortie.

Sur la sortie, poste qui pèse le plus lourd pour un modèle de raisonnement, Astra coûte donc cinq fois plus cher au token. Le rapport est spectaculaire, mais il repose sur un tarif de lancement, assorti d’un appel de note dans l’annonce de Google. Le tarif normal est déjà connu : 4 dollars en entrée, 20 dollars en sortie. L’écart avec Astra tombe alors de cinq à deux et demi.

Et il disparaît face à Claude Opus 5.5, facturé exactement 4 et 20 dollars. À tarif plein, le modèle phare de Google coûte au token le même prix que le modèle qui domine les classements.

Au coude-à-coude avec Astra, cinq points derrière Opus

La première mesure indépendante vient d’Artificial Analysis. À son niveau de raisonnement le plus élevé disponible, baptisé « High », Argon obtient 53 points sur l’Intelligence Index du cabinet. C’est autant que GPT-6 Astra en mode maximal et que Claude Fable 5.1, et un point de plus que GPT-6.1 Sol.

Anthropic garde la tête : Claude Opus 5.5 atteint 58 points, Claude Sonnet 5.5 en totalise 56. Google revendique de son côté la première place sur l’index de Vals, une startup d’évaluation des modèles, avec 68,9 % contre 67 % pour Claude Sonnet 5.5. Deux évaluateurs, deux classements : mieux vaut attendre d’autres mesures avant de couronner qui que ce soit.

Le progrès, lui, est net. Argon gagne 23 points sur Gemini 3.1 Pro Preview, le précédent modèle de pointe de Google, sorti il y a plus de sept mois. Entre les deux, le Gemini 3.5 annoncé a été abandonné en route. Google revient dans le trio de tête, sans le dominer.

Deux fois plus de tokens pour le même score

Un score de 53 points ne se paie pas au token, il se paie au volume de tokens dépensés pour l’atteindre. Or, d’après les mesures d’Artificial Analysis, Argon produit en moyenne 62 000 tokens de sortie par tâche, contre 27 000 pour Astra. Il raisonne plus longuement, écrit davantage, et chaque token de sortie est facturé.

Le cabinet a chiffré la facture. Au tarif de lancement, une tâche de son index coûte 1,99 dollar avec Argon, soit 60 % du prix d’Astra : cinq fois moins cher au token, le modèle de Google n’économise plus que 40 % une fois la tâche terminée. Au tarif normal, la même tâche montera à 3,98 dollars, environ 1,2 fois le coût d’Astra. Sorti de la promotion, le modèle présenté comme le moins cher de sa catégorie coûtera donc plus que son rival direct, à score égal.

Pour un agent qui enchaîne des centaines d’appels par jour, c’est ce coût par tâche accomplie qui finit sur la facture. Le prix affiché au million de tokens ne dit rien de la verbosité d’un modèle, et deux modèles au même score peuvent coûter du simple au double selon leur façon de raisonner.

Un million de tokens en sortie, une promesse à double tranchant

Google porte la limite de sortie de 64 000 à un million de tokens, une première selon l’éditeur. L’idée : laisser le modèle dérouler des centaines de milliers de tokens de réflexion dans une seule trajectoire pour résoudre un problème difficile d’une traite. Une nouvelle fonction de l’API (interface de programmation) Gemini, Long Decode Continuation, met en pause les réponses très longues et les reprend par requêtes successives pour éviter les timeouts.

Une trajectoire complète d’un million de tokens coûte 10 dollars au tarif de lancement, 20 au tarif normal. Les exemples internes cités par Google donnent l’échelle des chantiers visés : migration de bases C et C++ vers Rust jusqu’aux plus de 800 000 lignes du noyau Zircon de Fuchsia, optimisations mémoire qui ont libéré plus de 300 TiB (tébioctets) dans les centres de données du groupe. Sur ce type de travail, la consommation de tokens se mesure en millions, pas en milliers.

Un accès verrouillé, des tests à préparer

Pour l’instant réservé aux défenseurs en cybersécurité du programme Fairwind, Argon ouvrira d’abord aux clients payants de l’API et aux abonnés Google AI Ultra, sans calendrier.

Ce délai laisse le temps de préparer la bascule. Avant de confier un agent à Argon, comparez les modèles sur vos propres tâches, en coût par tâche réussie, et plafonnez le budget de tokens de chaque trajectoire. Le cache à 95 % de remise reste le levier le plus sûr pour les agents qui relisent sans cesse le même contexte, une base de code ou un dossier juridique par exemple. Et pour le budget, le seul prix qui compte est celui qui s’appliquera après la promotion.

Mon avis

Le prix au million de tokens est devenu une métrique de vitrine, et Google l’exploite en affichant un tarif promotionnel pour un modèle encore fermé au public. Je compte en coût par tâche réussie, et sur ce critère Argon ne passe sous Astra que le temps de la promotion. Ce qui me ferait changer d’avis serait un engagement à maintenir 2 et 10 dollars après la période de lancement ; tant que Google ne le prend pas, je raisonne au tarif plein, celui d’Opus 5.5, avec cinq points de moins.

Sources

Ils m’ont fait confiance

« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »

Évaluation client · projet WordPress · septembre 2026

5,0/5 sur 17 évaluations

Faire appel à mes services →

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *