
Jeudi soir, Anthropic a publié sur X un message de trois phrases. Ses modèles servent de plus en plus à construire leurs propres successeurs, écrit le laboratoire, et il veut « éclairer ce progrès pour le public » en partageant « trois mesures qui aident à suivre le développement de l’IA ».
Derrière ces trois phrases, un instrument de mesure, publié au moment exact où le patron du labo réclame un frein.
Selon la page publiée par Anthropic, Claude a « mené » environ 26 % du travail de recherche et développement (R&D) en IA de l’entreprise en août, contre moins de 1 % six mois plus tôt. Quelque 30 000 agents font en permanence de la recherche et de l’ingénierie sur sa principale plateforme interne, sous un dispositif de surveillance capable d’intervenir sur leurs actions. Enfin, sur une semaine de juillet, environ 6 % de la puissance de calcul consacrée à la R&D est allée à la sécurité.

Complétez votre site, carte par carte
J’ai conçu TresoRank pour détecter ce qui manque à votre visibilité SEO & GEO : contenus, enrichissements, maillage ou optimisations techniques. Chaque opportunité devient une carte à activer.
Analyser mon site gratuitement →Cinq jours entre l’appel au frein et le compteur
Il y a quelques jours, dans « Obama veut un plan IA, Anthropic l’a écrit avant lui », nous montrions que le labo avait déjà couché sur le papier son programme de régulation, bien avant que la classe politique ne s’en empare. Une pièce manquait à ce programme : un moyen de savoir où l’on en est.
Le 12 septembre, Dario Amodei publie un billet de blog où il affirme que l’IA progresse « drastiquement plus vite » depuis l’été, portée avant tout par sa capacité croissante à bâtir la génération suivante. Le 17, Anthropic dévoile ses indicateurs. Entre les deux, cinq jours.
La séquence se tient. Qui demande de ralentir doit pouvoir dire à quelle vitesse on roule.
Un frein à quatre paliers sans compteur de vitesse
Dans son billet, Amodei décrit quatre paliers d’accords internationaux, Chine comprise. Le premier interdit certains usages, comme les armes biologiques. Un autre impose des tests de sécurité partagés. Le dernier fixe une « limite de vitesse » à l’auto-amélioration récursive (le fait qu’une IA contribue à concevoir sa propre version suivante), sur le modèle des traités SALT de limitation des armements stratégiques.
Or une limite de vitesse suppose un radar. Un traité de limitation exige que les signataires s’accordent d’abord sur ce qu’ils comptent. Pour des missiles, l’objet se voit. Pour une IA qui écrit une part du code, des expériences ou des données d’entraînement de la suivante, rien ne se compte spontanément.
Les trois mesures d’Anthropic viennent combler ce vide. Elles donnent un contenu opérationnel à une notion qui, jusqu’ici, relevait du constat d’ingénieur ou de l’intuition de dirigeant.
Six à douze mois, une horloge courte pour une série qui démarre
Amodei fixe aussi une échéance : des systèmes capables de mener seuls des cyberattaques, et de contourner leurs dispositifs de contrôle, pourraient menacer l’ensemble d’Internet d’ici six à douze mois. Il cite l’incident entre OpenAI et Hugging Face, et reconnaît des cas similaires chez Anthropic.
Face à cet horizon, les indicateurs manquent de recul. La part de l’IA dans la R&D compare deux points pris à six mois d’écart, et la répartition du calcul tient sur une seule semaine de juillet. Une accélération se lit sur une courbe, et la série publique commence à peine. Le constat d’un emballement « depuis l’été » repose donc, pour l’instant, sur l’observation interne du labo.
Anthropic ne dit pas non plus à quel rythme ces mesures seront mises à jour, un paramètre qui décide de leur utilité. Publiées une fois par an, elles arriveraient après l’échéance fixée par Amodei lui-même.
Le laboratoire mesuré tient la règle
La limite la plus nette tient à la position de celui qui mesure. Anthropic calcule la part de l’IA dans la fabrication de ses propres modèles, sur ses propres systèmes, avec sa propre méthode. Il en détaille la méthode pour que d’autres laboratoires l’appliquent chez eux, mais aucun acteur extérieur ne peut aujourd’hui refaire le calcul sur les données d’Anthropic.
Le contexte financier n’arrange rien. L’introduction en Bourse qu’on prête à Anthropic pour novembre place le labo dans une période où chaque signal public pèse sur sa valorisation. Un indicateur qui montre que l’IA accélère sert autant l’argument de sécurité que l’argument commercial : il dit à la fois « c’est dangereux » et « nous sommes en avance ».
Amodei esquisse lui-même une parade dans son billet. Il propose d’installer des auditeurs indépendants à demeure dans les entreprises d’IA, avec accès aux systèmes internes et droit de publier leurs conclusions, et Anthropic s’y engage. Si ces auditeurs vérifient un jour les trois mesures, elles changeront de statut. Sans eux, elles restent une communication d’entreprise, sérieuse peut-être, mais invérifiable.
L’aviation civile, qu’Amodei prend en exemple, a mis des décennies à bâtir sa sûreté. Ses statistiques ne tiennent pas leur autorité des compagnies qui volent.
Trois questions à poser à chaque publication
Si vous suivez ces indicateurs, ou si vous comptez vous en servir pour arbitrer vos choix de modèles et d’outils, traitez-les comme n’importe quel benchmark publié par un éditeur :
- qui calcule, et sur quelles données : les systèmes internes d’Anthropic ne sont pas les vôtres, et la part d’IA dans un labo de pointe ne dit rien de celle d’une équipe produit ;
- la méthode reste-t-elle stable d’une publication à l’autre : un indicateur dont la définition bouge ne dessine aucune courbe ;
- un autre laboratoire publie-t-il une mesure comparable : Anthropic a mis sa méthode à disposition de ses concurrents, mais une référence qu’un seul acteur produit ne permet aucune comparaison.
La dernière question pèse plus que les deux autres. Un traité de type SALT se négocie entre plusieurs parties qui acceptent la même unité de compte. Tant qu’Anthropic reste seul à mesurer, ses trois indicateurs décrivent Anthropic, pas l’industrie.
Le test viendra avec la deuxième livraison. Si les chiffres confirment l’accélération et qu’Anthropic continue malgré tout à presser ses propres sorties, le labo aura fourni le radar et démontré du même coup qu’un radar ne ralentit personne. Donald Trump, opposé à tout ralentissement face à la Chine, lira sans doute la même courbe dans l’autre sens.
Sources
Ils m’ont fait confiance
« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »
Évaluation client · projet WordPress · septembre 2026
5,0/5 sur 16 évaluations
Faire appel à mes services →