
L’essentiel
- Des équipes d’Accenture vont travailler à l’intérieur d’Anthropic, via Faculty, pour tester les modèles et vérifier les mesures de sécurité.
- Les deux groupes prévoient au moins 1 milliard de dollars sur cinq ans ; l’action Accenture a gagné 8 % hors séance après l’annonce.
- Anthropic reconnaît qu’aucun standard ne régit aujourd’hui l’accès des évaluateurs ni leurs communications.
- Quelques heures plus tôt, un collectif d’organisations d’évaluation soutenu par Geoffrey Hinton et Stuart Russell publiait ses conditions minimales d’indépendance.
Anthropic va héberger ses propres évaluateurs. Des équipes d’Accenture travailleront à l’intérieur du laboratoire, au contact des modèles et des personnes qui les construisent, pour au moins un milliard de dollars sur cinq ans. Le marché a tranché en quelques minutes : 8 % de hausse pour Accenture hors séance. Quelques heures plus tôt, un collectif d’organisations d’évaluation publiait la liste des garanties sans lesquelles un évaluateur logé chez l’évalué ne sert à rien. Aucune ne figure dans ce qui a été rendu public.

Complétez votre site, carte par carte
J’ai conçu TresoRank pour détecter ce qui manque à votre visibilité SEO & GEO : contenus, enrichissements, maillage ou optimisations techniques. Chaque opportunité devient une carte à activer.
Analyser mon site gratuitement →Trois clauses manquent à l’accord Anthropic-Accenture
Anthropic a décrit le montage sur son compte officiel. L’exécution passe par Faculty, entreprise britannique rachetée par Accenture au premier trimestre, chargée de tester les modèles, de conduire les évaluations d’alignement et de vérifier les mesures de sécurité.
Le milliard finance une capacité d’évaluation : des équipes, des outils, du temps machine. Il ne dit rien du mandat. Un évaluateur intégré ne vaut que par trois clauses : ce à quoi il accède, ce qu’il a le droit de publier, et ce qui se passe quand il conclut qu’un modèle ne doit pas sortir. Anthropic admet d’ailleurs qu’aucun standard ne régit pour l’heure l’accès des évaluateurs ni leurs communications, et s’attend à faire évoluer son approche.
Les garanties que Hinton et Russell ont signées
L’AI Evaluator Forum a publié ses conditions minimales de collaboration avec les laboratoires. Il réunit notamment METR et AVERI, l’institut dirigé par Miles Brundage, ancien responsable de la recherche sur les politiques publiques chez OpenAI. Ces conditions sont courtes et très concrètes :
- des canaux directs et sans filtre vers le conseil d’administration et les organes de surveillance ;
- la possibilité de rendre publiques les conclusions ;
- des protections contre les représailles et contre les interférences de l’entreprise évaluée ;
- l’accès aux mêmes systèmes, données, outils et espaces physiques que les équipes internes.
Geoffrey Hinton et Stuart Russell figurent parmi les signataires. Satya Nadella, patron de Microsoft, a dit accueillir favorablement l’idée d’évaluateurs intégrés. Aucune de ces conditions ne coûte un milliard de dollars : ce sont des règles de procédure, et leur absence dans le montage annoncé pèse plus lourd que le montant.
Sam Altman a annoncé le même mouvement chez OpenAI, sans dire quels évaluateurs seront retenus, quand, ni ce qu’ils pourront publier. Le précédent invite à la prudence : Apollo Research n’a disposé que de trois jours pour tester GPT-6 Astra, et a écrit que le faible taux de comportements déviants observé ne disait rien de l’alignement du modèle.
Accenture préférée aux spécialistes de l’évaluation
Le choix a surpris. Les discussions sur les évaluateurs intégrés citaient jusqu’ici METR, Redwood Research ou Apollo Research, des structures dont l’évaluation de modèles est le métier. Accenture n’est pas réputée pour ses travaux de recherche à la pointe ; Anthropic met en avant son expérience opérationnelle auprès de grandes entreprises et d’agences publiques, et sa distance avec le milieu de l’IA, celle d’une société cotée née bien avant la vague actuelle.
L’argument tient debout : les organisations spécialisées vivent souvent de financements issus du même milieu que les laboratoires qu’elles examinent. Mais l’indépendance capitalistique et l’indépendance opérationnelle sont deux choses différentes. Un prestataire payé par l’entreprise qu’il inspecte, sur un contrat renouvelable, n’a aucun besoin d’être malhonnête pour devenir prudent. La Bourse a d’ailleurs salué un contrat, pas une garantie.
La meilleure justification du dispositif vient d’ailleurs. Des agents d’IA déployés par OpenAI et par Anthropic ont réussi à pirater des sites externes sans déclencher la moindre alerte à l’intérieur des laboratoires. La détection interne a manqué son objet. Voilà l’argument le plus solide en faveur d’un regard extérieur, et aussi l’étalon auquel se jugera celui-ci : il devra parler quand l’interne se taira.
Un rapport que personne ne lira ne sert à rien
Si vous mettez ces modèles en production, vous héritez du comportement de leurs agents : accès réseau, outils connectés, actions déclenchées sans supervision humaine. Un rapport d’évaluation que vous ne pouvez pas lire ne vous aide en rien à arbitrer. D’où l’importance de la publication : verra-t-on un jour un compte rendu de Faculty, même partiel, même expurgé ?
Anthropic prévoit d’annoncer d’autres évaluateurs dans les prochaines semaines. L’entreprise discute avec METR et des organisations à but non lucratif pour monter des évaluations intégrées que ces dernières financeraient elles-mêmes, un montage inverse où celui qui paie n’est pas celui qui est évalué. Restent les conditions du forum : tant qu’elles ne figurent pas noir sur blanc dans un contrat, elles valent une pétition d’intention.
Certains critiques estiment que l’autorégulation défendue par Dario Amodei sert surtout à esquiver la responsabilité des dérapages des modèles. Anthropic répond que le recours à des évaluateurs ne réduit pas sa responsabilité mais la rend plus vérifiable, et que la sécurité de ses modèles reste à sa charge. Vérifiable par qui, exactement ? Tant que les conclusions restent à l’intérieur du bâtiment, la vérifiabilité reste un mot.
Mon avis
Financer l’outillage d’un évaluateur est utile, le rendre indépendant est un autre exercice, et Anthropic a fait le premier en laissant le second ouvert. Quand les prochains contrats seront annoncés, je ne regarderai ni le montant ni le nom du partenaire, mais la ligne qui décrit ce qui arrive le jour où Faculty écrit qu’un modèle ne doit pas sortir. Sans elle, ce dispositif produira des rapports, jamais des refus. Et un secteur incapable de se dire non finit toujours par se le faire dire par un régulateur, dans des termes qu’il n’aura pas choisis.
Ils m’ont fait confiance
« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »
Évaluation client · projet WordPress · septembre 2026
5,0/5 sur 16 évaluations
Faire appel à mes services →