
Demandez à Claude Opus 5.5 d’analyser un malware ou de valider une vulnérabilité : le modèle refusera souvent. Faites la même demande depuis un compte vérifié du Cyber Verification Program (CVP) et les mêmes poids répondront. Seul l’interlocuteur a changé.
Anthropic a annoncé le 6 octobre l’extension de ce programme, qui fusionne deux dispositifs lancés il y a environ six mois : Project Glasswing, qui donnait à un petit groupe d’organisations protégeant les logiciels les plus critiques l’accès à Claude Mythos, et le CVP, qui offrait à des équipes de sécurité vérifiées des garde-fous allégés sur Claude Opus et Claude Sonnet.

Complétez votre site, carte par carte
J’ai conçu TresoRank pour détecter ce qui manque à votre visibilité SEO & GEO : contenus, enrichissements, maillage ou optimisations techniques. Chaque opportunité devient une carte à activer.
Analyser mon site gratuitement →Filtrer la requête ou contrôler l’identité
Jusqu’ici, les modèles grand public d’Anthropic (Claude Opus 5.5, Claude Fable 5.1, Claude Sonnet 5.5) appliquent des protections cyber que l’éditeur qualifie de conservatrices : elles bloquent la plupart du travail offensif ou assimilé. La logique est celle du filtre en entrée. Le modèle ne sait pas qui parle, il évalue donc la requête et refuse dès qu’elle ressemble à une attaque.
Le domaine se prête mal à cet exercice. Anthropic le reconnaît lui-même : la même capacité qui permet à une équipe de trouver et corriger une faille permet à un attaquant de l’exploiter. Un classifieur qui juge le texte d’une requête ne peut pas distinguer l’analyste d’un centre d’opérations de sécurité (SOC) du criminel qui a copié le même prompt. Il bloque les deux, ou il laisse passer les deux. L’éditeur admet d’ailleurs poursuivre un travail de réduction des faux positifs, y compris pour la programmation sécurisée ordinaire.
Le CVP prend le problème par l’autre bout. Plutôt que de deviner l’intention depuis la requête, on vérifie l’identité en amont et on desserre les classifieurs pour ceux qui ont passé le contrôle. Le blocage par le modèle cède la place à une confiance accordée à une organisation, avec des conditions et des contrôles de sécurité propres à chaque niveau.
Trois niveaux d’accès, dont deux documentés
Le programme repose désormais sur trois niveaux d’accès, tous ouverts à Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 et aux futurs modèles. Le texte d’annonce n’en détaille que deux.
- Defense Access couvre le travail défensif : opérations de SOC, réponse à incident, rétro-ingénierie de malware, analyse et validation de vulnérabilités. Sont visés les équipes de sécurité d’entreprises, d’associations, d’universités et d’administrations qui défendent des systèmes qu’elles possèdent ou maintiennent, les opérateurs d’infrastructures critiques de toute taille (hôpital régional, régie municipale), les petites sociétés de sécurité, les mainteneurs open source et les chercheurs individuels qui ont déjà signalé des vulnérabilités. Délai de réponse visé : quelques jours.
- Red Team Access ajoute les tests d’intrusion et le red teaming autorisés. Réservé aux organisations (équipes internes, équipes gouvernementales, cabinets de pentest), il impose de ne tester que des systèmes dont on a l’autorisation. Les candidatures prennent quelques semaines, et les demandeurs sont inscrits au niveau Defense Access le temps de l’examen. Les chercheurs individuels n’y sont pas éligibles.
Même au plus haut niveau, un filtre subsiste. Les actions susceptibles de causer des dommages physiques ou une perturbation de masse restent bloquées en temps réel : déploiement d’un rançongiciel, atteinte à des systèmes physiques, test d’intrusion sur des systèmes de sécurité à haut risque. L’identité vérifiée desserre le filtre sans le supprimer.
Neutralité d’un côté, efficacité de l’autre
Le filtre de contenu promet la neutralité : tout le monde est traité pareil, aucune décision humaine n’est requise. Il paie cette égalité par une inefficacité durable. Le défenseur sérieux perd du temps à contourner des refus, l’attaquant motivé reformule ou change d’outil.
La vérification d’identité promet l’efficacité : le défenseur accède à la pleine puissance du modèle. Elle paie ce gain par de la friction administrative et un pouvoir de décision déplacé. Anthropic devient juge de qui est un professionnel légitime, avec ses critères, ses délais et ses angles morts. Un chercheur indépendant sans historique de vulnérabilités publiées, ou un pays où les organisations échappent aux catégories prévues, risque de rester du côté des refus.
La sécurité elle-même impose des réserves. Un compte légitime peut être compromis, un employé peut déraper : vérifier qui se connecte ne dit rien de ce qu’il compte faire. D’où la logique de niveaux, qui échelonne les contrôles selon la dangerosité de l’usage, et le maintien d’un plafond de blocages pour le pire.
Monter son dossier et prévoir deux régimes d’outils
Si vous défendez un système, la première démarche est de déterminer à quel niveau votre activité se rattache, puis de constituer le dossier : périmètre des systèmes, preuves d’autorisation, historique de divulgations. Les délais annoncés, quelques jours d’un côté, quelques semaines de l’autre, se planifient comme une dépendance de projet.
Il faut aussi prévoir deux régimes dans vos outils. Les agents et pipelines qui s’appuient sur les modèles généralistes continueront de se heurter aux garde-fous conservateurs, tandis que ceux branchés sur un compte vérifié se comporteront différemment, avec des journaux et des contrôles d’accès à la hauteur de ce que l’éditeur attend en échange.
Le procédé pourrait s’appliquer à d’autres domaines sensibles, bien au-delà des failles et des malwares. Le CVP en est le premier terrain d’essai à grande échelle, et Anthropic y teste une idée qui dépasse son propre catalogue : l’accès à une capacité dangereuse se négocie désormais sur le nom de celui qui la demande.
Sources
Ils m’ont fait confiance
« Il ne se contente pas de corriger les symptômes, il cherche à comprendre l'origine des problèmes et à sécuriser les modifications effectuées. J'ai réellement le sentiment d'avoir trouvé un développeur qui comprend à la fois la technique et les enjeux globaux du projet. »
Évaluation client · projet WordPress · septembre 2026
5,0/5 sur 17 évaluations
Faire appel à mes services →