Anthropic a annoncé mardi une expansion majeure de ses efforts d'accès aux modèles axés sur la sécurité, en restructurant son initiative d'accès vérifié en un programme formel de cybervérification (CVP) avec trois niveaux distincts pour les professionnels de la cybersécurité. Cette décision intervient alors que la société a révélé que son initiative Project Glasswing avait découvert au moins 129 000 vulnérabilités logicielles vérifiées depuis avril.
Le programme restructuré permet aux équipes de sécurité contrôlées d'exécuter les modèles les plus performants d'Anthropic, notamment Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, avec des protections réduites et des classificateurs bloquants, des autorisations qui ne sont normalement pas disponibles pour les utilisateurs généraux. Selon Anthropic, l’objectif est de mettre les capacités de l’IA entre les mains des défenseurs avant que des acteurs malveillants n’utilisent les mêmes outils comme armes. Pour plus de contexte sur cette histoire, consultez notre tendances IA.
Trois niveaux d'accès, trois scénarios de menaces
Le nouveau programme s'organise autour de trois niveaux d'accès, chacun adapté à un type de travail de sécurité différent :
- Defense Access couvre les opérations défensives telles que la réponse aux incidents, l'ingénierie inverse des logiciels malveillants, ainsi que l'analyse et la validation des vulnérabilités.
- Red Team Access ajoute des tests d'intrusion autorisés et du red-teaming aux cas d'utilisation défensifs, permettant des attaques simulées contre des systèmes que les organisations sont autorisées à tester.
Les organisations et les équipes de sécurité individuelles postulent pour le niveau qui correspond à leur travail, et Anthropic examine chaque candidature avant d'accorder l'accès. La société a déclaré que les trois niveaux incluent l’accès à ses modèles phares actuels ainsi qu’aux nouveaux modèles lancés à l’avenir.
Les mesures de sauvegarde ont encore du mordant – de manière sélective
Anthropic a associé l'annonce à des données d'évaluation destinées à montrer que le système de niveaux sépare le travail défensif inoffensif des capacités véritablement dangereuses. Dans une évaluation CyScenarioBench sur Claude Opus 5.5, la société a signalé que les protections bloquaient 46 des 50 tâches du niveau Defense Access. Dans le niveau Red Team Access sur le même modèle, aucune des tâches n’a été bloquée et le modèle a réalisé 34 tâches sur 50 – le même taux d’achèvement enregistré lorsqu’aucune protection n’était appliquée.
En revanche, sans accès CVP, chaque tâche était bloquée dès la première invite, selon Anthropic.
"Ces évaluations nous donnent la certitude que nous pouvons mettre des cybercapacités avancées à la disposition d'un ensemble plus large de défenseurs en toute sécurité, élargissant ainsi les efforts défensifs que nous avons commencés avec le projet Glasswing", a déclaré la société dans son annonce, qui a été largement rapportée par The Hacker News, Reuters et SecurityWeek.
La conception reflète le pari que la plupart des travaux de sécurité défensifs (correctifs, analyse des journaux, triage des logiciels malveillants) peuvent se dérouler sous des garde-fous stricts, tandis que les tests offensifs légitimes nécessitent un couloir plus large. Cela reflète également la façon dont le secteur de la sécurité gère depuis longtemps les outils à double usage : examiner le praticien, pas seulement l'outil.
L'empreinte croissante de Glasswing
L'expansion du programme est étroitement liée au projet Glasswing, l'initiative d'Anthropic visant à appliquer ses modèles au renforcement des logiciels critiques. La société a déclaré que Glasswing avait découvert au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026, et 5 500 vulnérabilités vérifiées supplémentaires entre avril et octobre grâce à des efforts d'analyse open source.
Parmi les vulnérabilités vérifiées, plus de 33 000 ont jusqu’à présent été classées comme critiques ou de gravité élevée – un chiffre qu’Anthropic décrit comme probablement un sous-estimation importante, car il s’appuie sur les données d’enquête d’un sous-ensemble uniquement de partenaires de Glasswing. L’entreprise estime que l’impact réel pourrait être au moins cinq fois supérieur.
Une vue mesurée de la découverte de vulnérabilités basée sur l'IA
Une analyse indépendante suggère que le flot de failles découvertes par l’IA ne se traduit pas directement par une vague correspondante de failles exploitées. Dans une analyse publiée à la fin du mois dernier, Patrick Garrity, chercheur chez VulnCheck, a découvert que seules 2 des 300 vulnérabilités découvertes par Anthropic ou le projet Glasswing – soit environ 0,67 % – ont été exploitées dans la nature.
Les deux failles exploitées sont CVE-2026-26980, une vulnérabilité d'injection SQL dans Ghost CMS, et CVE-2026-61500, une faille de falsification de session dans Rejetto HTTP File Server. Les données confirment une nuance sur laquelle les chercheurs en sécurité ont souligné : l'IA réduit les obstacles à la découverte de vulnérabilités, mais la plupart des failles qu'elle fait apparaître n'ont jamais été sur les radars des attaquants.
Cette annonce intervient également au milieu d’un débat plus large sur le travail de sécurité généré par l’IA. Les recherches de 1Password et Veracode ont montré que les correctifs de vulnérabilité écrits par l’IA peuvent eux-mêmes introduire de nouvelles failles, soulignant que l’automatisation facilite mais ne remplace pas la vérification humaine.
Ce que cela signifie pour le secteur de la sécurité
Pour les équipes de sécurité, le CVP réduit l’énergie d’activation nécessaire à l’utilisation des modèles frontaliers pour un véritable travail défensif. Les intervenants en cas d'incident bénéficient d'un chemin sanctionné vers une assistance à l'analyse des logiciels malveillants ; les testeurs d'intrusion bénéficient d'un environnement gouverné pour les attaques assistées par l'IA ; et le petit groupe d’organisations auditant elles-mêmes les systèmes de sécurité de l’IA bénéficie de l’accès le moins restreint.
Pour Anthropic, le programme est à la fois une stratégie de sécurité et une stratégie commerciale. Cela concrétise la position de l'entreprise selon laquelle les cybercapacités puissantes devraient être libérées délibérément, auprès de défenseurs sélectionnés, plutôt que complètement supprimées – un contraste avec les concurrents qui ont été soumis à un examen minutieux des modèles avec des contrôles cybernétiques plus faibles. Cela approfondit également les relations d'Anthropic avec les entreprises les plus susceptibles de payer pour un accès au modèle frontalier : les gouvernements, les opérateurs d'infrastructures critiques et les grands fournisseurs de sécurité.
La société n'a pas annoncé de modifications tarifaires liées au programme, et les candidatures sont traitées via les canaux d'accès approuvés existants d'Anthropic. Compte tenu de l'ampleur de ce que Glasswing a déjà révélé – et de l'aveu même de l'entreprise selon lequel les chiffres sous-estiment probablement la réalité – le secteur de la sécurité surveillera combien de ces 129 000 découvertes seront corrigées avant que les attaquants ne les trouvent en premier.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →