Anthropic a lancé OSS Scanner, un service opt-in gratuit qui utilise les modèles d'IA les plus puissants de l'entreprise, y compris Claude Mythos, pour analyser périodiquement les projets open source éligibles à la recherche de vulnérabilités de sécurité et fournir des rapports de bogues entièrement générés par le modèle directement aux responsables.

Le service, annoncé mercredi dans un article de blog de l'entreprise, est le produit d'un changement discret dans le travail de sécurité d'Anthropic : ses modèles ont récemment découvert les vulnérabilités plus rapidement que la propre équipe de sécurité d'Anthropic ne peut les vérifier. Pour les développeurs qui suivent les outils remodelant la sécurité des logiciels, le lancement est un moment important pour notre couverture des développements de l'IA dans l'infrastructure open source.

Du projet Glasswing à un service public

OSS Scanner s'appuie sur l'expérience d'Anthropic utilisant Claude pour rechercher les vulnérabilités lors du projet Glasswing, l'effort interne de découverte de vulnérabilités de l'entreprise. Les chiffres de ces travaux expliquent pourquoi Anthropic ouvre le pipeline au public.

Au cours des six derniers mois, Anthropic affirme que ses derniers modèles ont révélé plus de 29 000 vulnérabilités potentielles dans certains des projets logiciels les plus importants au monde, mais la société n'a pu examiner et trier manuellement qu'environ 6 000 d'entre elles. La capacité de validation humaine, et non la capacité de modèle, est devenue le goulot d'étranglement.

Du côté de la demande, le constat est similaire. Anthropic rapporte que les responsables qui reçoivent ses premiers rapports demandent de plus en plus tout ce que l'entreprise possède : près de 5 000 rapports ont déjà été envoyés directement aux responsables qui ont demandé des soumissions groupées de résultats non vérifiés, y compris les correctifs.

Le contexte capacitaire est sombre. Sur CyberGym, une référence académique en matière de recherche de vulnérabilités, les grands modèles de langage sont passés de moins de 20 % des vulnérabilités au début de l'année dernière à plus de 85 % cette année, selon Anthropic – un bond qui a transformé les rapports de bugs de l'IA du bruit en résultats exploitables.

Comment les chiffres ont résisté lors des tests

Avant son lancement, Anthropic a validé le pipeline avec des dizaines de projets open source, produisant des centaines de rapports de bogues, y compris des vulnérabilités qui, selon la société, pourraient être enchaînées dans des exploits d'exécution de code à distance non authentifiés.

Le test le plus révélateur impliquait un examen externe. Anthropic a demandé aux testeurs d'intrusion experts qui examinent ses résultats de divulgation coordonnée de vulnérabilités (CVD) d'examiner 97 résultats critiques et de haute gravité du scanner, tirés de 48 projets. Parmi ceux-ci, 85 (88 %) ont atteint la barre du processus CVD d'Anthropic. Sur les 12 restants, 11 étaient des problèmes réels mais reproduisaient des problèmes connus ou d’autres résultats de la même analyse. Un seul était un faux positif.

Chaque rapport, selon la société, contient un reproducteur autonome et une explication de la vulnérabilité, y compris une bissection pour déterminer quand la faille a été introduite.

Le compromis : la rapidité plutôt que la certitude

La décision centrale de conception d'OSS Scanner constitue également son plus grand risque : les rapports sont entièrement générés par modèle, sans examen ni tri humain. Anthropic indique explicitement que cela permet une analyse plus rapide et plus fréquente, mais également que certains rapports seront incorrects ou invalides.

La société considère le compromis comme étant réactif à la demande des responsables. Étant donné que les exploits peuvent désormais être développés en quelques minutes, les projets préfèrent de plus en plus recevoir immédiatement chaque découverte non vérifiée – avec les correctifs proposés attachés – plutôt que d’attendre une vérification humaine. Inspiré par OSS-Fuzz de Google, qui analyse les logiciels open source avec des fuzzers depuis des années, OSS Scanner applique la même logique à l'analyse de code basée sur l'IA.

Les projets qui préfèrent le traitement traditionnel ne sont pas en reste : Anthropic affirme qu'il continuera à divulguer manuellement les rapports de vulnérabilité vérifiés par l'homme via son processus CVD existant, en particulier pour les projets ne disposant pas des ressources nécessaires pour trier eux-mêmes les rapports. Une procédure accélérée facultative est disponible pour ceux qui souhaitent obtenir des résultats bruts dès qu'ils sont générés.

Qui peut s'inscrire – et quoi d'autre annoncé par Anthropic

Les responsables principaux des projets éligibles peuvent s'inscrire en soumettant une pull request à un référentiel GitHub en suivant un modèle de projet standard. L'éligibilité reflète les critères OSS-Fuzz : les projets doivent avoir un impact critique sur l'infrastructure et la sécurité des utilisateurs, les admissions étant décidées au cas par cas.

Le scanner arrive parallèlement à un ensemble plus large d’initiatives de sécurité Anthropic. Le programme de cybervérification de l'entreprise met à la disposition des professionnels de la sécurité qualifiés des capacités cybernétiques avancées et des classificateurs de blocage réduits - un programme qu'Anthropic a étendu plus tôt cette semaine avec trois niveaux d'accès Claude pour les équipes de sécurité. Un effort Claude for OSS distinct fournit des abonnements gratuits Claude Max 20x pour aider les responsables à corriger les vulnérabilités et à améliorer leurs projets. SiliconANGLE a également signalé un nouveau programme Anthropic axé sur la protection des infrastructures critiques, présentant les annonces de la semaine comme une initiative coordonnée en faveur de la cybersécurité défensive.

Ce que cela signifie pour la sécurité open source

Si OSS Scanner fonctionne comme annoncé, cela marque un changement structurel dans la sécurité open source : l'IA trouve les bogues et les humains passent de la recherche à la vérification. Ce changement impose un réel fardeau aux responsables, qui doivent trier les rapports générés par la machine – dont certains sont erronés – tout en décidant de faire ou non confiance aux correctifs automatisés.

Le taux de validation de 88 % suggère que le rapport signal/bruit est désormais suffisamment bon pour valoir le temps d'un responsable, du moins pour les projets d'infrastructures critiques. Le fait que l’écosystème au sens large soit d’accord se manifestera dans le nombre d’inscriptions – et dans le nombre de projets inscrits qui se retireront discrètement après leur premier flot de rapports.

---

Gardez une longueur d'avance sur l'IA

Recevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.

Lire plus d'actualités sur l'IA →