Anthropic は、Claude Mythos を含む同社の最強の AI モデルを使用する無料のオプトイン サービスである OSS Scanner を開始しました。これにより、適格なオープンソース プロジェクトのセキュリティ脆弱性を定期的にスキャンし、完全にモデルで生成されたバグ レポートがメンテナーに直接配信されます。
同社のブログ投稿で水曜日に発表されたこのサービスは、Anthropic のセキュリティ業務における静かな変化の産物である。同社のモデルは最近、Anthropic のセキュリティ チームが検証するよりも早く脆弱性を発見している。ソフトウェアのセキュリティを再構築するツールを追跡している開発者にとって、このリリースは、オープンソース インフラストラクチャにおける AI 開発 を取り上げる重要な瞬間です。
プロジェクト Glasswing から公共サービスへ
OSS Scanner は、Anthropic の内部脆弱性発見活動である Project Glasswing 中に脆弱性を探索するために Claude を使用した Anthropic の経験から情報を得ています。その研究の数字は、Anthropic がパイプラインを一般に公開している理由を説明しています。
Anthropic 社は、過去 6 か月間で、同社の最新モデルにより、世界で最も重要なソフトウェア プロジェクトのいくつかにおいて 29,000 件を超える脆弱性の候補が表面化したが、同社が手動でレビューしてトリアージできたのはそのうち約 6,000 件のみであると述べています。モデルの能力ではなく人間の検証能力がボトルネックになっています。
需要側も同様の話をします。 Anthropic の報告によると、最初のレポートを受け取ったメンテナーは、会社が持っているすべてのものを要求することが増えています。パッチを含む未検証の結果の一括提出を要求したメンテナーには、すでに 5,000 件近くのレポートが直接送信されています。
能力の背景は厳しい。 Anthropic によると、学術的な脆弱性発見のベンチマークである CyberGym では、大規模な言語モデルによる脆弱性の発見率は、昨年初めには 20% 未満でしたが、今年は 85% 以上にまで増加しました。これにより、AI のバグ報告がノイズから実用的な発見に変わりました。
テストで数値がどのように維持されたか
Anthropic は立ち上げ前に、数十のオープンソース プロジェクトを使用してパイプラインを検証し、数百のバグ レポートを作成しました。その中には、認証されていないリモート コード実行のエクスプロイトに連鎖する可能性があると同社が主張する脆弱性も含まれています。
最も重要なテストには外部の監視が含まれていました。 Anthropic は、協調的脆弱性開示 (CVD) の調査結果をレビューする専門ペネトレーション テスターに、48 のプロジェクトから抽出されたスキャナーからの 97 件の重大かつ重大度の高い調査結果を調査するよう依頼しました。そのうち 85 件 (88%) が Anthropic の CVD プロセスの基準を満たしていました。残りの 12 個のうち、11 個は本物ですが、既知の問題または同じスキャンで得られた他の結果が重複しています。完全な偽陽性は 1 つだけでした。
同社によれば、各レポートには自己完結型の再現機能と、いつ欠陥が導入されたかを判断するための二分法を含む脆弱性の説明が含まれているという。
トレードオフ: 確実性よりもスピード
OSS Scanner の中心となる設計上の決定は、その最大のリスクでもあります。レポートは完全にモデルによって生成され、人間によるレビューやトリアージはありません。 Anthropic 氏は、これによりスキャンがより速く、より頻繁に実行できるようになりますが、一部のレポートが不正確または無効になることも明らかにしています。
同社は、メンテナンス者の需要に応じてトレードオフを設定しています。エクスプロイトは数分で開発できるようになったため、プロジェクトでは、人間による精査を待つよりも、未検証の発見をすべて、提案されたパッチとともに即座に受け取ることを好む傾向がますます高まっています。 OSS Scanner は、長年にわたってファザーを使用してオープンソース ソフトウェアをスキャンしてきた Google の OSS-Fuzz からインスピレーションを得て、同じロジックを AI 主導のコード分析に適用します。
従来の処理を好むプロジェクトも除外されません。Anthropic は、特にレポート自体をトリアージするリソースのないプロジェクトについては、既存の CVD プロセスを通じて人間が検証した脆弱性レポートを手動で開示し続けると述べています。生の結果が生成されたらすぐに必要な場合は、オプションのファストトラックを利用できます。
登録できる人 — そして Anthropic が発表したその他の内容
対象となるプロジェクトのコア メンテナは、標準プロジェクト テンプレートに従って GitHub リポジトリにプル リクエストを送信することで登録できます。適格性は OSS-Fuzz の基準を反映しています。プロジェクトはインフラストラクチャとユーザーのセキュリティに重大な影響を与える必要があり、受け入れはケースバイケースで決定されます。
このスキャナは、より広範な Anthropic セキュリティ イニシアチブとともに提供されます。同社のサイバー検証プログラムでは、資格のあるセキュリティ専門家が高度なサイバー機能と削減されたブロッキング分類子を利用できるようになります。Anthropic は今週初めにこのプログラムを拡張し、セキュリティ チーム向けに 3 層のクロード アクセスを追加しました。別の Claude for OSS の取り組みでは、無料の Claude Max 20x サブスクリプションを提供し、保守者が脆弱性を修正し、プロジェクトを改善できるようにします。 SiliconANGLE はまた、重要インフラの保護に焦点を当てた新しい Anthropic プログラムについても報告し、今週の発表を防御的なサイバーセキュリティへの協調的な推進として枠組み化しました。
オープンソース セキュリティにとっての意味
OSS Scanner が宣伝どおりに機能する場合、オープンソース セキュリティの構造的な変化を示すものになります。AI がバグを発見し、人間が探索から検証に移行することになります。この変化により、実際の負担はメンテナーに移り、自動パッチを信頼するかどうかを判断する際に、機械が生成したレポート (一部は間違っています) をトリアージしなければなりません。
88% の検証率は、信号対雑音比が、少なくとも重要なインフラストラクチャ プロジェクトでは、保守者が時間を費やす価値があるほど十分に優れていることを示しています。より広範なエコシステムが同意するかどうかは、登録数、そして最初の大量の報告後に静かにオプトアウトする登録プロジェクトの数に現れます。
---
AI の先を行く最新の AI ニュース、分析、画期的な情報をすべて 1 か所で入手できます。
AI ニュースをもっと読む→