Searchlight Cyber のセキュリティ研究者らは、OpenAI の GPT-5.6 コーディング モデルが、約 25 ドルの API コストで WordPress の深刻なリモート コード実行の脆弱性を発見できることを実証しました。この発見は、フロンティア AI ツールがどのように武器化され、悪用可能な欠陥を闇市場価格の数分の 1 で発見できるかについての懸念の高まりを具体化しています。
Searchlight Cyber の Web サイトで公開されたこの研究は、GPT-5.6 Sol Ultra と意図的に脆弱な WordPress コードベースを装備した 1 人の研究者が、認証前アクセスからリモート コード実行に至るまでのチェーンを特定できたことを示しています。この結果は、最新の AI 開発全体で追跡されているテーマである、大規模言語モデルの攻撃的なセキュリティの可能性に関する沸騰する議論の中心にあります。
50 万ドルの市場で 25 ドルの発見
この研究の見出しは、その厳しい経済学だ。 Searchlight Cyber によると、脆弱性を購入して政府や民間の買い手に転売する仲介業者であるエクスプロイトブローカーは、信頼性の高い WordPress リモートコード実行の欠陥に対して最大 50 万ドルを支払うことになるという。 WordPress はすべての Web サイトの約 40% で使用されており、コア RCE バグは非常に価値のあるものになっています。
このベンチマークと比較すると、欠陥を見つけるために研究者が GPT-5.6 API 呼び出しに費やした約 25 ドルは驚くべきものです。この作業には、大規模なチーム、特殊なファジング インフラストラクチャ、または数週間にわたる手動監査は必要ありませんでした。代わりに、WordPress のソース コードを第一原理から推論するための有能なコーディング モデルを指示することに依存していました。
研究者らは、管理者が WordPress インスタンスが影響を受けるかどうかを判断できるように、無料のチェッカー ツール wp2Shell.com をリリースしました。彼らは、弁護側に返答する時間を与えるために詳細な公表を差し控えたと述べた。
モデルが欠陥を発見した方法
この発見の中心となるのは、プラットフォームに巨大なプラグイン エコシステムを与えるメカニズムである WordPress のフック システムです。 「wp_enqueue_scripts」や「publish_post」などの名前のフックを使用すると、プラグインが WordPress ライフサイクルのほぼすべての段階にカスタム動作を追加できるようになります。これらは、副作用を実行するアクションと、通過するデータを変更するフィルターに分かれています。
その柔軟性は、広大な攻撃対象領域でもあります。研究者らが設定した課題は、認証されていない開始点からのリモート コード実行を可能にするチェーンを見つけることであり、成功とはサーバーのファイル システムから保護されたファイルを読み取ることができることと定義されます。
OpenAI の推論に重点を置いたコーディング モデルである GPT-5.6 Sol Ultra は、データがどのように WordPress のフックを通過して潜在的に危険な操作に流れ込むかを調査することで分析を実行しました。このモデルの強みは、パターンをやみくもに検索することではなく、コンポーネント間の相互作用について推論することにあり、推論に焦点を当てた最近のモデル リリースでその機能は著しく向上しました。
研究者らは、WordPress の脆弱なコピーを含むリポジトリを中心に演習を組み立てました。これは、成功がフラグ ファイルの抽出を意味するキャプチャ ザ フラグ チャレンジに似た設定です。しかし、彼らは、根本的な脆弱性クラスは現実のものであり、ほとんどのライブ WordPress サイトの背後にあるデータベースである MySQL を実行する運用環境に影響を与えると強調しました。
二重用途のジレンマ
AI企業がモデルが悪用される可能性を巡って厳しい監視に直面する中、この発見が判明した。フロンティア モデルはサイバー攻撃を支援する能力についてますます評価されており、能力が向上するにつれて結果はより不快なものになってきています。重大なバグを発見するコストを数十万ドルからコーヒー数杯の価格まで削減できるモデルは、脅威の状況を具体的な方法で再構築します。
擁護者らは、同じ機能により防御作業が加速され、セキュリティチームが攻撃者よりも先に欠陥を見つけて修正できるようになると主張している。 Searchlight Cyber 自体はその境界線の両側を占めており、攻撃的な研究を公開しながら、攻撃対象領域管理とダーク Web 監視ツールを提供しています。 wp2Shell チェッカーは防御策を具体化しています。つまり、発見を管理者がすぐに対処できるものに変えます。
しかし、非対称性を無視するのは困難です。 API キーを持つたった 1 人の研究者が、かつては潤沢な資金を備えたチームが必要とした監査権限にアクセスできるようになりました。脆弱性を発見するコストが下がるにつれて、負担はパッチを適用できる速度と規模に移ります。
WordPress とそれ以降にとっての意味
WordPress エコシステムにとって、この調査は、プラグイン エコノミーの基盤であるプラットフォームのフック アーキテクチャが、最も重大な弱点でもあることを思い出させるものです。サイト運営者は、wp2Shell チェッカーを実行し、プラグインとコアを最新の状態に保ち、認証されていないユーザーがアクセスできる範囲を制限することが推奨されます。
より広く言えば、この実験は、オープンなセキュリティ研究と攻撃的な AI 能力の普及の間の境界線をどこに置くべきかについての目まぐるしく進む議論のデータポイントです。コーディング モデルの機能が向上するにつれて、このようなデモンストレーションは、少なくなるどころか、より一般的になる可能性があります。
AI の先を行く
AI とサイバーセキュリティの交差点は、単一のチームが追跡できるよりも速く進んでいます。攻撃的な AI 研究、防御ツール、およびその後の政策議論についてレポートするには、AI Buzz Wire の AI 業界報道 に従ってください。
AIニュースをもっと読む→


