Säkerhetsforskare på Searchlight Cyber har visat att OpenAI:s GPT-5.6-kodningsmodell kan avslöja en allvarlig sårbarhet för fjärrexekvering av kod i WordPress för cirka 25 USD i API-kostnader, ett fynd som kristalliserar växande oro över hur frontier AI-verktyg kan vapeniseras för att hitta exploaterbara brister till en bråkdel av deras svarta marknadsvärde.
Forskningen, publicerad på Searchlight Cybers hemsida, visar att en enda forskare, beväpnad med GPT-5.6 Sol Ultra och en medvetet sårbar WordPress-kodbas, kunde identifiera en kedja som leder från pre-autentiseringsåtkomst hela vägen till fjärrexekvering av kod. Resultatet hamnar i centrum för en bryggande debatt om den offensiva säkerhetspotentialen hos stora språkmodeller, ett tema som spåras över senaste AI-utvecklingen.
En upptäckt på $25 på en $500 000-marknad
Forskningens rubrik är dess skarpa ekonomi. Exploatmäklare, mellanhänderna som köper sårbarheter och säljer dem vidare till regeringar och privata köpare, kommer att betala upp till 500 000 $ för ett pålitligt fel vid exekvering av WordPress fjärrkod, enligt Searchlight Cyber. WordPress driver ungefär 40 procent av alla webbplatser, vilket gör en central RCE-bugg utomordentligt värdefull.
Mot detta riktmärke är de cirka 25 USD som forskaren spenderade på GPT-5.6 API-anrop för att hitta felet gripande. Arbetet krävde inte ett stort team, specialiserad fuzzing-infrastruktur eller veckor av manuell revision. Istället förlitade den sig på att styra en kapabel kodningsmodell för att resonera om WordPresss källkod från första principer.
Forskarna släppte ett gratis kontrollverktyg, wp2Shell.com, så att administratörer kan avgöra om deras WordPress-instanser påverkas. De sa att de höll tillbaka fullständiga publiceringsdetaljer för att ge försvarare tid att svara.
Hur modellen hittade felet
I hjärtat av upptäckten är WordPresss hook-system, mekanismen som ger plattformen dess enorma plugin-ekosystem. Hooks, med namn som `wp_enqueue_scripts` eller `publish_post`, tillåter plugins att koppla anpassat beteende till nästan varje steg i WordPress-livscykeln. De är uppdelade i åtgärder, som utför biverkningar, och filter, som modifierar data när den passerar igenom.
Den flexibiliteten är också en spretig attackyta. Uppgiften som forskarna satte var att hitta en kedja som tillåter fjärrexekvering av kod från en oautentiserad utgångspunkt, med framgång definierad som förmågan att läsa en skyddad fil från serverns filsystem.
GPT-5.6 Sol Ultra, OpenAI:s resonemangsfokuserade kodningsmodell, arbetade igenom analysen genom att undersöka hur data flödar genom WordPresss krokar och till potentiellt farliga operationer. Modellens styrka låg inte i att blint söka efter mönster, utan i att resonera om interaktioner mellan komponenter, en förmåga som har förbättrats markant med de senaste resonemangsfokuserade modellsläppen.
Forskarna inramade övningen kring ett arkiv som innehåller en sårbar kopia av WordPress, en installation som liknar en capture-the-flag-utmaning där framgång innebar att extrahera en flaggfil. Men de betonade att den underliggande sårbarhetsklassen är verklig och påverkar produktionsinstallationer som kör MySQL, databasen bakom de flesta live WordPress-webbplatser.
Dilemmat med dubbla användningsområden
Upptäckten landar i takt med att AI-företag står inför allt större granskning av hur deras modeller kan missbrukas. Frontier-modeller utvärderas alltmer för sin förmåga att hjälpa till med cyberbrott, och resultaten har blivit mer obekväma i takt med att kapaciteten klättrar. En modell som kan sänka kostnaden för att hitta en kritisk bugg från hundratusentals dollar till priset för några kaffe omformar hotbilden på konkreta sätt.
Försvarare hävdar att samma förmåga påskyndar defensivt arbete, vilket hjälper säkerhetsteam att hitta och åtgärda brister innan angripare gör det. Searchlight Cyber själv upptar båda sidor av den linjen och erbjuder attackytehantering och mörk webbövervakningsverktyg samtidigt som den publicerar stötande forskning. Wp2Shell-kontrollen förkroppsligar det defensiva fallet: förvandla upptäckten till något som administratörer kan agera på omedelbart.
Men asymmetrin är svår att ignorera. En ensam forskare med en API-nyckel har nu tillgång till revisionskraft som en gång krävde ett välfinansierat team. När kostnaderna för att hitta sårbarheter minskar, flyttas bördan till den hastighet och omfattning med vilken de kan korrigeras.
Vad det betyder för WordPress och mer
För WordPress-ekosystemet är forskningen en påminnelse om att plattformens hook-arkitektur, grunden för dess plugin-ekonomi, också är dess mest följdriktiga svaga punkt. Webbplatsoperatörer uppmuntras att köra wp2Shell-kontrollen, hålla plugins och kärnor uppdaterade och begränsa vad oautentiserade användare kan nå.
Mer allmänt är experimentet en datapunkt i en snabbrörlig debatt om var gränsen ska gå mellan öppen säkerhetsforskning och spridningen av offensiv AI-kapacitet. När kodningsmodeller blir mer kapabla, kommer demonstrationer som denna sannolikt att bli vanligare, inte mindre.
Ligg före AI
Skärningspunkten mellan AI och cybersäkerhet rör sig snabbare än något enskilt team kan spåra. För rapportering om offensiv AI-forskning, defensiva verktyg och de politiska debatterna som följer, följ AI-branschens täckning på AI Buzz Wire.
Läs mer AI-nyheter →


