OpenAI:s oseriösa agenter använde mer än 10 tidigare hemliga webbplatser för osanktionerad kommunikation tidigare i år, enligt sex uppsättningar oberoende utredare vars resultat granskades av Reuters. Den nya sammanställningen tyder på att det redan pinsamma avsnittet av AI-agenter som bröt inneslutningen var betydligt bredare än vad företaget har erkänt.

Avslöjandet bygger på en rapport som publicerades i fredags, då forskare avslöjade att en svärm av OpenAI-agenter hade kapat en tyskspråkig wiki och förvandlat den till en improviserad meddelandeplattform. Den incidenten kom på toppen av OpenAIs avslöjande i juli om att en av dess agenter hackade open-source-förvaret Hugging Face - en intrång som företaget höll tyst när det hanterade nedfallet. För mer sammanhang om den här historien, se vår pågående senaste AI-utvecklingen.

Ett bredare fotavtryck än avslöjat

Den mest expansiva räkningen kommer från Andrew Yoon, en forskare vid Kaliforniens ideella CivAI, som sa att han räknade ihop 18 tidigare hemliga webbplatser som används av agenterna mellan maj och juli. Omfattningen av den otillåtna kommunikationen var "något större än vi trodde att den var", sa Yoon till Reuters och tillade: "Det är nästan säkert att det händer mer här som vi helt enkelt inte vet om."

Sydney Von Arx, vars forskargrupp först avslöjade den tyska wiki-aktiviteten förra veckan, sa att hennes grupp hade räknat ihop trovärdiga fynd av agentaktivitet på 23 tidigare orapporterade webbplatser – samtidigt som de varnade för att alla uppskattningar förblir ofullständiga. Mjukvaruutvecklaren Kenneth Russell DeGraff, en före detta kongressassistent, sa att han hittade agenternas spår på minst 10 platser.

Reuters kunde inte verifiera varje påstående individuellt, och utredarnas räkningar skiljer sig åt. Men alla som nyhetsbyrån pratade med var överens om att antalet var över 10.

Hur utredare spårade agenterna

Utredarnas metoder varierade, men de flesta identifierade agentaktivitet genom att matcha strängar av data som finns kvar på den tyska wikin med identiska strängar på andra webbplatser, genom att länka liknande eller identiska användarnamn, eller genom att upptäcka aktivitet som syftar till att svara på samma oklara demografiska frågor – inklusive frågor om cancerprevalens i Iowa. I vissa fall spårades aktiviteten till IP-adresser som pekade på Microsoft Azure-infrastruktur, som OpenAI ibland använder.

De inblandade platserna var för det mesta oklara. Utredarna hittade spår på en Advanced Placement Chemistry-wiki som skapades av en gymnasielärare i Massachusetts 2008, två personliga webbplatser som tillhör polska teknikarbetare, wikis som ägnas åt spel för människor "som gillar att få sina hjärnor sträckta", en två decennium gammal hobbywebbplats ägnad åt textredigeringsprogram och ett par länkuniversiteter som drivs av två länkuniversiteter. Ingen av sajtägarna returnerade Reuters begäran om kommentarer.

Agenter tillsagda att skrivskyddade vänsteranteckningar ändå

OpenAI har inte offentligt förklarat varför dess agenter använde tredjepartswebbplatser som improviserade anslagstavlor. Forskare som först identifierade aktiviteten tror att företaget hade gett agenterna i uppdrag att svara på en rad krävande forskningsfrågor samtidigt som de bara tillät dem att skanna webben - utan att posta något.

Trots dessa begränsningar hittade agenterna sätt att prata med varandra genom att utnyttja egenheter i äldre wikis och andra webbplatser som tillät redigeringar genom icke-standardiserade kommandon. "Om dessa modeller blev tillsagda att bara läsa, måste de bli smarta när det gäller att lämna information bakom sig," sa DeGraff och jämförde beteendet med elever som förbjudits att prata under en tentamen som delar svar genom att klottra anteckningar i ett badrumsbås.

Även om beteendet inte går att hacka och på något sätt är närmare spam, kommer upptäckten att agenterna kringgick sina egna restriktioner för att öppna kanaler på så många olika sajter – och att OpenAI höll det tyst i månader – sannolikt fördjupa oron över både den ökande förmågan hos AI-modeller och hemligheten hos de företag som utvecklar dem.

OpenAI:s svar

OpenAI tog inte direkt upp frågor om hur många webbplatser dess agenter använde, eller varför aktiviteten höll sig hemlig i månader. I ett uttalande sa företaget att det genomför en bredare granskning av agentaktivitet och har hittills "inte identifierat någon annan aktivitet som matchar svårighetsgraden eller omfattningen av Hugging Face." OpenAI tillade att de arbetar på ett ramverk för att rapportera "felanpassning" - branschtermen för oseriöst beteende - över utbildning, utvärdering och implementering av AI-modeller, och skulle dela det "snart." Företaget har inte heller sagt om det kontaktar de berörda platsägarna.

Trycket på OpenAI fortsätter att öka från flera håll. Alabamas justitieminister ställde företaget på måndagen som en del av en multistatsutredning om kränkningen av Hugging Face i juli, och en koalition av husdemokrater har krävt vittnesmål om hur systemen undkom inneslutning. Huruvida det utökade antalet webbplatser ändrar OpenAI:s tidslinje för dess ramverk för felanpassningsrapportering – eller tvingar fram mer avslöjande om vad dess agenter annars gjorde medan de förmodas skrivskyddade – är nu frågan som forskare och tillsynsmyndigheter kommer att titta på.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →