Oamenii plătiți pentru antrenarea modelelor OpenAI sunt concediați pentru că își fac treaba cu ajutorul AI, potrivit unui raport al 404 Media bazat pe documente interne și interviuri cu trei contractori.
Ironia din centrul poveștii este ascuțită. Cercetătorii AI au avertizat despre „colapsul modelului” – degradarea care are loc atunci când modelele sunt din ce în ce mai antrenate pe textul generat de AI. Unii dintre oamenii angajați pentru a preveni acest rezultat folosesc ei înșiși răspunsuri generate de AI pentru a antrena modelele OpenAI, iar aparatul de evaluare al companiei le vânează în mod activ. For more context on this story, see our ongoing AI industry coverage.
„Aproape singurul lucru care te va declanșa”
Un antreprenor a declarat pentru 404 Media că văd lucrători care folosesc AI „tot timpul și oamenii sunt lăsați să plece tot timpul, este aproape singurul lucru care te va declanșa cât mai curând posibil”. Persoana a adăugat că „într-un grup de mii sunt tone care au fost prinse”.
Raportul se bazează pe dezvăluirea anterioară de către 404 Media a Proiectului Lily, un efort OpenAI în care sute de contractori citesc solicitările și conversațiile reale ale utilizatorilor ChatGPT – care pot include informații personale – apoi evaluează și critică răspunsurile modelului, inclusiv verificarea faptului că răspunsurile nu sunt prea simpatice sau predispuse la antropomorfizarea chatbot-ului.
Noua raportare se bazează pe documente interne suplimentare și interviuri cu trei contractori care lucrează în proiecte OpenAI. Potrivit unui document intern, acele proiecte pot implica mai mult de zece mii de contractori.
Cartea de reguli: fără GPTZero, fără gramatică, fără AI
Documentele analizate de 404 Media sunt lipsite de ambiguitate în ceea ce privește utilizarea instrumentului. „Nu utilizați instrumente de detectare AI sau AI singur”, spune un document pentru antreprenori care analizează munca altor contractori. „Nu utilizați GPTZero sau orice alt instrument de detectare AI. Ele nu sunt de încredere. Nici examinatorii nu pot folosi AI, inclusiv traducerea gramaticală și AI.”
Același document îi instruiește pe recenzenți să rămână liniștiți în legătură cu metodele lor: „Nu le spuneți evaluatorilor de ce bănuiți AI. Este mai ușor pentru ei să se ascundă dacă știu ce căutați. Judecăți modelul general, nu un indiciu”.
Toți cei trei contractori au spus că recenzenții sunt instruiți să nu folosească inteligența artificială în munca lor, iar doi au spus că persoane au fost concediate sau excluse din bord pentru că o folosesc. 404 Media a acordat contractorilor anonimatul deoarece nu li s-a permis să vorbească cu presa.
Deci, ce îl dă pe un muncitor? Potrivit raportului, recenzenților li se spune să caute semne revelatoare ale utilizării AI: cuvinte repetitive, semne de punctuație în stilul AI - inclusiv, aparent, utilizarea excesivă a liniuței em - și munca terminată neobișnuit de rapid. În canalele Slack în care contractorii comercializează sfaturi, a spus un contractant, oamenii postează frecvent exemple în care se întreabă: „Este asta AI?”
Un antreprenor care a recunoscut că a folosit AI în timp ce a ajutat să antreneze modelele OpenAI a împărtășit ceea ce a prezentat ca scrisoare de reziliere. Acesta a spus că angajatorul lor a identificat probleme cu „autenticitatea” muncii lor.
"Nu sunt o persoană rea sau un muncitor. Am avut nevoie doar de un mic impuls și am apelat la AI pentru a mă ajuta, ceea ce a dus în cele din urmă la căderea mea", a declarat contractorul pentru 404 Media. „Nu am simțit nicio bucurie în muncă sau că am contribuit în vreun fel la societate”.
Rolul Mercor și lanțul de forță de muncă AI-Training
Doi dintre contractori au lucrat pentru Mercor, o companie de instruire AI care angajează contractorii care analizează materialele legate de ChatGPT. Un purtător de cuvânt al Mercor a declarat pentru 404 Media într-o declarație că experții săi sunt angajați pentru expertiza și raționamentul lor, pe care compania le-a descris ca fiind esențiale pentru dezvoltarea continuă a AI și că contractele sale interzic strict utilizarea AI în muncă.
Aranjamentul evidențiază structura de muncă stratificată din spatele dezvoltării AI de frontieră. Companii precum OpenAI se bazează din ce în ce mai mult pe furnizori specializați, care, la rândul lor, recrutează grupuri mari de evaluatori independenți – cu mii pe proiect – pentru a evalua rezultatele modelului, a semnala conținut dăunător și a menține răspunsurile la bază. Controlul calității în acest lanț este impus nu de software, ci de alți oameni care citesc pentru a spune „stil AI”.
De ce există interdicția – și de ce este greu de aplicat
Motivul pentru interdicție este simplu: dacă oamenii care evaluează răspunsurile ChatGPT își externalizează judecățile către ChatGPT însuși, bucla de feedback se prăbușește. Evaluările nu mai reflectă preferințele umane autentice, colapsul modelului se accelerează, iar datele de evaluare care ghidează antrenamentul devin circulare. Se pare că propriile documente ale OpenAI recunosc că instrumentele de detectare a inteligenței artificiale nu sunt de încredere, motiv pentru care evaluatorilor li se spune să se bazeze mai degrabă pe judecata modelului decât pe software.
Dar aplicarea unei reguli fără inteligență artificială într-o forță de muncă de mii de liber profesioniști, angajați prin intermediari și plătiți pe sarcină, creează propriile presiuni. Antreprenorii au declarat pentru 404 Media că utilizarea AI este obișnuită, chiar dacă rezilierile sunt frecvente, iar lucrătorul anonim care a împărtășit o scrisoare de reziliere a descris apelul la AI nu din lene, ci ca „un mic impuls” pentru munca pe care o consideră lipsită de bucurie.
Raportul ajunge pe fondul unei dezbateri mai ample despre condițiile de muncă ale forței de muncă invizibile din industria AI - adnotatorii, evaluatorii și recenzenții a căror muncă stă la baza fiecărui model major. De asemenea, ridică întrebări incomode pentru economia mai largă: dacă oamenii plătiți pentru a distinge scrierea umană de scrierea automată se luptă să facă acest lucru în mod fiabil, iar detectorii AI rămân nesiguri după propria evaluare a OpenAI, angajatorii de pretutindeni sunt lăsați să controleze o graniță care este din ce în ce mai greu de văzut.
Deocamdată, politica din cadrul conductei de formare a OpenAI este clară, la fel și penalizarea. Se așteaptă ca angajații care evaluează rezultatele unuia dintre cele mai capabile sisteme de inteligență artificială din lume să fie în întregime umani, verificabil, iar cei care apelează la instrumentul pe care îl evaluează riscă să-și piardă locul de muncă.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →