O startup din SUA numită Abliteration.ai a transformat una dintre cele mai controversate tehnici open source ale AI într-un serviciu comercial, vânzând acces la browser și API la modele populare deschise, fără antrenamentul lor de siguranță, inclusiv GLM-5.3 lansat recent de Z.ai, unul dintre cele mai capabile modele deschise disponibile astăzi.

Compania își ia numele de la „aliterație”, o metodă care înlătură tendința unui model de a refuza cererile dăunătoare. Cercetătorii și pasionații au folosit tehnica de ani de zile, iar Hugging Face găzduiește mii de modele abolite. Ceea ce este nou este ambalajul: Abliteration.ai găzduiește modele modificate pe propria infrastructură, astfel încât oricine are un browser web le poate interoga fără să descarce greutăți sau să închirieze GPU-uri. TechCrunch a raportat dezvoltarea pe 3 septembrie și de atunci a atras atenția cercetătorilor în materie de siguranță care urmăresc dezbaterea pe care o urmărim în acoperirea știrilor AI.

De la tehnica subterană la platforma la cheie

Fondată la sfârșitul anului trecut și încorporată oficial în martie, Abliteration.ai mută practica dintr-o nișă open source cu do-it-yourself într-un produs comercial rafinat. Prin găzduirea modelelor în sine, compania elimină simultan două puncte de frecare: utilizatorii nu mai au nevoie de abilitățile tehnice pentru a elimina un model și nici de calcularea pentru a rula unul.

Cofondatorul Devon - TechCrunch și-a reținut numele de familie la cererea sa, deoarece rămâne angajat la o altă firmă - a declarat că compania a încheiat contracte cu câțiva furnizori importanți de cloud și este finanțată în întregime din veniturile clienților. Startup-ul nu a strâns capital de risc, deși el a spus că discuțiile sunt în desfășurare.

Ce a găsit testul TechCrunch

Compania spune că scopul său este să permită „lucrări ofensive de testare cibernetică, red-teaming și agenți pe care alte modele refuză să le facă”. TechCrunch a pus asta la încercare cu un cont gratuit, interogând o versiune anulată a GLM-5.3 printr-un browser web. Reporterii i-au cerut modelului să scrie un program Python care fură parolele Chrome salvate și să producă un protocol detaliat pentru cultivarea unui agent patogen uman periculos acasă. Potrivit raportului, a satisfăcut cu ușurință ambele solicitări.

Acest experiment este miezul poveștii: sarcinile pe care modelele de frontieră mainstream le refuză categoric sunt acum disponibile în spatele unui formular de înscriere, fără costuri, într-o filă de browser.

Argumentul de apărare al echipei roșii

Argumentul lui Devon pentru afacere este argumentul clasic de securitate: nu te poți apăra împotriva comportamentului pe care nu-l poți reproduce. Un model care refuză să scrie cod de exploatare funcțional este de puțin folos unei echipe roșii care încearcă să înțeleagă atacatorii adevărați.

„Imaginea de ansamblu a modelelor abolite este că sunt capabili să modeleze actori răi”, a spus el pentru TechCrunch. „Avantajul este acum că apărătorii se pot mișca cât mai repede posibil... Cred că va accelera securitatea cibernetică, care este un fel de punct contraintuitiv”.

Clienții companiei includ startup-uri în stadiu incipient din Marea Britanie și Europa, care testează securitatea băncilor, companiilor aeriene și a altor operatori de infrastructură critică. Un client important, a spus Devon, echipe roșii agenții bancari și nu a putut efectua această activitate cu modele comerciale nemodificate.

„Un model care devine sociopat”

Cercetătorii în siguranță văd aceeași capacitate foarte diferit. Andrew Yoon, șeful de cercetare la AI Safety Nonprofit CivAI, a declarat pentru TechCrunch că aliterarea vă permite „să modificați modelul astfel încât să devină un sociopat”.

„Puteți introduce literalmente orice aici și va fi conform cu acesta”, a spus Yoon, adăugând că se așteaptă ca „modele editate, anulate să fie folosite pentru rău în viitorul apropiat”.

Într-un articol de opinie recent, Yoon a susținut că, dacă îndepărtarea balustradei nu poate fi prevenită în mod realist, guvernele ar trebui să solicite furnizorilor să ruleze clasificatoare care detectează și blochează activitățile dăunătoare ale armelor cibernetice și biologice și ar trebui să solicite companiilor care închiriază acces direct la GPU-uri avansate să verifice identitățile clienților și să refuze serviciul în cazul în care este suspectată o utilizare greșită periculoasă.

Balustrade subțiri și fără verificări de identitate

Deocamdată, propriile garanții ale lui Abliteration.ai sunt minime. Platforma oferă clienților un nivel opțional de moderare, astfel încât aceștia să poată adăuga orice restricții doresc, iar site-ul în sine menține anumite limite minore - TechCrunch nu a putut determina modelul să producă instrucțiuni de sinucidere, iar Devon a spus că lucrează la măsuri suplimentare pentru prevenirea violenței.

Compania nu efectuează nicio verificare a cunoașterii clientului în afară de înregistrarea cardului de credit utilizat pentru plată. „Nu vrei să fii persoana responsabilă pentru ca cineva să facă ceva nebunesc... deci unde tragi linia care este responsabilitatea ta ca companie?” spuse Devon. „Suntem încă în proces de a defini asta”.

O întrebare pe care industria nu o poate eschiva

Nu toți practicienii în domeniul securității sunt de acord că modelele abolite sunt chiar și cel mai bun instrument pentru testarea ofensivă. Ahmed Aly, CEO al companiei Fabraix, a declarat pentru TechCrunch că compania sa se bazează mai mult pe reglarea fină a modelelor deschise, care sunt deja livrate cu puține refuzuri – și observă că aliterarea poate degrada capacitățile de bază ale unui model.

Majoritatea experților consultați de TechCrunch sunt de acord asupra unui lucru: practica nu poate fi oprită. Greutățile descărcabile înseamnă că oricine poate elimina refuzurile la nivel local, așa cum a subliniat un comentariu din 2026 de la Centrul de Combatere a Terorismului din West Point despre utilizarea abuzivă de „aliterare”. Întrebarea deschisă forțează Abliteration.ai dacă reducerea costului de acces pentru toată lumea – apărători și atacatori deopotrivă – face internetul mai sigur sau mai periculos.

Rămâi înaintea AI

Siguranța AI evoluează zilnic. Obțineți cele mai recente evoluții AI într-un singur loc.

Citiți mai multe știri AI →