Identitatea lui Ox Alpha, modelul AI fără marcă care a dominat conversațiile dezvoltatorilor de când a apărut pe OpenRouter și OpenCode pe 20 august, nu mai este un mister. Z.AI din China a confirmat miercuri Bloomberg News că modelul este o nouă iterație a seriei GLM – și a spus că va lansa greutățile modelului în această seară, făcându-le disponibile pentru descărcare și rulare oricui.

Confirmarea pune capăt unuia dintre cele mai frenetice jocuri de ghicire pe care comunitatea AI le-a văzut în acest an și pune un model chinezesc de vârf pe un curs de coliziune cu laboratoarele occidentale care prețuiesc capabilități comparabile la un preț ridicat. For more context on this story, see our ongoing AI trends.

O lansare ascunsă care a funcționat exact așa cum a fost proiectat

Ox Alpha a sosit cu o listă care descria totul despre ceea ce putea face și nimic despre cine l-a construit. OpenRouter l-a atribuit „ unui furnizor terță parte care a ales să rămână anonim în timpul acestei previzualizări ” și l-a poziționat ca un model de raționament construit pentru codare, lucru agentic susținut și sarcini de producție.

Numai specificațiile au fost suficiente pentru a învârti capetele: o fereastră de context de puțin peste un milion de jetoane, suport pentru text, imagine și intrare video și acces complet gratuit atât prin OpenRouter, cât și prin OpenCode. OpenCode a anunțat o capacitate de servire de 100 de trilioane de jetoane pe zi pentru model, iar Nous Research a susținut că propriul portal ar putea trece printr-un cvadrilion de jetoane.

Rularea anonimă a unui model adiacent frontierei pe o infrastructură neutră a permis Z.AI să colecteze date reale de utilizare și discuții de referință nefiltrate înainte de a-și atașa marca – un manual care ocolește narațiunea cu reduceri care urmează fiecărei lansări chineze deschise, așa cum a remarcat OfficeChai în analiza sa a lansării.

Funcția de referință care a aprins siguranța

Mania se retrage la un singur punct de date. Într-o zi de la lansare, dezvoltatorul Ben Davis a efectuat o evaluare informală cu zece sarcini pe benchmark-ul DeepSWE și a raportat o precizie de 80% la prima trecere pentru Ox Alpha - înaintea lui Claude Fable 5 la 65% și GPT-5.6 Sol la 52%.

Acest rezultat a fost suficient pentru a trimite modelul viral și pentru a pune capăt seriei de 56 de zile a DeepSeek în vârful clasamentului OpenCode. De asemenea, a atras o respingere imediată. La Hacker News, unde confirmarea lui Bloomberg a strâns sute de comentarii, dezvoltatorii au îndemnat prudență, observând că o rulare de zece sarcini este un eșantion mult prea mic pentru a rezolva ceva și că rezultatele modelului pe alte clasamente au fost vizibil mai mixte.

Cum a spart internetul mai întâi cazul

Cu mult înainte de confirmarea de miercuri, munca de detectiv comunitar se stabilise deja pe Z.AI - cunoscut anterior ca Zhipu AI - ca candidat principal. Un dezvoltator numit „dax” a efectuat un test de amprentare a tokenizerului în 25 de solicitări și a constatat că numărul de tokeni brut al Ox Alpha se potrivea cu tokenizatorul GLM pe 11 din 11 sonde, în timp ce niciun alt model de laborator nu a șters patru. Pe sonda cu o singură cifră, tokenizerul DeepSeek a ars 98 de jetoane, unde GLM a folosit 29.

O analiză separată a constatat că Ox Alpha s-a împiedicat de același „semn murdar” care a declanșat istoric modelele din familia Qwen și GLM, restrângând devreme domeniul la un laborator chinez. Cealaltă teorie proeminentă – Xiaomi, a cărei echipă MiMo a condus anterior un manual de lansare stealth identic cu MiMo-V2-Pro sub pseudonimul Hunter Alpha – acum pare să fi fost o momeală.

Miza dezvăluirii se extinde dincolo de dreptul de lăudare. New York Times a raportat marți că un model de lansare al unui laborator chinez ar putea testa gradul de pregătire a securității cibernetice a lumii, subliniind cât de atent guvernele occidentale urmăresc lansările deschise de acest calibru.

De ce greutățile deschise modifică calculul

Confirmarea lui Z.AI că vor veni greutăți în această seară este partea care contează pentru piață. Actualul GLM 5.3 al companiei are un preț de 1,40 USD per milion de jetoane de intrare și 4,40 USD per milion de jetoane de ieșire pe API-ul său primar, cu o reducere de cache de 81%. Noul model este de așteptat să fie livrat sub aceeași licență MIT pe care Z.AI a folosit-o de la GLM 5, potrivit OfficeChai.

Codarea adiacentă frontierei și performanța agentică, lansate în mod deschis la o fracțiune din prețul API-ului de Vest, este tocmai punctul de presiune pe care laboratoarele premium au petrecut doi ani încercând să-l evite. De asemenea, menține Z.AI competitiv cu DeepSeek pe partea deschisă a pieței chineze, unde modelele care pot fi descărcate gratuit au devenit așteptările implicite pentru orice mai puțin decât granița absolută a unui laborator.

Ce să urmărești în continuare

Detaliile cheie rămân neconfirmate - cel mai important număr de parametri și dimensiunea modelului, care vor determina cât de practică este versiunea pentru implementarea locală. Discuțiile din comunitate s-au concentrat deja asupra modului în care modelul răspunde la cuantizare și cât de repede rulează pe hardware-ul de consum, mai degrabă decât pe GPU-urile centrelor de date.

Cert este că o săptămână de speculații anonime i-a oferit lui Z.AI ceva ce niciun buget de marketing nu ar putea cumpăra: validare imparțială, agnostică a mărcii pe teren neutru. Acum că modelul are un nume, benchmark-urile sunt pe cale să devină mult mai aglomerate - și mult mai riguroase.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →