Laboratorul chinezesc de inteligență artificială Moonshot AI a dezvăluit Kimi K3 pe 16 iulie 2026, lansând ceea ce numește „primul model deschis din lume de clasă 3T” – un sistem de 2,8 trilioane de parametri care reduce decalajul cu cele mai puternice modele proprietare de la Anthropic și OpenAI. Lansarea a devenit imediat una dintre cele mai discutate lansări de AI ale anului, ajungând în topul Hacker News și fiind acoperite de Reuters, Bloomberg și The New York Times.

Pentru [acoperirea industriei AI] mai largă (https://aibuzzwire.news), Kimi K3 contează, deoarece împinge frontiera modelelor deschise mult mai sus, forțând în același timp o nouă dezbatere asupra faptului dacă sistemele descărcabile gratuit pot fi egale cu cele închise. Moonshot spune că greutățile complete ale modelului vor fi lansate până pe 27 iulie 2026.

Un model deschis cu 2,8 trilioane de parametri

Potrivit anunțului tehnic al lui Moonshot, Kimi K3 este un model de 2,8 trilioane de parametri construit pe două actualizări arhitecturale pe care compania le numește Kimi Delta Attention (KDA) și Attention Residuals (AttnRes). Utilizează un design Mixture-of-Experts (MoE) care activează doar 16 din 896 de experți pentru orice simbol dat, împreună cu ceea ce Moonshot descrie ca un cadru Stabil LatentMoE. Compania susține că aceste modificări duc la o îmbunătățire de aproximativ 2,5 ori a eficienței generale de scalare în comparație cu modelul Kimi K2 anterior.

De asemenea, modelul este livrat cu capabilități native de viziune și o fereastră de context de un milion de token. Analistul Simon Willison, scriind pe blogul său, a remarcat că Kimi K3 ia coroana de dimensiuni deschise de la DeepSeek v4 Pro cu 1,6 trilioane de parametri – „mai mult de două ori mai mare” față de Kimi K2.6 cu 1 trilion de parametri care l-a precedat.

Moonshot încadrează lansarea ca cel mai recent pas într-un impuls susținut de scalare, spunând că în nouă din ultimele douăsprezece luni modelele sale au stabilit limita superioară a dimensiunilor modelelor deschise.

Cum se compară cu punctele de referință

Suita de evaluare proprie a lui Moonshot plasează performanța generală a lui Kimi K3 în spatele doar a două sisteme proprietare – Claude Fable 5 de la Anthropic și GPT-5.6 Sol de la OpenAI – în timp ce depășește în mod constant alte modele testate, inclusiv Claude Opus 4.8 și GPT-5.5. Analiza terță parte urmărește în general aceste afirmații.

Serviciul de evaluare independent Artificial Analysis a raportat că, pe baza de referință privată pe orizont lung de cunoștințe, Kimi K3 a atins un Elo general de 1547 - un salt de 732 de puncte față de Kimi K2.6 și în urma lui Claude Fable 5. Pe Arena.ai Frontend Code, Kimi K3 a urcat pe primul loc, depășind chiar și liderul 5, potrivit lui Claude F, depășind chiar și liderul 5, depășind chiar și un loc larg de Claude Fable. după lansare.

Prețul este o parte notabilă a poveștii. Analiza artificială a fixat costul mediu pe sarcină la 0,94 USD, comparabil cu 1,04 USD pentru GPT-5.6 Sol și cu aproximativ jumătate din 1,80 USD pentru Claude Opus 4.8, remarcând în același timp că Kimi K3 a folosit cu 21% mai puține jetoane de ieșire decât predecesorul său. Pe bază de token, modelul are un preț de 3 USD per milion de jetoane de intrare și 15 USD per milion de jetoane de ieșire - același nivel ca seria Claude Sonnet de la Anthropic și, după cum a observat Willison, cel mai scump model lansat de un laborator chinez de inteligență artificială până în prezent, față de 0,95 USD/4 USD al lui Kimi K2.6.

Codare agentică și un compilator pe care l-a construit singur

O mare parte din anunțul Moonshot s-a concentrat nu pe benchmark-uri chatbot, ci pe sarcini agentice cu orizont lung. Compania spune că Kimi K3 poate susține sesiuni extinse de inginerie, poate naviga în depozite mari de cod și poate orchestra instrumente terminale cu o supraveghere umană minimă.

Într-o demonstrație, Moonshot a spus că o versiune timpurie a lui Kimi K3 s-a ocupat de majoritatea activității de optimizare a kernelului GPU al echipei în timpul dezvoltării târzii. În altul, modelul a construit „MiniTriton”, un compilator GPU compact asemănător Triton, cu propria sa reprezentare intermediară la nivel de tile, treceri de optimizare și conductă de generare de cod PTX. Moonshot susține că MiniTriton a egalat sau a depășit stivele stabilite de Triton și torch.compile pe punctele de referință acceptate pentru linia acoperișului și antrenamentul susținut de la capăt la capăt al nanoGPT cu convergență stabilă.

Compania a prezentat, de asemenea, o dovadă izbitoare a conceptului în proiectarea cipurilor. Într-o singură rulare autonomă de 48 de ore, Kimi K3 a proiectat, optimizat și verificat un cip construit pentru a servi unui model nano pe propria arhitectură, folosind instrumente EDA open-source din biblioteca Nangate 45nm. Moonshot a spus că designul închide sincronizarea la 100 MHz în 4 mm² și susține peste 8.700 de jetoane pe secundă de decodificare în simulare.

Din punct de vedere al cercetării, Moonshot a spus că Kimi K3 a reprodus relațiile universale I-Love-Q din astrofizica computațională în aproximativ două ore - lucru pe care compania a estimat că i-ar lua de obicei unui cercetător una sau două săptămâni - prin validarea încrucișată a peste 20 de lucrări, implementarea unui pipeline numeric complet în peste 300 de ecuații de stare și scriind peste 3 linii de P00000000000.

Dezbaterea deschisă revine

Sosirea lui Kimi K3 reaprinde o dezbatere care a durat până în 2026, deoarece laboratoarele chineze au închis în mod repetat – sau au părut să închidă – distanța cu modelele de frontieră din SUA. Modelul este acum familiar: o versiune chineză postează numere auto-raportate în partea de sus a clasamentelor, laboratoarele occidentale subliniază avantajul lor de proprietate, în creștere, iar companiile cântăresc costurile și deschiderea față de capacitatea brută.

Această tensiune este vizibilă în prețuri. Un model care subcutează Claude Opus 4.8 în ceea ce privește costul pe sarcină în timp ce se apropie de capacitatea sa, dar care încarcă mai mult decât orice versiune chineză anterioară, reflectă încrederea lui Moonshot că poate impune prețuri premium chiar și într-un ecosistem deschis. Willison a avertizat să nu citească prea mult în orice punct de referință – testul său de lungă durată „pelican pe bicicletă”, a scris el, nu se mai corelează în mod fiabil cu calitatea din lumea reală – dar a spus că lansarea încă răsplătește testele practice.

Kimi K3 este disponibil acum prin Kimi.com, agentul desktop Kimi Work, instrumentul de dezvoltare Kimi Code și API-ul Kimi. Moonshot a spus că lucrează cu parteneri de inferență și întreținerii open-source pentru a asigura o lansare fiabilă înainte de lansarea completă a ponderilor.

Rămâi înaintea AI

Pentru acoperirea continuă a lansărilor de modele, a bătăliilor de referință și a frontierei deschise, urmăriți AI Buzz Wire pentru evoluțiile care modelează cursa globală a inteligenței artificiale.

Citiți mai multe știri despre modelele AI →