Il laboratorio cinese di intelligenza artificiale Moonshot AI ha presentato Kimi K3 il 16 luglio 2026, rilasciando quello che definisce "il primo modello aperto di classe 3T al mondo": un sistema da 2,8 trilioni di parametri che riduce il divario con i modelli proprietari più potenti di Anthropic e OpenAI. Il lancio è diventato immediatamente uno dei rilasci di intelligenza artificiale più discussi dell'anno, raggiungendo la vetta di Hacker News e attirando la copertura di Reuters, Bloomberg e The New York Times.

Per una più ampia [copertura del settore dell’intelligenza artificiale] (https://aibuzzwire.news), Kimi K3 è importante perché spinge la frontiera dei modelli a peso aperto nettamente più in alto, costringendo al contempo un nuovo dibattito sulla possibilità che i sistemi scaricabili liberamente possano eguagliare quelli chiusi. Moonshot afferma che i pesi completi del modello saranno rilasciati entro il 27 luglio 2026.

Un modello aperto da 2,8 trilioni di parametri

Secondo l'annuncio tecnico di Moonshot, Kimi K3 è un modello da 2,8 trilioni di parametri costruito su due aggiornamenti architetturali che l'azienda chiama Kimi Delta Attention (KDA) e Attention Residuals (AttnRes). Utilizza un design Mixture-of-Experts (MoE) che attiva solo 16 degli 896 esperti per ciascun token, abbinato a quello che Moonshot descrive come un framework LatentMoE stabile. L'azienda afferma che queste modifiche producono un miglioramento di circa 2,5 volte nell'efficienza complessiva del ridimensionamento rispetto al precedente modello Kimi K2.

Il modello viene inoltre fornito con funzionalità di visione nativa e una finestra di contesto da un milione di token. L'analista Simon Willison, scrivendo sul suo blog, ha notato che Kimi K3 prende la corona di dimensioni aperte dal v4 Pro da 1,6 trilioni di parametri di DeepSeek - "più del doppio della dimensione" del Kimi K2.6 da 1 trilione di parametri che lo ha preceduto.

Moonshot considera il rilascio come l'ultimo passo in una spinta al ridimensionamento sostenuta, affermando che per nove degli ultimi dodici mesi i suoi modelli hanno fissato il limite superiore delle dimensioni dei modelli aperti.

Come si confronta con i benchmark

La suite di valutazione di Moonshot colloca le prestazioni complessive di Kimi K3 dietro solo a due sistemi proprietari: Claude Fable 5 di Anthropic e GPT-5.6 Sol di OpenAI, mentre supera costantemente altri modelli testati, tra cui Claude Opus 4.8 e GPT-5.5. L’analisi di terze parti tiene traccia ampiamente di tali affermazioni.

Il servizio di valutazione indipendente Artificial Analysis ha riferito che sul suo benchmark privato di lavoro conoscitivo a lungo orizzonte, Kimi K3 ha raggiunto un Elo complessivo di 1547 - un balzo di 732 punti rispetto a Kimi K2.6 e dietro solo a Claude Fable 5. Nell'arena Frontend Code di Arena.ai, Kimi K3 è salito al primo posto, superando anche Claude Fable 5, secondo un post in classifica che è circolato ampiamente dopo il lancio.

Il prezzo è una parte notevole della storia. Artificial Analysis ha fissato il costo medio per attività a 0,94 dollari, paragonabile agli 1,04 dollari di GPT-5.6 Sol e a circa la metà degli 1,80 dollari di Claude Opus 4.8, pur rilevando che Kimi K3 utilizzava il 21% in meno di token di output rispetto al suo predecessore. Su base token, il modello ha un prezzo di 3 dollari per milione di token di input e 15 dollari per milione di token di output: lo stesso livello della serie Claude Sonnet di Anthropic e, come ha osservato Willison, il modello più costoso rilasciato da un laboratorio di intelligenza artificiale cinese fino ad oggi, rispetto ai 0,95/4 dollari di Kimi K2.6.

Codifica agentica e un compilatore costruito da sé

Gran parte dell'annuncio di Moonshot non si concentrava sui benchmark dei chatbot ma sui compiti degli agenti a lungo orizzonte. L'azienda afferma che Kimi K3 può sostenere sessioni di progettazione estese, navigare in archivi di codici di grandi dimensioni e orchestrare strumenti terminali con una supervisione umana minima.

In una dimostrazione, Moonshot ha affermato che una prima versione di Kimi K3 ha gestito la maggior parte del lavoro di ottimizzazione del kernel della GPU del team durante la fase avanzata dello sviluppo. In un altro, il modello ha creato "MiniTriton", un compilatore GPU compatto simile a Triton con la propria rappresentazione intermedia a livello di riquadro, passaggi di ottimizzazione e pipeline di generazione di codice PTX. Moonshot afferma che MiniTriton ha eguagliato o battuto gli stack Triton e torch.compile consolidati sui benchmark della linea del tetto supportati e ha sostenuto un addestramento nanoGPT end-to-end con convergenza stabile.

L'azienda ha inoltre presentato una sorprendente prova di concetto nella progettazione dei chip. In una singola corsa autonoma di 48 ore, Kimi K3 avrebbe progettato, ottimizzato e verificato un chip costruito per servire un modello nano sulla propria architettura, utilizzando strumenti EDA open source sulla libreria Nangate a 45 nm. Moonshot ha affermato che il progetto chiude i tempi a 100 MHz entro 4 mm² e sostiene oltre 8.700 token al secondo di velocità di decodifica nella simulazione.

Dal punto di vista della ricerca, Moonshot ha affermato che Kimi K3 ha riprodotto le relazioni universali I-Love-Q dell’astrofisica computazionale in circa due ore – un lavoro che secondo le stime dell’azienda richiederebbe in genere a un ricercatore una o due settimane – convalidando in modo incrociato più di 20 documenti, implementando una pipeline numerica completa su oltre 300 equazioni di stato e scrivendo oltre 3.000 righe di Python.

Ritorna il dibattito sul peso aperto

L’arrivo di Kimi K3 riaccende un dibattito che è durato fino al 2026 poiché i laboratori cinesi hanno ripetutamente ridotto – o sembravano ridurre – la distanza con i modelli di frontiera statunitensi. Lo schema è ormai familiare: un rilascio cinese colloca i numeri auto-riferiti in cima alle classifiche, i laboratori occidentali sottolineano il loro vantaggio proprietario ancora in crescita e le aziende valutano i costi e l’apertura rispetto alle capacità grezze.

Questa tensione è visibile nei prezzi. Un modello che supera Claude Opus 4.8 in termini di costo per attività pur avvicinandosi alle sue capacità, ma che costa più di qualsiasi precedente versione cinese, riflette la fiducia di Moonshot di poter ottenere prezzi premium anche in un ecosistema aperto. Willison ha messo in guardia dal leggere troppo in ogni singolo benchmark - il suo test di lunga data del "pellicano su una bicicletta", ha scritto, non è più correlato in modo affidabile con la qualità del mondo reale - ma ha detto che il rilascio ha comunque premiato i test pratici.

Kimi K3 è ora disponibile tramite Kimi.com, l'agente desktop Kimi Work, lo strumento per sviluppatori Kimi Code e l'API Kimi. Moonshot ha affermato che sta lavorando con partner di inferenza e manutentori open source per garantire un lancio affidabile prima del rilascio completo.

Stai al passo con l'intelligenza artificiale

Per una copertura continua del lancio dei modelli, delle battaglie sui benchmark e della frontiera del peso aperto, segui AI Buzz Wire per gli sviluppi che plasmano la corsa globale all'intelligenza artificiale.

Leggi altre notizie sul modello AI →