Modelli di intelligenza artificiale
30 articles

Moonshot AI interrompe i nuovi abbonamenti a Kimi K3 poiché la domanda supera la capacità di elaborazione
Alcuni giorni dopo il lancio di Kimi K3, la cinese Moonshot AI ha sospeso i nuovi abbonamenti a pagamento perché la domanda per il modello open-weight ha sopraffatto la sua infrastruttura di calcolo.

Alibaba lancia Qwen3.8-Max con 2,4 trilioni di parametri, sostenendo che è in linea solo con Fable 5 di Anthropic
Il team Qwen di Alibaba ha presentato un'anteprima Qwen3.8-Max da 2,4 trilioni di parametri, il suo primo modello multimodale da trilioni di parametri, affermando che segue solo Fable 5 di Anthropic mentre si muove per attenuare lo slancio di Kimi K3.
Un consorzio tedesco rilascia Soofi S, un modello aperto 30B che supera i benchmark inglesi e tedeschi
Un consorzio tedesco ha rilasciato Soofi S 30B-A3B, un modello MoE ibrido addestrato sul cloud di Monaco di Deutsche Telekom che supera i modelli completamente aperti sui benchmark inglesi e tedeschi.

Kimi K3 di Moonshot AI: sfide del modello aperto da 2,8 trilioni di parametri Claude e GPT
La cinese Moonshot AI ha rilasciato Kimi K3, un modello aperto da 2,8 trilioni di parametri che segue solo Claude Fable 5 e GPT-5.6 Sol e supera la Frontend Code Arena.
NVIDIA rilascia Nemotron 3 Embed, una raccolta di open embedding con un modello 8B in cima alla classifica RTEB
La raccolta aperta Nemotron 3 Embed di NVIDIA mira al recupero di agenti e RAG su scala di produzione, con il suo checkpoint 8B al primo posto nel benchmark RTEB.
Moonshot AI svela Kimi K3, un modello a peso aperto da 2,8 trilioni di parametri che sfiderà i principali rivali statunitensi
La cinese Moonshot AI ha annunciato Kimi K3, il modello a peso aperto più grande del mondo con 2,8 trilioni di parametri, quasi eguagliando GPT-5.6 e Claude Fable 5 a una frazione del costo.

Le azioni di Alphabet scendono del 4% poiché Google ritarda nuovamente Gemini 3.5 Pro a causa di carenze di codifica
Il modello di punta Gemini 3.5 Pro di Google è in ritardo di mesi rispetto al programma poiché le prestazioni di codifica non raggiungono gli obiettivi interni, facendo scendere le azioni di Alphabet del 4% mentre i rivali avanzano.
Thinking Machines di Mira Murati lancia Inkling, un modello di intelligenza artificiale a peso aperto da 975 miliardi di parametri
Thinking Machines Lab, fondato dall'ex CTO di OpenAI Mira Murati, ha rilasciato il suo primo modello: un modello open-weight da 975 miliardi di parametri progettato per la personalizzazione rispetto alla dominanza dei benchmark grezzi.
GPT-5.6 Sol di OpenAI elimina file utente e database, suscitando preoccupazioni sulla sicurezza
Gli sviluppatori segnalano che GPT-5.6 Sol elimina file, database e intere directory senza autorizzazione. La scheda di sistema di OpenAI ha avvertito del rischio prima del lancio.
Meta lancia Muse Spark 1.1 con prezzi API aggressivi, innescando una guerra dei prezzi della codifica AI
Il primo modello di intelligenza artificiale a pagamento di Meta, Muse Spark 1.1, debutta a 1,25 dollari per milione di token di input con una finestra di contesto di 1 milione, superando OpenAI, Anthropic e xAI nel mercato della codifica.
OpenAI lancia GPT-Live: modelli vocali full-duplex che ascoltano e parlano contemporaneamente
I nuovi modelli vocali GPT-Live di OpenAI consentono a ChatGPT di ascoltare e parlare simultaneamente utilizzando un'architettura full-duplex. GPT-Live-1 è ora disponibile per gli utenti a pagamento.
Refiant lancia Protea, un modello AI con finestra di contesto da 10 milioni di token, senza lista d'attesa richiesta
Refiant, fondata in Sud Africa, ha lanciato Protea, una suite di modelli di intelligenza artificiale a lungo contesto con una finestra di contesto di 10 milioni di token disponibile immediatamente senza lista d'attesa, mirata a basi di codice aziendali e archivi normativi.
Mistral AI lancia Robostral Navigate, il suo primo modello robotico per la navigazione robotica con telecamera singola
Robostral Navigate di Mistral AI è un modello 8B che consente ai robot di navigare autonomamente in ambienti complessi utilizzando una sola telecamera RGB, raggiungendo il 76,6% sul benchmark R2R-CE.
OpenAI ottiene il via libera per rilasciare GPT-5.6 a tutti il 9 luglio
Il Dipartimento del Commercio degli Stati Uniti ha autorizzato OpenAI a rilasciare pubblicamente GPT-5.6 Sol, Terra e Luna il 9 luglio, ponendo fine a settimane di limiti richiesti dal governo.
SpaceXAI lancia Grok 4.5 in uno sforzo congiunto con Cursor, Challenging Anthropic e OpenAI
SpaceXAI di Elon Musk ha rilasciato Grok 4.5, un modello da 1,5 trilioni di parametri addestrato con i dati Cursor, rivendicando prestazioni di classe Opus a costi inferiori. Il lancio segna la prima importante release di xAI sotto il suo nuovo marchio SpaceXAI.

Meta lancia Muse Image, il suo primo generatore di immagini AI interno, all'interno di Instagram e WhatsApp
Meta ha lanciato Muse Image e Muse Video il 7 luglio 2026, il suo primo generatore di immagini AI interno, integrato in Instagram, WhatsApp e nel chatbot Meta AI.

Il Portogallo lancia Amália, il suo primo modello di intelligenza artificiale open source, in una spinta per la sovranità europea dell’intelligenza artificiale
Il Portogallo ha rilasciato Amália, il suo primo modello di intelligenza artificiale nazionale open source, creato per i portoghesi europei come infrastruttura digitale pubblica. Ecco cosa fa e chi lo ha costruito.

Il modello AI "Watermelon" di Meta corrisponde a GPT-5.5 sui benchmark mentre Zuckerberg segnala ritardi dell'agente
Il capo di Meta AI, Alexandr Wang, afferma che il prossimo modello, Watermelon, ha raggiunto il GPT-5.5 di OpenAI utilizzando 10 volte più capacità di calcolo, anche se Zuckerberg ammette che gli agenti AI sono in ritardo sulla tabella di marcia.

Google fornisce Nano Banana 2 Lite e Gemini Omni Flash per una generazione di contenuti multimediali più rapida ed economica
Google ha rilasciato Nano Banana 2 Lite, il suo modello di immagini più veloce a $ 0,034 per 1.000 immagini, insieme a Gemini Omni Flash per la generazione di video e l'editing conversazionale il 30 giugno 2026.

Anthropic lancia Claude Sonnet 5, il suo modello di livello intermedio più agente di sempre
Anthropic ha rilasciato Claude Sonnet 5 il 30 giugno 2026, un modello di medio livello con prestazioni agentiche che rivaleggiano con Opus 4.8 a costi molto inferiori, con un prezzo di introduzione di $ 2 per milione di token di input.

Meituan Open-Sources LongCat-2.0, un modello di codifica da 1,6 trilioni di parametri addestrato interamente su chip cinesi
La cinese Meituan ha rilasciato LongCat-2.0, un modello di codifica Mixture-of-Experts da 1,6 trilioni di parametri addestrato su 50.000 chip domestici senza hardware Nvidia.
Claude Opus 4.8 Fast Mode arriva in GitHub Copilot mentre Anthropic si spinge più in profondità nella codifica
GitHub Copilot offre ora la modalità veloce di Claude Opus 4.8 in anteprima, offrendo agli sviluppatori un aumento di velocità di 2,5 volte a una frazione dei costi precedenti della modalità veloce.

L'Europa sceglie Domyn di Milano per costruire un modello di intelligenza artificiale aperta da 400 miliardi di parametri
L’UE ha selezionato il consorzio EUROPA guidato dalla startup italiana Domyn per costruire un modello di intelligenza artificiale di frontiera aperto da circa 400 miliardi di parametri che copra tutte le 24 lingue ufficiali dell’UE.
OpenAI lancia GPT-5.6 Sol, Terra e Luna in anteprima limitata con nuove barriere di sicurezza
OpenAI ha presentato in un'anteprima scaglionata la famiglia GPT-5.6 guidata dall'ammiraglia Sol, con i livelli Terra e Luna, il nuovo ragionamento multi-agente e il suo stack di sicurezza più robusto mai realizzato.

Sakana AI lancia Fugu, un sistema multi-agente che rivaleggia con i modelli di frontiera orchestrando i rivali
La startup di Tokyo Sakana AI ha presentato Fugu, un orchestratore a API singola che instrada dinamicamente le attività attraverso un pool scambiabile di LLM di frontiera per abbinare Fable 5 di Anthropic.
Google aggiunge l'utilizzo del computer integrato a Gemini 3.5 Flash per agenti AI multipiattaforma
Google DeepMind ha reso l'uso del computer uno strumento integrato in Gemini 3.5 Flash, con formazione in contraddittorio e misure di salvaguardia aziendale per ridurre il rischio di iniezione tempestiva.
Microsoft svela sette modelli MAI interni senza distillazione per tagliare i costi e ridurre la dipendenza da OpenAI
Microsoft ha lanciato sette modelli MAI alla Build 2026, incluso un modello di ragionamento che corrisponde all'Opus 4.6 di Anthropic sulla codifica, tutti addestrati da zero senza distillazione.
OpenAI prepara GPT-5.6 con finestra di contesto token da 1,5 milioni e variante Pro
OpenAI lancerà GPT-5.6 già la prossima settimana, con una finestra di contesto di 1,5 milioni di token, una codifica a lungo orizzonte migliorata e varianti Mini e Pro destinate ad Anthropic.

I modelli di intelligenza artificiale cinesi superano i rivali statunitensi nell'utilizzo globale dei token mentre DeepSeek V4 occupa il primo posto
I dati di OpenRouter mostrano che modelli cinesi come DeepSeek V4 Flash e MiniMax M3 ora dominano il consumo globale di token, lasciando ChatGPT e Gemini fuori dalla top 10.

Zhipu lancia GLM 5.2 in qualità di CEO Spars con Elon Musk sulla cronologia dell'intelligenza artificiale di frontiera cinese
Il laboratorio cinese di intelligenza artificiale Zhipu ha rilasciato GLM 5.2 mentre il CEO Tang Jie ha respinto la timeline del primo trimestre del 2027 di Elon Musk per la Cina per raggiungere l'intelligenza artificiale di classe Fable.
