Modelli di intelligenza artificiale
54 articles
Google lancia Gemini 3.8 Flash e una variante informatica creata per la difesa automatizzata delle vulnerabilità
Gemini 3.8 Flash di Google offre codifica e ragionamento a livello di frontiera a 0,75 dollari per milione di token di input, con una variante Flash Cyber per i difensori della sicurezza.
OpenAI inizia a lanciare GPT-6 Astra per clienti selezionati, dichiarando che l'era AGI è arrivata
OpenAI ha iniziato a lanciare GPT-6 Astra per selezionare clienti di sicurezza informatica, con Greg Brockman che dichiara l'era AGI. Ecco chi ottiene l'accesso e quali sono le prospettive.
L'IFM di Abu Dhabi pubblica K2 Horizon: sei modelli aperti con dati e codice di formazione completi
IFM ha lanciato K2 Horizon: sei modelli aperti (da 0.9B a 375B-A23B) con dati di addestramento completi, checkpoint, registri e codice sotto Apache 2.0. Cosa include.
Meta lancia Muse Spark 1.3 con aggiornamenti Agentic per Muse Code e Meta Model API
Muse Spark 1.3 di Meta viene distribuito a Muse Code e all'API Meta Model con aggiornamenti del flusso di lavoro agentico, migliore multitasking e ragionamento massimo mantenuto per i test di sicurezza.
Google lancia Gemini 3.8 Flash e Flash Cyber, il suo terzo modello in sei settimane
Google fornisce Gemini 3.8 Flash e una variante Flash Cyber incentrata sulla sicurezza informatica, sostenendo prestazioni di codifica vicine a Opus a una frazione del prezzo.
Multiverse Computing lancia Quasar 438B, il modello di intelligenza artificiale più alto in Europa
Multiverse Computing ha lanciato Quasar 438B, un modello di ragionamento di classe 400B che ha ottenuto un punteggio di 43 nell'Artificial Analysis Intelligence Index, il risultato migliore tra qualsiasi modello europeo.
Google prepara il lancio flash di Gemini 3.8 entro mercoledì per colmare il divario nella codifica dell'intelligenza artificiale
Google DeepMind prevede di lanciare Gemini 3.8 Flash già mercoledì, riferisce il WSJ, con test interni che mostrano progressi nella codifica laddove Gemini è rimasta indietro rispetto ai rivali.
OpenAI conferma che Astra è il suo primo modello di sicurezza informatica "critico" e imposta un rilascio limitato
OpenAI ha confermato che il suo prossimo modello Astra ha superato la soglia "critica" della sicurezza informatica e sarà presto disponibile con accesso limitato ai suoi strumenti informatici più potenti.
Anthropic lancia Claude Fable 5.1 e Mythos 5.1: 25% più economici, più potenti nell'Agent Coding
Claude Fable 5.1 di Anthropic taglia i costi tipici del 25% e registra grandi guadagni sui benchmark di codifica degli agenti, mentre Mythos 5.1 arriva per gli utenti con accesso affidabile.
Cohere rilascia Parse 5, un'intelligenza artificiale per l'analisi dei documenti con parametri da 2,3 B creata per l'acquisizione cost-first
Parse 5 di Cohere trasforma PDF, diapositive e scansioni in Markdown strutturato con un modello di parametri 2.3B. Il problema: il suo vantaggio nel benchmark si basa su un punteggio parziale.
Z.ai apre GLM-5.3 Weights on Hugging Face con una licenza rivolta agli hyperscaler
Z.ai ha rilasciato i pesi GLM-5.3 su Hugging Face con un contesto di token da 1 milione e una licenza personalizzata che richiede revisioni della sicurezza per fornitori MaaS da oltre 10 miliardi di dollari.
Anteprima Hy4 open source Tencent: MoE con parametri 770B con contesto token 1M
Il team Hunyuan di Tencent ha rilasciato l'anteprima Hy4 sotto Apache 2.0: un modello MoE da 770 B con parametri attivi da 49 B, contesto token da 1 milione e supporto vLLM day-one.
Google fornisce Gemini 3.5 Transcribe e Omni 1.1 Flash: due aggiornamenti per gli sviluppatori IA
Il nuovo Gemini 3.5 Transcribe di Google raggiunge un tasso di errore di parole del 2,6% mentre Omni 1.1 Flash aggiunge scene video di 40 secondi, upscaling 4K e controllo a livello di fotogramma.
Gemini Omni 1.1 Flash di Google aggiunge controlli di livello studio e output 4K ai video AI
Google ha rilasciato Gemini Omni 1.1 Flash con estensione della scena fino a 40 secondi, transizioni di inizio e fine fotogramma e upscaling 4K tramite l'API Gemini.
Google lancia Gemini 3.5 Transcribe: riconoscimento vocale in tempo reale in 85 lingue
Google ha lanciato Gemini 3.5 Transcribe con rilevamento di 85 lingue, tasso di errore di streaming del 4% e risposte più veloci del 70% rispetto a Chirp 3, distribuendolo su tutte le sue app.
Qwen3.8-Flash-Next di Alibaba presenta in anteprima l'architettura Qwen4 con 6B parametri attivi
Qwen3.8-Flash-Next di Alibaba prevede in anteprima Qwen4: parametri 125B con 6B attivi, pesi aperti e risultati che superano Qwen3.7-Plus a un nono del costo di formazione.
Z.ai lancia GLM-5.3-Flash sotto licenza MIT: Ox Alpha rivelato, Weights Live
GLM-5.3-Flash di Z.ai è un modello multimodale 320B-A18B con licenza MIT servito su chip AI cinesi che ora è in cima alle classifiche di analisi artificiale a basso costo.
Z.ai conferma che Ox Alpha è un modello della serie GLM e rilascerà i suoi pesi
Z.ai ha detto a Bloomberg che il modello virale stealth Ox Alpha è una nuova versione della serie GLM e che i pesi aperti arriveranno stasera, ponendo fine a una settimana di febbrili ipotesi.
Il creatore di Ox Alpha potrebbe essere stato smascherato: l'analisi punta al GLM di Zhipu
Un trucco di iniezione tempestiva e un'analisi della compressione gzip suggeriscono che il modello misterioso Ox Alpha di OpenRouter sia il GLM di Zhipu, ma gli scettici si oppongono.
DeepSeek aggiunge visione a V4-Flash con un modello sperimentale in grado di supportare immagini
DeepSeek fornisce deepseek-v4-flash-vision-exp con input di immagini, contesto token da 1 milione e prezzi a livello di Flash, risolvendo il punto cieco più noto del suo modello.
OpenAI taglia i prezzi dell'API GPT-5.6 Sol di oltre il 20% mentre la guerra dei prezzi raggiunge il suo fiore all'occhiello
OpenAI ha tagliato i prezzi per gli sviluppatori GPT-5.6 Sol di oltre il 20%, portando i token di output a 20 dollari per milione. La mossa pone fine a mesi di mantenimento del prezzo di punta.
Ox Alpha: il modello AI Stealth gratuito di OpenRouter con contesto di token 1M dà il via a un Whodunit
Un modello di frontiera stealth gratuito chiamato Ox Alpha è apparso su OpenRouter con un contesto token da 1 milione e input video, e la comunità AI sta correndo per smascherare il suo creatore.
I modelli Gemma Open di Google superano 1 miliardo di download e le varianti della community sono tra le prime 100.000
Google afferma che i suoi modelli aperti Gemma hanno superato 1 miliardo di download, con oltre 100.000 varianti comunitarie, implementazioni orbitali con la NASA e un nuovo hub Awesome Gemma.
Ornith-1.5 corrisponde a Claude Opus 4.8 sui benchmark di codifica agentica con modelli completamente aperti e auto-miglioranti
La famiglia Ornith-1.5 con licenza MIT genera le proprie attività di addestramento e impalcature – e la sua ammiraglia 397B collega Claude Opus 4.8 sulla codifica Terminal-Bench 2.1.
Il Qwen 3.8 27B di Alibaba funziona su un laptop e supera i suoi modelli più grandi
Qwen 3.8 27B di Alibaba è un modello di visione Apache-2.0 che funziona su laptop e batte il Qwen 3.7-Plus chiuso, ma la sua impostazione di ragionamento predefinita sovraintende a tutto.
I modelli AI Qwen di Alibaba raggiungono i 3 miliardi di download, superando Meta e Google
I modelli Qwen di Alibaba hanno superato i 3 miliardi di download superando Meta e Google nell'adozione dell'intelligenza artificiale open source, settimane dopo il rilascio di Qwen 3.8 a pesi aperti.
GLM-5.3 di Z.ai raddoppia la codifica e emerge con sorprendenti capacità di sicurezza informatica
Il nuovo GLM-5.3 di Z.ai registra notevoli miglioramenti nella codifica e una scoperta di vulnerabilità all'avanguardia, riducendo il divario tra Anthropic e OpenAI rispetto alla frontiera del peso aperto.
Google fornisce Gemini 3.7 Flash: il suo cavallo di battaglia più intelligente per la codifica e gli agenti a metà prezzo
Gemini 3.7 Flash di Google arriva appena tre settimane dopo 3.6 Flash con importanti vantaggi in termini di codifica e agenti, oltre a un prezzo di lancio a metà del costo del suo predecessore.
DeepSeek lancia V4 Pro per la disponibilità generale, l'agente di cablaggio open source e aumenta i prezzi delle API
Il laboratorio cinese di intelligenza artificiale DeepSeek rilascia V4 Pro in anteprima, distribuisce Harness v0.1 come rivale open source di Claude Code e aumenta drasticamente i prezzi delle API prima della sua IPO.
xAI lancia Grok 4.6, corrispondente a GPT-5.6 Sol su Frontier Intelligence Index
Grok 4.6 di xAI ottiene un punteggio di 61 nell'indice di intelligenza artificiale di analisi, legando GPT-5.6 Sol con prestazioni agentiche eccezionali a un costo inferiore del 60%. Disponibile ora in Cursor e Grok Build.
SL2T di Google DeepMind porta la traduzione della lingua dei segni sui telefoni Pixel 11
Google DeepMind ha presentato SL2T, un modello di traduzione della lingua dei segni che trasforma la lingua dei segni in testo sulla gamma Pixel 11, a partire da Pixel 11 Pro Fold.
Nvidia costruisce Nemotron 4 da 1 trilione di parametri per sfidare i migliori modelli di intelligenza artificiale open source
Nvidia sta sviluppando Nemotron 4, un modello di intelligenza artificiale open source con almeno un trilione di parametri, per rivaleggiare con i principali sistemi open-weight. Il modello potrebbe arrivare questo autunno.
NVIDIA lancia Nemotron 3.5 Lightning e NeMo Switchyard per un'IA agentica più intelligente
Il nuovo modello aperto da 30 miliardi di parametri di NVIDIA e la libreria di routing open source promettono risultati fino a 4 volte più veloci e attività degli agenti più veloci del 30% su dispositivi edge, PC e cloud.
Mark Zuckerberg dichiara guerra ai rivali chiusi dell'IA nel Manifesto della superintelligenza poiché Meta Open Source è il suo modello più potente
Mark Zuckerberg di Meta ha pubblicato un ampio manifesto che chiede un'intelligenza artificiale superintelligente per tutti, attaccando i rivali IA chiusi e rilasciando una versione aperta del modello più potente di Meta.
Meta rilascia Muse Glimmer, un modello a peso aperto da 30 miliardi che esegue agenti IA su GPU consumer
Meta ha pubblicato Muse Glimmer, un modello aperto da 30 miliardi di parametri sotto Apache 2.0 che supera Gemma4-31B e Qwen3.6-27B sui benchmark agentici mentre viene eseguito localmente.
OpenAI mette in pausa il modello Astra dopo che le valutazioni hanno segnalato le capacità di sicurezza informatica "critiche"
OpenAI ha sospeso lo sviluppo del suo prossimo modello Astra dopo che i test hanno dimostrato che potrebbe raggiungere la soglia di sicurezza informatica "Critica", il primo modello ad attivare il livello di rischio più alto.
Secondo quanto riferito, ByteDance sta addestrando un modello AI da 10 trilioni di parametri per rivaleggiare con i miti di Anthropic
Il Financial Times riporta che ByteDance sta costruendo un enorme modello da 10 trilioni di parametri progettato per corrispondere alla scala dei Mythos di Anthropic, intensificando la corsa all'intelligenza artificiale tra Stati Uniti e Cina.
OpenAI sospende il lavoro sul nuovo modello Astra a causa di problemi critici di sicurezza informatica
OpenAI ha rallentato lo sviluppo del suo prossimo modello Astra dopo che test interni hanno rivelato capacità informatiche di livello critico, rafforzando i controlli prima del rilascio.
Imagine Image 2.0 di xAI si colloca appena dietro GPT-Image-2 di OpenAI nei benchmark Arena
xAI ha rilasciato Imagine Image 2.0 per Grok, classificandosi al secondo posto a livello globale nei benchmark Arena dietro GPT-Image-2 di OpenAI, con nuovi strumenti di editing, supporto multi-riferimento e modelli preconfigurati.
OpenAI sospende lo sviluppo del modello Astra dopo che ha raggiunto la soglia di rischio "critica" per la sicurezza informatica
OpenAI ha interrotto parte dello sviluppo di Astra dopo che test interni hanno scoperto che potrebbe raggiungere il livello di rischio di sicurezza informatica più alto nel suo Quadro di preparazione, il primo dei suoi modelli a farlo.
ByteDance sta addestrando un modello AI da 10 trilioni di parametri per rivaleggiare con i miti di Anthropic
ByteDance sta addestrando un mega modello di intelligenza artificiale con un massimo di 10 trilioni di parametri, avvicinandosi alle dimensioni stimate di Mythos 5 di Anthropic e facendo impallidire gli attuali leader cinesi.
Shieldstral di Mistral: un modello di sicurezza a pesi aperti 3B che legge le politiche invece di memorizzarle
Mistral AI ha rilasciato Shieldstral, un classificatore di sicurezza a pesi aperti con parametri 3B che valuta testo e immagini rispetto alle politiche di moderazione in linguaggio semplice al momento dell'inferenza.
Alibaba lancia Qwen3.8-Max: un modello da 2,4 trilioni di parametri che rivaleggia con Claude di Anthropic
Alibaba ha rilasciato Qwen3.8-Max, un modello da 2,4 trilioni di parametri che segue solo Claude di Anthropic nei benchmark, con pesi aperti promessi entro pochi giorni.
Il modello Astra di OpenAI risolve 10 problemi matematici irrisolti da tempo con dimostrazioni controllate dalla macchina
Il modello Astra inedito di OpenAI ha risolto 10 problemi aperti in matematica e informatica con prove verificate dal Lean, anticipando il suo prossimo modello importante prima della revisione del governo degli Stati Uniti.
Gemini 3.5 Pro emerge nei blind test della LM Arena mentre Google si avvicina al rilascio
Il ritardato Gemini 3.5 Pro di Google è stato più volte individuato nei blind test della LMSYS Chatbot Arena, segnalando che un lancio pubblico potrebbe finalmente essere imminente.
Thinking Machines lancia Inkling-Small: il modello a peso aperto 276B con dimensioni pari a un quarto della sua ammiraglia
Thinking Machines Lab ha lanciato Inkling-Small, un modello a peso aperto da 276 miliardi di parametri con 12B attivo che eguaglia il suo fiore all'occhiello con un quarto delle dimensioni: un concorrente statunitense nella corsa a peso aperto.
DeepSeek lancia la beta pubblica di V4-Flash mentre la guerra dei prezzi dell'intelligenza artificiale in Cina si intensifica
DeepSeek ha rilasciato l'API beta ufficiale V4-Flash, con un modello riqualificato che batte il suo fiore all'occhiello V4 Pro su nove benchmark di agenti, sottoquotando i rivali statunitensi in termini di prezzo.
OpenAI riduce i prezzi dei modelli GPT-5.6 fino all'80% mentre le aziende diventano sempre più sensibili ai costi dell'IA
OpenAI ha tagliato i prezzi su due modelli GPT-5.6, tra cui Luna, riducendo i costi dei modelli più piccoli fino all'80% mentre le aziende esaminano attentamente la spesa per l'intelligenza artificiale.
Il nuovo modello V4-Flash di DeepSeek corrisponde a GPT-5.6 Luna a un costo inferiore del 60%
DeepSeek ha rilasciato V4-Flash '0731', un modello open-weight che quasi eguaglia il GPT-5.6 Luna di OpenAI nei benchmark pur costando circa il 60% in meno.
MiniMax cinese rilascia il modello video AI H3 con clip 2K, audio stereo e pesi aperti
La startup cinese di intelligenza artificiale MiniMax ha lanciato il suo modello di generazione video H3 il 31 luglio 2026, offrendo risoluzione 2K, audio stereo e pesi aperti a una frazione dei prezzi della concorrenza, sfidando direttamente Seedance 2.5 di ByteDance.
Google DeepMind presenta Gemini Robotics 2 con controllo umanoide dell'intero corpo e collaborazione multi-robot
Google DeepMind ha lanciato Gemini Robotics 2, un modello di visione-linguaggio-azione che consente ai robot umanoidi di muoversi, afferrare e coordinare le attività in tutto il corpo.
OpenAI riduce i prezzi dell'API GPT-5.6 fino all'80% mentre le aziende riconsiderano i costi dell'intelligenza artificiale
OpenAI ha tagliato i prezzi delle API GPT-5.6 Luna e Terra fino all'80% il 30 luglio 2026, sottoquotando Anthropic mentre le aziende esaminano attentamente la spesa per l'inferenza.
OpenAI afferma che GPT-5.6 Sol batte Claude Opus 5 su ARC-AGI-3, ma solo con le proprie impostazioni
OpenAI riporta che GPT-5.6 Sol ha ottenuto un punteggio del 38,3% su ARC-AGI-3 utilizzando ragionamento e compattazione mantenuti, superando Claude Opus 5. Ma l'imbracatura ufficiale racconta una storia diversa, innescando un dibattito sull'equità del benchmark.
Black Forest Labs presenta FLUX 3: un unico modello di intelligenza artificiale per immagini, video, audio e robotica
Black Forest Labs ha lanciato FLUX 3, un modello multimodale che genera congiuntamente immagini, video con audio nativo e previsioni delle azioni dei robot, preferito rispetto a Runway Gen-4.5 nel 77% dei confronti.
