Google ha introdotto un trio di nuovi modelli Gemini il 21 luglio 2026, raddoppiando l’efficienza e il rapporto costo-efficacia di cui gli sviluppatori hanno bisogno per creare agenti AI di produzione su larga scala. L'azienda ha presentato Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e Gemini 3.5 Flash Cyber, ciascuno rivolto a un segmento diverso del panorama dei modelli IA sempre più competitivo. Per una copertura completa degli ultimi sviluppi nelle ultime notizie sull'intelligenza artificiale, queste versioni segnano la spinta più aggressiva di Google per conquistare il mercato degli sviluppatori sensibile ai costi.

L'annuncio arriva in un momento cruciale per il colosso della ricerca. Mentre concorrenti come OpenAI e Anthropic hanno catturato l'attenzione con i loro modelli di punta, la serie Flash di Google si è ritagliata una nicchia come punto di riferimento per gli sviluppatori che hanno bisogno di gestire agenti AI in modo economico e affidabile. I nuovi modelli rappresentano un significativo passo avanti sia in termini di qualità che di efficienza nei flussi di lavoro degli agenti.

Gemini 3.6 Flash: il nuovo modello del cavallo di battaglia

Gemini 3.6 Flash si posiziona come il modello cavallo di battaglia di Google, basandosi direttamente sul feedback degli sviluppatori che utilizzano il precedente 3.5 Flash. Secondo l'annuncio di Google, redatto dal Senior Director of Product Management Tulsee Doshi, il modello offre codifica, lavoro di conoscenza e prestazioni multimodali migliorati riducendo significativamente il consumo di token.

Nell'indice di analisi artificiale, Gemini 3.6 Flash consuma il 17% in meno di token di output rispetto al suo predecessore. In alcuni benchmark, come DeepSWE di Datacurve, la riduzione arriva fino al 65%. Il modello richiede inoltre meno passaggi di ragionamento e chiamate a strumenti per realizzare flussi di lavoro in più fasi.

Il prezzo è stato fissato a 1,50 dollari per milione di token di input e 7,50 dollari per milione di token di output, sottoquotando la generazione precedente. Ciò rende gli agenti più convenienti da costruire ed eseguire su larga scala, un fattore critico per le aziende che implementano l’intelligenza artificiale in migliaia di attività simultanee.

Miglioramenti del benchmark

Google ha riportato diversi notevoli miglioramenti delle prestazioni rispetto a 3.5 Flash:

  • DeepSWE: 49% contro 37%, riflettendo una maggiore precisione nella modifica del codice con meno modifiche indesiderate e cicli di esecuzione ridotti
  • MLE Bench: 63,9% contro 49,7%, un salto significativo nelle capacità di ricerca sul machine learning
  • Verificato OSWorld: 83,0% contro 78,4%, mostrando capacità di utilizzo del computer migliorate
  • GDPval-AA v2: 1421 contro 1349, riflettendo i miglioramenti nelle attività di lavoro basato sulla conoscenza

L'uso del computer è ora disponibile come strumento lato client integrato tramite Gemini API e Gemini Enterprise, eliminando la necessità di livelli di orchestrazione di terze parti.

Gemini 3.5 Flash-Lite: progettato per velocità e scalabilità

Insieme all'aggiornamento Flash, Google ha rilasciato Gemini 3.5 Flash-Lite, progettato per attività a bassa latenza e carichi di lavoro ad alto rendimento come la ricerca di agenti e l'elaborazione di documenti. È il modello più veloce della serie 3.5, con 350 token di output al secondo misurati da Artificial Analysis.

Con un prezzo aggressivo di 0,30 dollari per milione di token di input e 2,50 dollari per milione di token di output, Flash-Lite offre un interessante rapporto prezzo/prestazioni per gli sviluppatori che gestiscono traffico di produzione su larga scala. Google ha notato che in molte valutazioni di agenti e codifica, il modello supera addirittura il più grande Gemini 3 Flash, anche su SWE-Bench Pro (54,2% contro 49,6%) e OSWorld-Verified (74,0% contro 65,1%).

Il modello supporta livelli di pensiero configurabili, consentendo agli sviluppatori di dare priorità all'esecuzione a bassa latenza per attività ad alto volume o di coinvolgere livelli di pensiero più elevati per carichi di lavoro complessi di subagenti multi-step.

Gemini 3.5 Flash Cyber: AI per la sicurezza dei codici

La terza versione, Gemini 3.5 Flash Cyber, è un modello specializzato messo a punto per individuare e correggere le vulnerabilità della sicurezza informatica. Costruito sulla base di 3.5 Flash, è abbinato all'agente CodeMender di Google, che utilizza più agenti Flash Cyber ​​che lavorano insieme per produrre report di sicurezza combinati.

Sul benchmark CyberGym, il modello raggiunge prestazioni competitive di frontiera. Tuttavia, data la natura a duplice uso della tecnologia, Google sta adottando un approccio deliberatamente cauto nell’implementazione. Il modello sarà disponibile esclusivamente per governi e partner fidati tramite CodeMender come parte di un programma pilota ad accesso limitato.

Ciò offre ai difensori in prima linea un vantaggio nel trovare e risolvere le vulnerabilità critiche prima che possano essere sfruttate, mitigando al contempo il rischio di un uso improprio più ampio.

Gemini 3.5 Pro ancora in fase di test

Google ha confermato che Gemini 3.5 Pro, il modello di punta il cui ritardo è stato attentamente monitorato, è attualmente in fase di test con i partner e sarà reso ampiamente disponibile non appena sarà pronto. L'azienda aveva precedentemente posticipato il lancio di Pro a causa di obiettivi di performance interni e di un'ondata di partenze di ricercatori.

Forse la cosa più notevole è che Google ha rivelato che il team ha già iniziato quella che ha descritto come la corsa di pre-addestramento più ambiziosa finora per Gemini 4, segnalando che la prossima generazione di modelli è già in corso.

Misure di sicurezza migliorate

Gemini 3.6 Flash viene fornito con protezioni Frontier Safety migliorate nei settori delle minacce chimiche, biologiche, radiologiche e nucleari (CBRN) e degli abusi di reati informatici. Google afferma che queste misure di salvaguardia rendono il modello sostanzialmente più resistente ai jailbreak riducendo al minimo i rifiuti per usi vantaggiosi.

Il rilascio arriva nel mezzo di un controllo approfondito sulla sicurezza dei modelli di intelligenza artificiale a Washington, dove l’amministrazione Trump ha spinto le aziende a condividere modelli inediti con tester governativi prima del rilascio pubblico. Google DeepMind e Microsoft hanno entrambi firmato accordi con il Centro governativo per gli standard e l'innovazione dell'intelligenza artificiale nel maggio 2026 per condividere i loro modelli di frontiera per i test di sicurezza nazionale.

Disponibilità

Gemini 3.6 Flash e 3.5 Flash-Lite sono immediatamente disponibili per gli sviluppatori tramite l'API Gemini, Google AI Studio e Android Studio. I clienti aziendali possono accedervi tramite Gemini Enterprise Agent Platform. L'app Gemini supporta inoltre entrambi i modelli per l'uso da parte dei consumatori e 3.5 Flash-Lite è in fase di implementazione nella Ricerca Google.

Stai al passo con l'intelligenza artificiale

Vuoi di più dal mondo dell'intelligenza artificiale? Aggiungi ai segnalibri AI Buzz Wire per la copertura più recente del settore dell'intelligenza artificiale di cui ti puoi fidare.

Leggi altre notizie sull'AI →