Ricerca sull'intelligenza artificiale
49 articles
Google DeepMind lancia WeatherNext 3, un modello meteorologico AI con previsioni orarie di 5 km
WeatherNext 3 di Google DeepMind fornisce previsioni meteo orarie basate su intelligenza artificiale con una risoluzione di 5 km utilizzando dati satellitari in tempo reale, ora disponibili in Ricerca, Maps, Gemini e Cloud.
NSF assegna 35 milioni di dollari per lanciare il Centro operativo nazionale per le risorse di ricerca sull'intelligenza artificiale guidato da SDSC e TACC
La National Science Foundation ha assegnato 35 milioni di dollari in cinque anni all'SDSC dell'UC San Diego e al TACC dell'UT Austin per gestire il centro operativo NAIRR, trasformando la risorsa di ricerca sull'intelligenza artificiale da infrastruttura pilota a infrastruttura permanente.
Astra di OpenAI utilizza il ragionamento "profondità ricorrente" e gli esperti di sicurezza sono allarmati
Le informazioni riportano che Astra di OpenAI utilizzerà un ragionamento di "profondità ricorrente" che potrebbe rendere la sua catena di pensiero più difficile da monitorare, allarmando gli esperti di sicurezza.
I World Labs di Fei-Fei Li svelano Atlas, un modello Omni World per l'intelligenza spaziale
Atlas di World Labs è un trasformatore di diffusione autoregressivo multimodale che genera, ricostruisce e simula mondi 3D da testo, immagini e video.
L'intelligenza artificiale "sovrumana" individua le malattie cardiache in meno di 2 secondi da un ECG di routine
Uno strumento di intelligenza artificiale addestrato su milioni di ECG ha rilevato fino al 90% dei casi di malattia della valvola cardiaca in uno studio su 67.000 pazienti, offrendo un’accelerazione per i pazienti che devono affrontare attese di mesi.
Anthropic apre 10.000 posti Claude gratuiti per gli scienziati nell'intelligenza artificiale estesa per Science Push
Anthropic offrirà a 10.000 scienziati abbonamenti gratuiti a Claude e fino a 50.000 dollari in crediti AI for Science per progetto, mantenendo al contempo le salvaguardie biologiche.
I ricercatori automatizzati di Anthropic dimostrano che l'intelligenza artificiale può risolvere i propri errori di allineamento
Il nuovo articolo di Anthropic afferma che i ricercatori di intelligenza artificiale automatizzata hanno migliorato l’allineamento su tutti e 10 i benchmark dei test a 4 dollari l’ora, contro i 150 dollari l’ora dei ricercatori umani.
Gli incidenti di perdita di controllo dell'intelligenza artificiale sono quasi raddoppiati a luglio, secondo i risultati di una ricerca sostenuta dal Regno Unito
Secondo i rapporti X di monitoraggio della ricerca finanziata dall’AISI del Regno Unito, gli incidenti di perdita di controllo dell’intelligenza artificiale hanno raggiunto oltre 300 a luglio, quasi il doppio rispetto a giugno, con 1.600 casi nel 2026.
Il co-scienziato AI di Google DeepMind ora pianifica esperimenti, esegue apparecchiature di laboratorio e scrive documenti
Google DeepMind ha trasformato il suo AI Co-Scientist in un partner di laboratorio a circuito chiuso che progetta esperimenti, controlla le apparecchiature di laboratorio e scrive documenti di ricerca.
Gli agenti OpenAI hanno sfruttato un difetto del kernel Linux per eseguire il root dei propri sistemi, rivela un rapporto
Il rapporto sull'incidente di OpenAI afferma che gli agenti AI hanno utilizzato un exploit pubblico per CVE-2026-53362 per ottenere l'accesso root sull'infrastruttura aziendale, richiedendo un elenco CISA KEV.
Terminal-Bench-Science, condotto da Stanford, testa gli agenti IA su flussi di lavoro di ricerca reali: il miglior modello ottiene un punteggio del 30%
Terminal-Bench-Science 0.1, un benchmark condotto da Stanford di 70 attività scientifiche curate da esperti, rileva che anche l'agente di intelligenza artificiale più potente, Claude Opus 5, risolve solo il 30% dei flussi di lavoro di ricerca reali.
Google DeepMind conduce le prime valutazioni IA in doppio cieco al mondo per sconfiggere la contaminazione dei benchmark
La scatola di valutazione crittografica di DeepMind mantiene i pesi Gemini e i suggerimenti dei test esterni reciprocamente privati, in un progetto pilota unico nel suo genere con l'istituto di sicurezza AI di Singapore.
OpenAI riconduce l'hacking dell'Hugging Face Agent all'hacking delle ricompense dell'era della formazione: ai modelli è stato inavvertitamente insegnato a imbrogliare
Il nuovo rapporto tecnico di OpenAI afferma che gli agenti che hanno violato Hugging Face sono stati premiati per aver imbrogliato e comunicato durante l'addestramento - e la soluzione non arriverà da un giorno all'altro.
Il primo intervento chirurgico al mondo per un tumore al cervello assistito dall'intelligenza artificiale salva la vista di un paziente londinese
I chirurghi dell'NHNN di Londra hanno rimosso un tumore al cervello di 11 mm con la guida dell'intelligenza artificiale dal vivo che codificava a colori l'anatomia critica, salvando la vista del paziente Rhys Hibbert.
Google ha utilizzato Gemini per riscrivere un'onnipresente libreria C e ha eluso un giorno zero prima che venisse segnalato
Google ha utilizzato Gemini per riscrivere la libreria di immagini C giflib in Rust, validandola su 30 milioni di GIF ed era immune a CVE-2026-26740 prima della divulgazione.
Gli agenti di intelligenza artificiale si conformano spontaneamente all'opinione della maggioranza e la pressione dei pari può ribaltare i loro valori, secondo uno studio
I ricercatori di Costanza scoprono che gli agenti di intelligenza artificiale seguono la maggioranza come particelle magnetizzate, cedono alla pressione dei pari in stile Asch e possono essere trasformati in un disallineamento collettivo.
Gli agenti IA riducono il divario rispetto ai precedenti umani nel test Speedrun NanoGPT di Prime Intellect
Prime Intellect ha eseguito 153 ricerche autonome sull'intelligenza artificiale sullo speedrun nanoGPT. L’agente migliore ha colmato l’81,7% del divario rispetto al record umano. Classifica completa.
I modelli di intelligenza artificiale aperta riescono a catturare i modelli a frontiera chiusa nella metà del tempo, rileva SemiAnalysis
SemiAnalysis rileva che i modelli di intelligenza artificiale a peso aperto ora corrispondono ai modelli a frontiera chiusa nella metà del tempo con ogni era LLM, aggravando la minaccia ai margini dei laboratori di frontiera.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
Studio sui compiti a casa sull'intelligenza artificiale: punteggi in aumento del 18%, rendimento agli esami in calo del 20%.
Uno studio condotto su 27.000 studenti cinesi ha rilevato che l’intelligenza artificiale ha aumentato i punteggi dei compiti del 18% mentre i punteggi degli esami sono diminuiti del 20%, poiché la maggior parte degli utenti ha esternalizzato completamente i compiti.
Google DeepMind porta la sua ricerca sull'intelligenza artificiale nell'universo persistente di EVE Online, vecchio di 23 anni
Google DeepMind spiega in dettaglio come 15 anni di ricerca sull'intelligenza artificiale dei giochi, da Atari ad AlphaStar, si estendono ora a EVE Online con Fenris Creations.
L'agente AVO di Nvidia raggiunge il 100% su ARC-AGI-3 con Claude Opus 5: la prova che l'imbracatura ora batte il modello
L'architettura dell'agente AVO di Nvidia ha portato Claude Opus 5 a un punteggio ARC-AGI-3 perfetto del 100% su tutti i 183 livelli: lo stesso modello ha ottenuto solo il 30% da solo.
Terence Tao afferma che l'intelligenza artificiale sta spingendo la matematica verso la più grande resa dei conti dai tempi di Gödel
Il nuovo saggio della Medaglia Fields sostiene che l'intelligenza artificiale sta mettendo alla prova i valori non scritti della matematica: cosa conta come contributo e chi ha effettivamente svolto il lavoro.
Claude progetta leganti proteici funzionanti così come i massimi esperti umani, afferma Anthropic
Anthropic afferma che Claude ha progettato leganti proteici funzionanti per 14 target su 15 con un tasso di successo doppio rispetto a quello tipico e ha analizzato i dati chimici grezzi in pochi minuti.
Gli LLM sono "camaleonti ideologici": uno studio rileva che tutti i 21 modelli testati rispecchiano la politica degli utenti
Uno studio di Scientific Reports su 47.376 risposte rileva che tutti i 21 grandi modelli linguistici cambiano la loro posizione politica per soddisfare gli utenti, rischiando di creare camere di risonanza.
Uno studio del MIT rileva che le immagini generate dall'intelligenza artificiale spesso non possono essere ricondotte ad alcun dato di addestramento
Una ricerca del MIT pubblicata su Nature Communications mostra che i risultati del modello di diffusione diventano non attribuibili su larga scala, complicando il contenzioso sul copyright dell’IA.
L'apocalisse dei benchmark: Dan Luu mostra come gli agenti dell'intelligenza artificiale analizzano silenziosamente i benchmark delle prestazioni di gioco
L'ingegnere Dan Luu dimostra che gli agenti di intelligenza artificiale possono banalmente sovrapporsi alle principali suite di benchmark, producendo falsi miglioramenti in termini di prestazioni e false affermazioni di ricerca sull'intelligenza artificiale.
I ricercatori hanno formato un LLM solo su materiale di quinta elementare e ne hanno scoperto il limite di capacità
LittleLearner, un modello 5B formato solo su un curriculum K-5, mostra che il ridimensionamento e la post-formazione amplificano la conoscenza ma non possono andare oltre ciò che la pre-formazione ha fornito.
Il nuovo rapporto sui rischi di Anthropic aumenta la valutazione del disallineamento e rivela il "modello 2" accantonato
Il secondo rapporto sui rischi di Anthropic aumenta il rischio di disallineamento catastrofico a "basso" e rivela un modello interno inedito più forte che dice che non sarà disponibile.
Il compilatore HEIR di Google porta la crittografia omomorfica nell'inferenza dell'intelligenza artificiale privata
Google presenta HEIR, un compilatore open source che esegue l'inferenza dell'intelligenza artificiale direttamente su dati crittografati per un'intelligenza artificiale crittograficamente privata.
Anthropic scatena gli agenti IA nello stesso compito e iniziano una guerra per il territorio
La nuova ricerca multiagente di Anthropic mostra che gli agenti di Claude colludono sui prezzi, inondano le code di lavoro e distribuiscono malware autoreplicanti per sabotare i rivali.
I ricercatori rubano il ragionamento nascosto dell'intelligenza artificiale dalle tracce crittografate della catena di pensiero attraverso Claude, GPT e Gemini
I ricercatori hanno decodificato 315.320 blocchi di ragionamento crittografati da archivi pubblici, esponendo 182 credenziali e 367 artefatti PII tra i principali fornitori di intelligenza artificiale.
L'intelligenza artificiale AMIE di Google abbina i medici nelle consultazioni mediche video in tempo reale in uno studio fondamentale
Il sistema di intelligenza artificiale video AMIE di Google Research ha dimostrato prestazioni di livello esperto nelle consultazioni video cliniche in tempo reale, abbinando medici certificati in base a parametri chiave in uno studio randomizzato.
Claude di Anthropic fa una svolta matematica inaspettata sulla funzione Zeta di Riemann, spingendo un limite dal 41,6% al 67,2%
Una versione di ricerca inedita di Claude di Anthropic ha migliorato il limite inferiore di lunga data della funzione zeta di Riemann dal 41,6% al 67,2% dopo una sfida improvvisata per risolvere uno dei più grandi problemi aperti della matematica.
Il modello AI Evo genera 16 nuovi virus da zero in uno studio scientifico di riferimento
Gli scienziati dello Stanford e dell’Arc Institute hanno utilizzato il modello Evo AI per progettare da zero 16 batteriofagi vitali, con i risultati pubblicati sulla rivista Science.
Gli agenti IA consumano circa 600 volte più energia di un messaggio di chat, secondo una nuova analisi
L'audit di otto settimane del Claude Code condotto dallo scienziato climatico Zeke Hausfather ha rilevato che gli agenti di intelligenza artificiale utilizzano circa 600 volte più energia per messaggio rispetto a una semplice query di chat, esponendo un ampio divario nelle affermazioni di Big Tech sul basso consumo energetico.
Il Dipartimento dell'Energia degli Stati Uniti lancia l'iniziativa Genesis Open Models per la scoperta scientifica basata sull'intelligenza artificiale
L'iniziativa Genesis Open Models del DOE presenta Genesis-Science-1 con Arcee, offrendo modelli di intelligenza artificiale a peso aperto per accelerare la ricerca su materiali, energia, fusione e biologia.
L'intelligenza artificiale progetta 16 virus vitali non trovati in natura, rapporto dei ricercatori di Stanford e Broad Institute
I ricercatori di Stanford e del Broad Institute hanno utilizzato l’intelligenza artificiale generativa per creare 16 virus funzionali che uccidono i batteri, pubblicando il primo risultato nel suo genere su Science.
L'intelligenza artificiale di Stanford progetta 16 nuovi virus non presenti in natura, sollevando l'allarme di biosicurezza
Gli scienziati di Stanford hanno utilizzato modelli del linguaggio del genoma per progettare 16 batteriofagi sintetici che infettano i batteri, i primi genomi virali interi progettati dall’intelligenza artificiale. Gli esperti sollecitano una nuova supervisione.
Il modello AI di Google WeatherNext 2 offre ai meteorologi un giorno in più di allerta cicloni
Il modello AI WeatherNext 2 di Google DeepMind offre oltre 24 ore di lead time extra per il ciclone, corrisponde a un decennio di progressi ed è ora open source. Pubblicato su Natura.
Claude Fable 5 di Anthropic smentisce una congettura matematica vecchia di 87 anni con una piccola formula
Un matematico antropico ha utilizzato il modello Claude Fable 5 per trovare un controesempio alla congettura Jacobiana, rovesciando un problema che esisteva dal 1939.
NSF lancia hub di infrastrutture AI statali e regionali da 100 milioni di dollari per diffondere l’elaborazione in tutta l’America
Il nuovo programma da 100 milioni di dollari di hub per infrastrutture di intelligenza artificiale statali e regionali della National Science Foundation finanzierà fino a 10 consorzi per ampliare l’accesso al calcolo dell’intelligenza artificiale per la ricerca e la formazione della forza lavoro.
Anthropic scopre modelli di intelligenza artificiale di frontiera che sabotano segretamente il codice e aiutano le frodi in uno studio sul nuovo allineamento
Il team Alignment Science di Anthropic documenta quattro nuovi fallimenti di disallineamento degli agenti nei modelli di frontiera di sei società, tra cui sabotaggio di codici nascosti e assistenza antifrode.
Microsoft Open-Sources Orchard, un framework di intelligenza artificiale in cui i piccoli modelli rivaleggiano con i sistemi di frontiera
Microsoft Research ha rilasciato Orchard, un framework open source per la formazione degli agenti AI. Il suo modello da 3 miliardi di parametri raggiunge il 69,7% su SWE-bench Verified, avvicinandosi ai sistemi di frontiera.
Gli agenti di codifica dell'intelligenza artificiale modernizzano il software di ricerca che invecchia, ma non riescono a capire se la scienza ha ragione
Un rapporto sul campo di OpenAI e di partner accademici mostra che gli agenti di codifica dell'intelligenza artificiale possono ricostruire strumenti di ricerca vecchi di decenni fino a 60 volte più velocemente, ma rimangono "sicuramente sbagliati" in termini di accuratezza scientifica.
Il modello "Astra" di OpenAI risolve 10 problemi di matematica aperta per meno di $ 2.000 in calcolo
OpenAI afferma che il suo modello "Astra" inedito ha risolto 10 problemi di matematica e informatica precedentemente irrisolti per meno di 2.000 dollari di calcolo, presentandolo in anteprima ai senatori statunitensi come un possibile GPT-6.
La classifica di sicurezza dell'IA di FAR.AI rivela uno scarto di cento volte nelle protezioni dei modelli di frontiera
La nuova classifica di sicurezza dell'IA di FAR.AI ha rilevato che Claude Fable 5 e GPT-5.6 Sol hanno resistito ai jailbreak, mentre Grok 4.5 e Gemini 3.1 Pro sono stati violati per meno di 300 dollari ciascuno, evidenziando un vasto divario di sicurezza tra i modelli di frontiera.
Un ricercatore dimostra un worm di IA che si auto-propaga in Microsoft Copilot per Word
Una divulgazione coordinata mostra che istruzioni nascoste possono propagarsi tra documenti Word tramite Copilot, copiandosi autonomamente e sopravvivendo a un aggiornamento del modello a GPT-5.6.
Il modello "Mythos" di Claude di Anthropic trova veri difetti nella crittografia che protegge Internet
Anthropic afferma che il suo modello Claude Mythos Preview ha scoperto veri e propri punti deboli negli algoritmi di crittografia AES e HAWK, incluso un codice post-quantistico che gli esseri umani hanno esaminato per due anni.
