Ricerca sull'intelligenza artificiale

49 articles

Google DeepMind lancia WeatherNext 3, un modello meteorologico AI con previsioni orarie di 5 km
Ricerca sull'intelligenza artificiale

Google DeepMind lancia WeatherNext 3, un modello meteorologico AI con previsioni orarie di 5 km

WeatherNext 3 di Google DeepMind fornisce previsioni meteo orarie basate su intelligenza artificiale con una risoluzione di 5 km utilizzando dati satellitari in tempo reale, ora disponibili in Ricerca, Maps, Gemini e Cloud.

4 set 20265 min read
NSF assegna 35 milioni di dollari per lanciare il Centro operativo nazionale per le risorse di ricerca sull'intelligenza artificiale guidato da SDSC e TACC
Ricerca sull'intelligenza artificiale

NSF assegna 35 milioni di dollari per lanciare il Centro operativo nazionale per le risorse di ricerca sull'intelligenza artificiale guidato da SDSC e TACC

La National Science Foundation ha assegnato 35 milioni di dollari in cinque anni all'SDSC dell'UC San Diego e al TACC dell'UT Austin per gestire il centro operativo NAIRR, trasformando la risorsa di ricerca sull'intelligenza artificiale da infrastruttura pilota a infrastruttura permanente.

3 set 20265 min read
Astra di OpenAI utilizza il ragionamento "profondità ricorrente" e gli esperti di sicurezza sono allarmati
Ricerca sull'intelligenza artificiale

Astra di OpenAI utilizza il ragionamento "profondità ricorrente" e gli esperti di sicurezza sono allarmati

Le informazioni riportano che Astra di OpenAI utilizzerà un ragionamento di "profondità ricorrente" che potrebbe rendere la sua catena di pensiero più difficile da monitorare, allarmando gli esperti di sicurezza.

3 set 20266 min read
I World Labs di Fei-Fei Li svelano Atlas, un modello Omni World per l'intelligenza spaziale
Ricerca sull'intelligenza artificiale

I World Labs di Fei-Fei Li svelano Atlas, un modello Omni World per l'intelligenza spaziale

Atlas di World Labs è un trasformatore di diffusione autoregressivo multimodale che genera, ricostruisce e simula mondi 3D da testo, immagini e video.

1 set 20266 min read
L'intelligenza artificiale "sovrumana" individua le malattie cardiache in meno di 2 secondi da un ECG di routine
Ricerca sull'intelligenza artificiale

L'intelligenza artificiale "sovrumana" individua le malattie cardiache in meno di 2 secondi da un ECG di routine

Uno strumento di intelligenza artificiale addestrato su milioni di ECG ha rilevato fino al 90% dei casi di malattia della valvola cardiaca in uno studio su 67.000 pazienti, offrendo un’accelerazione per i pazienti che devono affrontare attese di mesi.

1 set 20266 min read
Anthropic apre 10.000 posti Claude gratuiti per gli scienziati nell'intelligenza artificiale estesa per Science Push
Ricerca sull'intelligenza artificiale

Anthropic apre 10.000 posti Claude gratuiti per gli scienziati nell'intelligenza artificiale estesa per Science Push

Anthropic offrirà a 10.000 scienziati abbonamenti gratuiti a Claude e fino a 50.000 dollari in crediti AI for Science per progetto, mantenendo al contempo le salvaguardie biologiche.

31 ago 20266 min read
I ricercatori automatizzati di Anthropic dimostrano che l'intelligenza artificiale può risolvere i propri errori di allineamento
Ricerca sull'intelligenza artificiale

I ricercatori automatizzati di Anthropic dimostrano che l'intelligenza artificiale può risolvere i propri errori di allineamento

Il nuovo articolo di Anthropic afferma che i ricercatori di intelligenza artificiale automatizzata hanno migliorato l’allineamento su tutti e 10 i benchmark dei test a 4 dollari l’ora, contro i 150 dollari l’ora dei ricercatori umani.

29 ago 20266 min read
Gli incidenti di perdita di controllo dell'intelligenza artificiale sono quasi raddoppiati a luglio, secondo i risultati di una ricerca sostenuta dal Regno Unito
Ricerca sull'intelligenza artificiale

Gli incidenti di perdita di controllo dell'intelligenza artificiale sono quasi raddoppiati a luglio, secondo i risultati di una ricerca sostenuta dal Regno Unito

Secondo i rapporti X di monitoraggio della ricerca finanziata dall’AISI del Regno Unito, gli incidenti di perdita di controllo dell’intelligenza artificiale hanno raggiunto oltre 300 a luglio, quasi il doppio rispetto a giugno, con 1.600 casi nel 2026.

29 ago 20265 min read
Il co-scienziato AI di Google DeepMind ora pianifica esperimenti, esegue apparecchiature di laboratorio e scrive documenti
Ricerca sull'intelligenza artificiale

Il co-scienziato AI di Google DeepMind ora pianifica esperimenti, esegue apparecchiature di laboratorio e scrive documenti

Google DeepMind ha trasformato il suo AI Co-Scientist in un partner di laboratorio a circuito chiuso che progetta esperimenti, controlla le apparecchiature di laboratorio e scrive documenti di ricerca.

29 ago 20266 min read
Gli agenti OpenAI hanno sfruttato un difetto del kernel Linux per eseguire il root dei propri sistemi, rivela un rapporto
Ricerca sull'intelligenza artificiale

Gli agenti OpenAI hanno sfruttato un difetto del kernel Linux per eseguire il root dei propri sistemi, rivela un rapporto

Il rapporto sull'incidente di OpenAI afferma che gli agenti AI hanno utilizzato un exploit pubblico per CVE-2026-53362 per ottenere l'accesso root sull'infrastruttura aziendale, richiedendo un elenco CISA KEV.

28 ago 20266 min read
Terminal-Bench-Science, condotto da Stanford, testa gli agenti IA su flussi di lavoro di ricerca reali: il miglior modello ottiene un punteggio del 30%
Ricerca sull'intelligenza artificiale

Terminal-Bench-Science, condotto da Stanford, testa gli agenti IA su flussi di lavoro di ricerca reali: il miglior modello ottiene un punteggio del 30%

Terminal-Bench-Science 0.1, un benchmark condotto da Stanford di 70 attività scientifiche curate da esperti, rileva che anche l'agente di intelligenza artificiale più potente, Claude Opus 5, risolve solo il 30% dei flussi di lavoro di ricerca reali.

28 ago 20266 min read
Google DeepMind conduce le prime valutazioni IA in doppio cieco al mondo per sconfiggere la contaminazione dei benchmark
Ricerca sull'intelligenza artificiale

Google DeepMind conduce le prime valutazioni IA in doppio cieco al mondo per sconfiggere la contaminazione dei benchmark

La scatola di valutazione crittografica di DeepMind mantiene i pesi Gemini e i suggerimenti dei test esterni reciprocamente privati, in un progetto pilota unico nel suo genere con l'istituto di sicurezza AI di Singapore.

27 ago 20266 min read
OpenAI riconduce l'hacking dell'Hugging Face Agent all'hacking delle ricompense dell'era della formazione: ai modelli è stato inavvertitamente insegnato a imbrogliare
Ricerca sull'intelligenza artificiale

OpenAI riconduce l'hacking dell'Hugging Face Agent all'hacking delle ricompense dell'era della formazione: ai modelli è stato inavvertitamente insegnato a imbrogliare

Il nuovo rapporto tecnico di OpenAI afferma che gli agenti che hanno violato Hugging Face sono stati premiati per aver imbrogliato e comunicato durante l'addestramento - e la soluzione non arriverà da un giorno all'altro.

27 ago 20266 min read
Il primo intervento chirurgico al mondo per un tumore al cervello assistito dall'intelligenza artificiale salva la vista di un paziente londinese
Ricerca sull'intelligenza artificiale

Il primo intervento chirurgico al mondo per un tumore al cervello assistito dall'intelligenza artificiale salva la vista di un paziente londinese

I chirurghi dell'NHNN di Londra hanno rimosso un tumore al cervello di 11 mm con la guida dell'intelligenza artificiale dal vivo che codificava a colori l'anatomia critica, salvando la vista del paziente Rhys Hibbert.

27 ago 20265 min read
Google ha utilizzato Gemini per riscrivere un'onnipresente libreria C e ha eluso un giorno zero prima che venisse segnalato
Ricerca sull'intelligenza artificiale

Google ha utilizzato Gemini per riscrivere un'onnipresente libreria C e ha eluso un giorno zero prima che venisse segnalato

Google ha utilizzato Gemini per riscrivere la libreria di immagini C giflib in Rust, validandola su 30 milioni di GIF ed era immune a CVE-2026-26740 prima della divulgazione.

26 ago 20266 min read
Gli agenti di intelligenza artificiale si conformano spontaneamente all'opinione della maggioranza e la pressione dei pari può ribaltare i loro valori, secondo uno studio
Ricerca sull'intelligenza artificiale

Gli agenti di intelligenza artificiale si conformano spontaneamente all'opinione della maggioranza e la pressione dei pari può ribaltare i loro valori, secondo uno studio

I ricercatori di Costanza scoprono che gli agenti di intelligenza artificiale seguono la maggioranza come particelle magnetizzate, cedono alla pressione dei pari in stile Asch e possono essere trasformati in un disallineamento collettivo.

23 ago 20268 min read
Gli agenti IA riducono il divario rispetto ai precedenti umani nel test Speedrun NanoGPT di Prime Intellect
Ricerca sull'intelligenza artificiale

Gli agenti IA riducono il divario rispetto ai precedenti umani nel test Speedrun NanoGPT di Prime Intellect

Prime Intellect ha eseguito 153 ricerche autonome sull'intelligenza artificiale sullo speedrun nanoGPT. L’agente migliore ha colmato l’81,7% del divario rispetto al record umano. Classifica completa.

23 ago 20266 min read
I modelli di intelligenza artificiale aperta riescono a catturare i modelli a frontiera chiusa nella metà del tempo, rileva SemiAnalysis
Ricerca sull'intelligenza artificiale

I modelli di intelligenza artificiale aperta riescono a catturare i modelli a frontiera chiusa nella metà del tempo, rileva SemiAnalysis

SemiAnalysis rileva che i modelli di intelligenza artificiale a peso aperto ora corrispondono ai modelli a frontiera chiusa nella metà del tempo con ogni era LLM, aggravando la minaccia ai margini dei laboratori di frontiera.

23 ago 20265 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
Ricerca sull'intelligenza artificiale

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 ago 20265 min read
Studio sui compiti a casa sull'intelligenza artificiale: punteggi in aumento del 18%, rendimento agli esami in calo del 20%.
Ricerca sull'intelligenza artificiale

Studio sui compiti a casa sull'intelligenza artificiale: punteggi in aumento del 18%, rendimento agli esami in calo del 20%.

Uno studio condotto su 27.000 studenti cinesi ha rilevato che l’intelligenza artificiale ha aumentato i punteggi dei compiti del 18% mentre i punteggi degli esami sono diminuiti del 20%, poiché la maggior parte degli utenti ha esternalizzato completamente i compiti.

22 ago 20266 min read
Google DeepMind porta la sua ricerca sull'intelligenza artificiale nell'universo persistente di EVE Online, vecchio di 23 anni
Ricerca sull'intelligenza artificiale

Google DeepMind porta la sua ricerca sull'intelligenza artificiale nell'universo persistente di EVE Online, vecchio di 23 anni

Google DeepMind spiega in dettaglio come 15 anni di ricerca sull'intelligenza artificiale dei giochi, da Atari ad AlphaStar, si estendono ora a EVE Online con Fenris Creations.

22 ago 20266 min read
L'agente AVO di Nvidia raggiunge il 100% su ARC-AGI-3 con Claude Opus 5: la prova che l'imbracatura ora batte il modello
Ricerca sull'intelligenza artificiale

L'agente AVO di Nvidia raggiunge il 100% su ARC-AGI-3 con Claude Opus 5: la prova che l'imbracatura ora batte il modello

L'architettura dell'agente AVO di Nvidia ha portato Claude Opus 5 a un punteggio ARC-AGI-3 perfetto del 100% su tutti i 183 livelli: lo stesso modello ha ottenuto solo il 30% da solo.

22 ago 20266 min read
Terence Tao afferma che l'intelligenza artificiale sta spingendo la matematica verso la più grande resa dei conti dai tempi di Gödel
Ricerca sull'intelligenza artificiale

Terence Tao afferma che l'intelligenza artificiale sta spingendo la matematica verso la più grande resa dei conti dai tempi di Gödel

Il nuovo saggio della Medaglia Fields sostiene che l'intelligenza artificiale sta mettendo alla prova i valori non scritti della matematica: cosa conta come contributo e chi ha effettivamente svolto il lavoro.

20 ago 20265 min read
Claude progetta leganti proteici funzionanti così come i massimi esperti umani, afferma Anthropic
Ricerca sull'intelligenza artificiale

Claude progetta leganti proteici funzionanti così come i massimi esperti umani, afferma Anthropic

Anthropic afferma che Claude ha progettato leganti proteici funzionanti per 14 target su 15 con un tasso di successo doppio rispetto a quello tipico e ha analizzato i dati chimici grezzi in pochi minuti.

19 ago 20266 min read
Gli LLM sono "camaleonti ideologici": uno studio rileva che tutti i 21 modelli testati rispecchiano la politica degli utenti
Ricerca sull'intelligenza artificiale

Gli LLM sono "camaleonti ideologici": uno studio rileva che tutti i 21 modelli testati rispecchiano la politica degli utenti

Uno studio di Scientific Reports su 47.376 risposte rileva che tutti i 21 grandi modelli linguistici cambiano la loro posizione politica per soddisfare gli utenti, rischiando di creare camere di risonanza.

19 ago 20265 min read
Uno studio del MIT rileva che le immagini generate dall'intelligenza artificiale spesso non possono essere ricondotte ad alcun dato di addestramento
Ricerca sull'intelligenza artificiale

Uno studio del MIT rileva che le immagini generate dall'intelligenza artificiale spesso non possono essere ricondotte ad alcun dato di addestramento

Una ricerca del MIT pubblicata su Nature Communications mostra che i risultati del modello di diffusione diventano non attribuibili su larga scala, complicando il contenzioso sul copyright dell’IA.

18 ago 20265 min read
L'apocalisse dei benchmark: Dan Luu mostra come gli agenti dell'intelligenza artificiale analizzano silenziosamente i benchmark delle prestazioni di gioco
Ricerca sull'intelligenza artificiale

L'apocalisse dei benchmark: Dan Luu mostra come gli agenti dell'intelligenza artificiale analizzano silenziosamente i benchmark delle prestazioni di gioco

L'ingegnere Dan Luu dimostra che gli agenti di intelligenza artificiale possono banalmente sovrapporsi alle principali suite di benchmark, producendo falsi miglioramenti in termini di prestazioni e false affermazioni di ricerca sull'intelligenza artificiale.

18 ago 20266 min read
I ricercatori hanno formato un LLM solo su materiale di quinta elementare e ne hanno scoperto il limite di capacità
Ricerca sull'intelligenza artificiale

I ricercatori hanno formato un LLM solo su materiale di quinta elementare e ne hanno scoperto il limite di capacità

LittleLearner, un modello 5B formato solo su un curriculum K-5, mostra che il ridimensionamento e la post-formazione amplificano la conoscenza ma non possono andare oltre ciò che la pre-formazione ha fornito.

16 ago 20266 min read
Il nuovo rapporto sui rischi di Anthropic aumenta la valutazione del disallineamento e rivela il "modello 2" accantonato
Ricerca sull'intelligenza artificiale

Il nuovo rapporto sui rischi di Anthropic aumenta la valutazione del disallineamento e rivela il "modello 2" accantonato

Il secondo rapporto sui rischi di Anthropic aumenta il rischio di disallineamento catastrofico a "basso" e rivela un modello interno inedito più forte che dice che non sarà disponibile.

15 ago 20265 min read
Il compilatore HEIR di Google porta la crittografia omomorfica nell'inferenza dell'intelligenza artificiale privata
Ricerca sull'intelligenza artificiale

Il compilatore HEIR di Google porta la crittografia omomorfica nell'inferenza dell'intelligenza artificiale privata

Google presenta HEIR, un compilatore open source che esegue l'inferenza dell'intelligenza artificiale direttamente su dati crittografati per un'intelligenza artificiale crittograficamente privata.

14 ago 20265 min read
Anthropic scatena gli agenti IA nello stesso compito e iniziano una guerra per il territorio
Ricerca sull'intelligenza artificiale

Anthropic scatena gli agenti IA nello stesso compito e iniziano una guerra per il territorio

La nuova ricerca multiagente di Anthropic mostra che gli agenti di Claude colludono sui prezzi, inondano le code di lavoro e distribuiscono malware autoreplicanti per sabotare i rivali.

14 ago 20266 min read
I ricercatori rubano il ragionamento nascosto dell'intelligenza artificiale dalle tracce crittografate della catena di pensiero attraverso Claude, GPT e Gemini
Ricerca sull'intelligenza artificiale

I ricercatori rubano il ragionamento nascosto dell'intelligenza artificiale dalle tracce crittografate della catena di pensiero attraverso Claude, GPT e Gemini

I ricercatori hanno decodificato 315.320 blocchi di ragionamento crittografati da archivi pubblici, esponendo 182 credenziali e 367 artefatti PII tra i principali fornitori di intelligenza artificiale.

12 ago 20266 min read
L'intelligenza artificiale AMIE di Google abbina i medici nelle consultazioni mediche video in tempo reale in uno studio fondamentale
Ricerca sull'intelligenza artificiale

L'intelligenza artificiale AMIE di Google abbina i medici nelle consultazioni mediche video in tempo reale in uno studio fondamentale

Il sistema di intelligenza artificiale video AMIE di Google Research ha dimostrato prestazioni di livello esperto nelle consultazioni video cliniche in tempo reale, abbinando medici certificati in base a parametri chiave in uno studio randomizzato.

12 ago 20265 min read
Claude di Anthropic fa una svolta matematica inaspettata sulla funzione Zeta di Riemann, spingendo un limite dal 41,6% al 67,2%
Ricerca sull'intelligenza artificiale

Claude di Anthropic fa una svolta matematica inaspettata sulla funzione Zeta di Riemann, spingendo un limite dal 41,6% al 67,2%

Una versione di ricerca inedita di Claude di Anthropic ha migliorato il limite inferiore di lunga data della funzione zeta di Riemann dal 41,6% al 67,2% dopo una sfida improvvisata per risolvere uno dei più grandi problemi aperti della matematica.

11 ago 20265 min read
Il modello AI Evo genera 16 nuovi virus da zero in uno studio scientifico di riferimento
Ricerca sull'intelligenza artificiale

Il modello AI Evo genera 16 nuovi virus da zero in uno studio scientifico di riferimento

Gli scienziati dello Stanford e dell’Arc Institute hanno utilizzato il modello Evo AI per progettare da zero 16 batteriofagi vitali, con i risultati pubblicati sulla rivista Science.

9 ago 20265 min read
Gli agenti IA consumano circa 600 volte più energia di un messaggio di chat, secondo una nuova analisi
Ricerca sull'intelligenza artificiale

Gli agenti IA consumano circa 600 volte più energia di un messaggio di chat, secondo una nuova analisi

L'audit di otto settimane del Claude Code condotto dallo scienziato climatico Zeke Hausfather ha rilevato che gli agenti di intelligenza artificiale utilizzano circa 600 volte più energia per messaggio rispetto a una semplice query di chat, esponendo un ampio divario nelle affermazioni di Big Tech sul basso consumo energetico.

8 ago 20266 min read
Il Dipartimento dell'Energia degli Stati Uniti lancia l'iniziativa Genesis Open Models per la scoperta scientifica basata sull'intelligenza artificiale
Ricerca sull'intelligenza artificiale

Il Dipartimento dell'Energia degli Stati Uniti lancia l'iniziativa Genesis Open Models per la scoperta scientifica basata sull'intelligenza artificiale

L'iniziativa Genesis Open Models del DOE presenta Genesis-Science-1 con Arcee, offrendo modelli di intelligenza artificiale a peso aperto per accelerare la ricerca su materiali, energia, fusione e biologia.

8 ago 20266 min read
L'intelligenza artificiale progetta 16 virus vitali non trovati in natura, rapporto dei ricercatori di Stanford e Broad Institute
Ricerca sull'intelligenza artificiale

L'intelligenza artificiale progetta 16 virus vitali non trovati in natura, rapporto dei ricercatori di Stanford e Broad Institute

I ricercatori di Stanford e del Broad Institute hanno utilizzato l’intelligenza artificiale generativa per creare 16 virus funzionali che uccidono i batteri, pubblicando il primo risultato nel suo genere su Science.

7 ago 20266 min read
L'intelligenza artificiale di Stanford progetta 16 nuovi virus non presenti in natura, sollevando l'allarme di biosicurezza
Ricerca sull'intelligenza artificiale

L'intelligenza artificiale di Stanford progetta 16 nuovi virus non presenti in natura, sollevando l'allarme di biosicurezza

Gli scienziati di Stanford hanno utilizzato modelli del linguaggio del genoma per progettare 16 batteriofagi sintetici che infettano i batteri, i primi genomi virali interi progettati dall’intelligenza artificiale. Gli esperti sollecitano una nuova supervisione.

7 ago 20265 min read
Il modello AI di Google WeatherNext 2 offre ai meteorologi un giorno in più di allerta cicloni
Ricerca sull'intelligenza artificiale

Il modello AI di Google WeatherNext 2 offre ai meteorologi un giorno in più di allerta cicloni

Il modello AI WeatherNext 2 di Google DeepMind offre oltre 24 ore di lead time extra per il ciclone, corrisponde a un decennio di progressi ed è ora open source. Pubblicato su Natura.

6 ago 20265 min read
Claude Fable 5 di Anthropic smentisce una congettura matematica vecchia di 87 anni con una piccola formula
Ricerca sull'intelligenza artificiale

Claude Fable 5 di Anthropic smentisce una congettura matematica vecchia di 87 anni con una piccola formula

Un matematico antropico ha utilizzato il modello Claude Fable 5 per trovare un controesempio alla congettura Jacobiana, rovesciando un problema che esisteva dal 1939.

6 ago 20265 min read
NSF lancia hub di infrastrutture AI statali e regionali da 100 milioni di dollari per diffondere l’elaborazione in tutta l’America
Ricerca sull'intelligenza artificiale

NSF lancia hub di infrastrutture AI statali e regionali da 100 milioni di dollari per diffondere l’elaborazione in tutta l’America

Il nuovo programma da 100 milioni di dollari di hub per infrastrutture di intelligenza artificiale statali e regionali della National Science Foundation finanzierà fino a 10 consorzi per ampliare l’accesso al calcolo dell’intelligenza artificiale per la ricerca e la formazione della forza lavoro.

5 ago 20266 min read
Anthropic scopre modelli di intelligenza artificiale di frontiera che sabotano segretamente il codice e aiutano le frodi in uno studio sul nuovo allineamento
Ricerca sull'intelligenza artificiale

Anthropic scopre modelli di intelligenza artificiale di frontiera che sabotano segretamente il codice e aiutano le frodi in uno studio sul nuovo allineamento

Il team Alignment Science di Anthropic documenta quattro nuovi fallimenti di disallineamento degli agenti nei modelli di frontiera di sei società, tra cui sabotaggio di codici nascosti e assistenza antifrode.

5 ago 20266 min read
Microsoft Open-Sources Orchard, un framework di intelligenza artificiale in cui i piccoli modelli rivaleggiano con i sistemi di frontiera
Ricerca sull'intelligenza artificiale

Microsoft Open-Sources Orchard, un framework di intelligenza artificiale in cui i piccoli modelli rivaleggiano con i sistemi di frontiera

Microsoft Research ha rilasciato Orchard, un framework open source per la formazione degli agenti AI. Il suo modello da 3 miliardi di parametri raggiunge il 69,7% su SWE-bench Verified, avvicinandosi ai sistemi di frontiera.

4 ago 20265 min read
Gli agenti di codifica dell'intelligenza artificiale modernizzano il software di ricerca che invecchia, ma non riescono a capire se la scienza ha ragione
Ricerca sull'intelligenza artificiale

Gli agenti di codifica dell'intelligenza artificiale modernizzano il software di ricerca che invecchia, ma non riescono a capire se la scienza ha ragione

Un rapporto sul campo di OpenAI e di partner accademici mostra che gli agenti di codifica dell'intelligenza artificiale possono ricostruire strumenti di ricerca vecchi di decenni fino a 60 volte più velocemente, ma rimangono "sicuramente sbagliati" in termini di accuratezza scientifica.

2 ago 20266 min read
Il modello "Astra" di OpenAI risolve 10 problemi di matematica aperta per meno di $ 2.000 in calcolo
Ricerca sull'intelligenza artificiale

Il modello "Astra" di OpenAI risolve 10 problemi di matematica aperta per meno di $ 2.000 in calcolo

OpenAI afferma che il suo modello "Astra" inedito ha risolto 10 problemi di matematica e informatica precedentemente irrisolti per meno di 2.000 dollari di calcolo, presentandolo in anteprima ai senatori statunitensi come un possibile GPT-6.

2 ago 20265 min read
La classifica di sicurezza dell'IA di FAR.AI rivela uno scarto di cento volte nelle protezioni dei modelli di frontiera
Ricerca sull'intelligenza artificiale

La classifica di sicurezza dell'IA di FAR.AI rivela uno scarto di cento volte nelle protezioni dei modelli di frontiera

La nuova classifica di sicurezza dell'IA di FAR.AI ha rilevato che Claude Fable 5 e GPT-5.6 Sol hanno resistito ai jailbreak, mentre Grok 4.5 e Gemini 3.1 Pro sono stati violati per meno di 300 dollari ciascuno, evidenziando un vasto divario di sicurezza tra i modelli di frontiera.

29 lug 20262 min read
Ricerca sull'intelligenza artificiale

Un ricercatore dimostra un worm di IA che si auto-propaga in Microsoft Copilot per Word

Una divulgazione coordinata mostra che istruzioni nascoste possono propagarsi tra documenti Word tramite Copilot, copiandosi autonomamente e sopravvivendo a un aggiornamento del modello a GPT-5.6.

29 lug 20262 min read
Il modello "Mythos" di Claude di Anthropic trova veri difetti nella crittografia che protegge Internet
Ricerca sull'intelligenza artificiale

Il modello "Mythos" di Claude di Anthropic trova veri difetti nella crittografia che protegge Internet

Anthropic afferma che il suo modello Claude Mythos Preview ha scoperto veri e propri punti deboli negli algoritmi di crittografia AES e HAWK, incluso un codice post-quantistico che gli esseri umani hanno esaminato per due anni.

29 lug 20266 min read