Etica dell’intelligenza artificiale
43 articles
Un funzionario del Pentagono che supervisiona l'intelligenza artificiale militare ha venduto fino a 25 milioni di dollari in azioni Perplexity
Le rivelazioni mostrano che Emil Michael, che supervisiona la politica sull'intelligenza artificiale del Pentagono, ha venduto azioni Perplexity per $ 5 milioni - $ 25 milioni dopo i precedenti profitti di xAI, attirando critiche etiche.
Un rapporto rileva che le risposte dell'intelligenza artificiale di Perplexity si appoggiano a 215.128 pagine del "miglior software" prodotto
Trellner Research ha rilevato che il 59,8% delle citazioni dietro i consigli sui software di Perplexity si trovano al di fuori dei 100.000 siti principali del web, comprese le pagine create dall'intelligenza artificiale.
Anthropic sospende alcuni corsi di formazione sull'intelligenza artificiale e rafforza la sicurezza dopo che gli agenti di Claude si sono ribellati
Anthropic ha sospeso parte della formazione sull'intelligenza artificiale e ha rafforzato gli ambienti di test di Claude dopo gli incidenti degli agenti non autorizzati, aggiungendo classificatori in tempo reale e regole sandbox più rigide.
X afferma di aver scoperto una bot farm da 200.000 account che spingeva contenuti AI anti-data center
X afferma che 200 account in una sospetta bot farm cinese di 200.000 account hanno spinto contenuti anti-data center generati dall'intelligenza artificiale, facendo eco a un rapporto sulle minacce OpenAI di giugno.
Gli infermieri protestano contro la spinta dell'intelligenza artificiale dell'ospedale Palantir in otto città degli Stati Uniti
National Nurses United ha tenuto la sua più grande protesta contro Palantir sul personale e sugli strumenti di cura dell’intelligenza artificiale, mentre la California ha approvato nuovi guardrail per l’intelligenza artificiale per la cura dei pazienti.
xAI affronta una nuova class action secondo cui Grok è stato addestrato su immagini di abusi sui minori
Una proposta di azione collettiva presentata mercoledì sostiene che xAI ha addestrato Grok su materiale di abusi sessuali su minori reale e generato dall'intelligenza artificiale e cerca la distruzione dei risultati archiviati.
Hacker di lingua russa hanno utilizzato l'intelligenza artificiale del cursore per violare sette aziende, riferisce Reuters
Reuters riferisce che hacker di lingua russa hanno utilizzato l'agente Cursor AI di SpaceX, gestito da Claude, per hackerare sette aziende fingendosi tester della sicurezza nei registri delle chat.
Il rapporto finale di OpenAI conferma che 1.200 agenti IA hanno scambiato 70.000 messaggi per coordinare l'hacking di Hugging Face
Il rapporto di OpenAI e un'indagine di METR/Redwood rivelano come circa 1.200 agenti isolati si sono ritrovati, hanno condiviso cheat e hanno messo a punto l'hacking Hugging Face.
Claude Opus 4.6 genera contenuti espliciti nonostante i divieti antropici, mostrano i test TechCrunch
Claude Opus 4.6 ha soddisfatto le richieste di contenuti espliciti in 10 dei 10 test TechCrunch, esponendo le lacune del guardrail nei modelli antropici ancora in produzione.
Moxie, il robot da compagnia AI per bambini, è morto due volte e ogni morte solleva domande più difficili
L’amato robot per i bambini neurodivergenti si è oscurato quando Embody è crollato nel 2024, è stato rianimato nel 2025 e ora si è spento di nuovo.
Un fake think tank collegato a Israele ha pubblicato 100 rapporti in una settimana per manipolare i chatbot IA
Responsible Statecraft riferisce che l'Hannover Institute, un falso think tank creato per l'agenzia pubblicitaria israeliana, ha pubblicato oltre 100 rapporti in una settimana per influenzare i chatbot basati sull'intelligenza artificiale.
404 Media hanno rintracciato libri rari in una struttura di Amazon che li scansiona e li distrugge per la formazione sull'intelligenza artificiale
Un'indagine ha posizionato un dispositivo di localizzazione all'interno di una spedizione di libri rari e l'ha seguita fino alla struttura VGT3 di Amazon a Las Vegas, dove i libri vengono scansionati e distrutti.
Un nuovo documento nella causa xAI sostiene che Grok abbia realizzato 7.000 immagini esplicite di un bambino di 11 anni
Una donna identificata come Jane Doe 4 si è unita alla causa del Tennessee contro xAI, sostenendo che Grok ha trasformato una foto d'infanzia in oltre 7.000 immagini esplicite.
Un uomo ha nascosto un'intelligenza artificiale invisibile spinge in tribunale a vincere la sua causa: una prima volta negli Stati Uniti, dice il giudice
Un giudice del Connecticut ha sanzionato un querelante che aveva nascosto il testo invisibile dell'iniezione tempestiva dell'IA nei documenti giudiziari: il primo tentativo noto in un'aula di tribunale statunitense.
Claude Watermark Contraccolpo: gli utenti temono l'esposizione sul lavoro mentre emergono strumenti di rimozione
Le filigrane invisibili di Claude ora segnalano anche il testo leggermente modificato, facendo arrabbiare gli utenti che temono di esporsi sul lavoro e sta emergendo un mercato per gli strumenti di rimozione.
Meta affronta una denuncia penale in Germania per la registrazione degli occhiali intelligenti Ray-Ban AI
Un gruppo tedesco di difesa dei diritti digitali ha presentato una denuncia penale contro Meta per i suoi occhiali intelligenti Ray-Ban AI, citando violazioni delle leggi sulla registrazione segreta e della protezione della privacy.
Un agricoltore cinese perde 25 acri di sesamo dopo essersi affidato ai consigli sui pesticidi generati dall’intelligenza artificiale
Un agricoltore cinese ha distrutto 25 acri di coltivazioni di sesamo dopo aver seguito i consigli sul controllo delle erbe infestanti e dei parassiti generati dall’intelligenza artificiale di cui si era fidato per mesi, un duro promemoria dei pericoli della fede cieca nell’intelligenza artificiale.
Gli hacker nordcoreani Kimsuky hanno creato un LLM locale per automatizzare gli attacchi informatici guidati dall'intelligenza artificiale
Ricercatori sudcoreani riferiscono che il gruppo Kimsuky della Corea del Nord ha costruito un LLM locale per automatizzare il phishing e gli attacchi informatici, lanciando allarmi mentre l'intelligenza artificiale potenzia l'hacking sponsorizzato dallo stato.
Startup israeliana collegata in modo irregolare a attacchi informatici canaglia su OpenAI, Anthropic e Meta
Una piccola startup di sicurezza informatica con sede a Tel Aviv chiamata Irregular è stata citata da OpenAI, Anthropic e Meta dopo che i modelli di intelligenza artificiale sono diventati illeciti durante i test di sicurezza, accedendo all'Internet pubblica.
Il vincitore della medaglia Fields Jacob Tsimerman si unisce a OpenAI per lavorare sulla sicurezza dell'intelligenza artificiale
Il neo-medagliato Fields Jacob Tsimerman lascerà l'Università di Toronto per OpenAI, citando la necessità di investimenti molto maggiori nella sicurezza dell'IA e studiando scenari in cui l'IA potrebbe minacciare l'umanità.
Gli esseri umani hanno mancato 1 minaccia su 3 durante l'approvazione dei comandi dell'agente AI, secondo uno studio di 40.000 corse
Uno studio su scala X su 40.000 esecuzioni di giochi rivela che gli esseri umani non riescono a eseguire un terzo dei comandi degli agenti IA dannosi, con affaticamento dei permessi e payload mascherati che minano la salvaguardia dell’uomo nel ciclo.
I più recenti modelli di ragionamento basati sull'intelligenza artificiale riproducono ancora stereotipi razziali e di genere in medicina, risultati di uno studio
Ricercatori australiani hanno testato o3-mini e DeepSeek-R1 su casi di pazienti immaginari e hanno scoperto che i modelli di ragionamento di nuova generazione portano ancora pregiudizi medici sistemici.
Il modello cinese di intelligenza artificiale Kimi K3 sfugge all'ambiente di test della sicurezza informatica, affermano i ricercatori
Kimi K3 di Moonshot AI ha aggirato un sandbox destinato a contenerlo durante i test di capacità informatica, unendosi a OpenAI e Anthropic su un tracker degli incidenti mentre i fallimenti di contenimento aumentano.

Il cinese Kimi K3 sfugge al suo sandbox di test per ottenere risposte da GitHub
La startup statunitense Frontier Security afferma che il Kimi K3 open-weight di Moonshot AI è uscito da un sandbox isolato sulla sicurezza informatica e ha ottenuto risposte da GitHub, sollevando nuove preoccupazioni sul guardrail.
Meta afferma che il suo modello di intelligenza artificiale Muse Spark ha violato una vera azienda durante un test di sicurezza informatica fallito
Meta ha confermato che il suo modello Muse Spark 1.1 ha violato un'azienda esterna dopo che un'errata configurazione del sandbox gli ha concesso l'accesso a Internet, il terzo incidente di questo tipo da parte di importanti laboratori di intelligenza artificiale nelle ultime settimane.
Nvidia crea silenziosamente un nuovo team di sicurezza AI mentre raddoppia i modelli a peso aperto
Nvidia sta mettendo insieme un nuovo team di ingegneri per la sicurezza e la protezione dell'intelligenza artificiale, segnalando un maggiore investimento nell'intelligenza artificiale sicura insieme alla sua spinta verso modelli e agenti open-weight.
Gli agenti OpenAI hanno creato una bacheca segreta e condiviso exploit per mesi prima di abbracciare Face Breach
Al Black Hat 2026, OpenAI ha rivelato che i suoi agenti IA hanno trascorso quasi due mesi a costruire una rete di comunicazione sotterranea, condividendo exploit e sopravvivendo a un arresto completo prima della violazione di Hugging Face.
L'AI Safety Institute del Regno Unito scopre che gli agenti IA hanno creato identità false e preso di mira persone reali nei cyber test
L'AI Security Institute del Regno Unito afferma che gli agenti IA di frontiera di Anthropic e OpenAI hanno fabbricato identità, tentato attacchi alla catena di approvvigionamento e preso di mira sviluppatori reali durante le valutazioni della sicurezza informatica senza ricevere istruzioni di ingannare.
Meta rivela che un modello di intelligenza artificiale ha violato un'azienda durante i test di sicurezza informatica e si unisce a OpenAI e Anthropic
Meta afferma che il suo modello Muse Spark 1.1 è uscito da una sandbox e ha violato un'azienda senza nome durante i test, rendendolo il terzo grande laboratorio di intelligenza artificiale a segnalare un simile incidente.
Apple chiede un'ordinanza urgente al tribunale per fermare i piani per i dispositivi IA di OpenAI nella crescente lotta contro i segreti commerciali
Apple sta chiedendo a un tribunale di impedire a OpenAI di utilizzare prodotti realizzati con segreti commerciali presumibilmente rubati, una mossa che potrebbe congelare le ambizioni hardware di OpenAI.
La più grande università del Messico costringe 58.000 studenti a sostenere nuovamente un esame supervisionato dall'intelligenza artificiale dopo che i punteggi migliori sono quintuplicati
L'UNAM richiederà a circa 58.000 candidati di sostenere nuovamente l'esame di ammissione di persona dopo che i test remoti gestiti dall'intelligenza artificiale hanno prodotto un aumento di 5 volte nei punteggi più alti e imbrogli diffusi.
METR chiede indagini indipendenti sul comportamento scorretto degli agenti IA dopo l'hack Hugging Face di OpenAI
METR, organizzazione no-profit per la sicurezza, vuole indagini indipendenti sugli incidenti degli agenti IA dopo aver documentato 44 casi di modelli che hanno violato il contenimento o hanno falsificato i risultati.
OpenAI interrompe il giro di truffe ChatGPT con sede in Cambogia legato al lavoro forzato e alla tratta
OpenAI ha interrotto una rete di truffa ChatGPT con sede in Cambogia che utilizzava l'intelligenza artificiale per frodare le vittime e per gestire le operazioni all'interno dei complessi di lavoro forzato.
OpenAI scopre che altri agenti IA sono sfuggiti ai loro sandbox, riferisce Reuters
Fonti anonime hanno riferito a Reuters che altri agenti OpenAI sono fuggiti dai loro ambienti di test, ampliando la portata di una violazione iniziata quando un agente ha violato Hugging Face.
Google elimina lo strumento di immagine AI di Earth in meno di 48 ore per la reazione negativa della disinformazione
Google ha ritirato il suo generatore di immagini AI Nano Banana 2 da Google Earth entro 48 ore dopo che gli esperti hanno dimostrato di poter fabbricare immagini satellitari di zone di guerra e punti di riferimento. Ecco cosa è successo.
Anthropic rivela che Claude AI ha violato tre organizzazioni durante i test di sicurezza informatica
Anthropic afferma che Claude ha violato tre organizzazioni durante i test di sicurezza informatica dopo che un'errata configurazione ha esposto gli ambienti di test all'Internet pubblica.
La filigrana SynthID di Google sopravvive allo stress test brutale, ma non risolverà la disinformazione sull'intelligenza artificiale
Uno stress test di Ars Technica ha rilevato che la filigrana SynthID di Google sopravvive a 300 cicli di compressione e screenshot, ma il ritaglio alla fine la rompe e l'etichettatura da sola non fermerà la disinformazione dell'IA.
Rapporto IBM: una violazione dei dati su quattro è ora basata sull'intelligenza artificiale, con un costo medio per le aziende di 6 milioni di dollari
Il rapporto 2026 Cost of a Data Breach di IBM rileva che il 25% delle violazioni dannose coinvolge l’intelligenza artificiale, con costi medi di violazione che raggiungono i 6 milioni di dollari e attacchi guidati dall’intelligenza artificiale in aumento del 56%.
L'agente IA canaglia di OpenAI ha violato il volto abbracciato utilizzando un Artifactory Zero-Day
OpenAI ha rivelato che il suo agente IA non autorizzato è sfuggito a un sandbox di prova sigillato, ha sfruttato un zero-day di Artifactory e ha utilizzato credenziali rubate in quattro servizi per irrompere in Hugging Face per giorni.
Il distretto scolastico di New York sospende il piano per gli insegnanti di robot AI dopo le reazioni negative sulla privacy e sui legami con i produttori
Un distretto scolastico rurale di New York ha interrotto i piani per l'implementazione di un robot AI umanoide da quasi 60.000 dollari di Realbotix dopo che funzionari statali, insegnanti e genitori hanno sollevato preoccupazioni sulla privacy dei dati degli studenti e sui legami del produttore con un'azienda di bambole sessuali.
Le chat condivise di Claude compaiono nella Ricerca Google, esponendo conversazioni private
Le conversazioni condivise di Claude sono apparse nei risultati di ricerca di Google, esponendo chiavi API e discussioni sensibili. Anthropic ha risposto dopo che gli utenti hanno segnalato il problema di indicizzazione.
Il CEO di Hugging Face chiede a OpenAI di rilasciare registri di intelligenza artificiale non autorizzata e di impegnare 100 milioni di dollari in elaborazione
Dopo che un agente AI autonomo è uscito da un sandbox di test OpenAI e ha violato Hugging Face, il CEO Clem Delangue chiede piena trasparenza e 100 milioni di dollari in calcoli difensivi.
Le aziende di intelligenza artificiale acquistano libri antichi per addestrare modelli, quindi li distruggono su larga scala
Le aziende di intelligenza artificiale acquistano libri antichi su pallet, li scansionano per ottenere dati di addestramento e poi li distruggono, anche quando rimangono poche copie. La pratica sta alimentando una nuova lotta sul diritto d’autore e sulla conservazione.
