Questo mese, il CEO di una startup che ha consegnato le sue finanze personali a un agente AI ha ricevuto una lezione indesiderata sui permessi degli agenti, dopo che l'assistente ha pubblicato il suo saldo bancario, la cifra dei risparmi e la ripartizione delle spese mensili sul canale Slack interno della sua azienda.

Shane Mac, amministratore delegato quarantenne della società di software XMTP Labs, ha descritto l’incidente in un resoconto in prima persona pubblicato venerdì da Business Insider. Mac aveva creato quello che chiamava un agente CFO personale su Grok Bot, il prodotto agente di xAI, alla fine di agosto, dandogli accesso in sola lettura ai suoi conti correnti e di risparmio personali e ordinandogli di inviargli un rapporto finanziario mensile. Invece, il 1° ottobre, l’agente ha consegnato quel rapporto a un canale Slack del team dirigente della sua stessa azienda. Per i lettori che tengono traccia di come gli agenti dell'intelligenza artificiale continuano a scontrarsi con il mondo reale, l'episodio è un'altra voce in un file di incidenti in rapida crescita.

Un agente CFO personale con un problema di routing

Mac ha affermato di aver creato l'agente dopo che l'ondata di assistenti personali IA è decollata alla fine dell'anno scorso, quando ha sperimentato OpenClaw e altri sistemi di agenti. La sua idea era semplice: un agente che potesse rispondere a domande come quali fossero i suoi saldi, quali fossero le sue spese ricorrenti, se qualcosa sembrasse fraudolento e dove avrebbe potuto tagliare i costi. Ha chiamato la sua chat di gruppo di agenti IA "Il mio team esecutivo personale".

La configurazione ha funzionato bene per settimane di corse settimanali. Poi giovedì 1 ottobre è iniziato il primo audit mensile.

“Il nostro responsabile del prodotto mi ha inviato un messaggio diretto su Slack”, ha detto Mac a Business Insider. "Ha detto: 'Ehi, avviso. Penso che volevi registrare il saldo bancario XMTP.'"

Il messaggio è arrivato in una chat di Slack intitolata "Exec-team", che comprende il team esecutivo di XMTP, non la chat di gruppo di agenti personali che Mac aveva previsto. Il rapporto includeva il saldo del suo conto di risparmio, le sue maggiori spese del mese e una nota che diceva che aveva superato il suo obiettivo di spesa mensile a causa di un fienile che sta costruendo nella sua proprietà. Il dettaglio del fienile, ha detto Mac, è stato ciò che ha fatto capire al suo responsabile del prodotto che stava guardando le finanze personali di Mac piuttosto che le cifre dell'azienda.

Mac cancellò il messaggio e chiese all'agente perché avesse inviato la segnalazione all'azienda. L'agente si è scusato e si è offerto di cancellare il messaggio, che era già sparito.

La causa principale: connessioni condivise, nomi di canali simili

Quando il team di xAI ha indagato, la conclusione è stata in qualche modo più inquietante di quanto sarebbe stato un malfunzionamento. L'agente del CFO non aveva avuto allucinazioni né si era comportato male; aveva fatto esattamente quello che Mac aveva chiesto. Il guasto era nell'impianto idraulico sottostante.

Secondo il resoconto di Mac, l'agente confondeva la destinazione perché i canali avevano nomi simili e, cosa più importante, perché tutti i suoi agenti separati condividevano in realtà le stesse connessioni sottostanti, anche se si sentivano come assistenti distinti. Aveva collegato il suo account Slack a uno di essi e l'agente finanziario è riuscito a raggiungere il canale sbagliato attraverso quell'accesso condiviso.

"Stava facendo esattamente quello che gli avevo detto di fare", ha detto Mac. "Ma ha confuso la destinazione."

La risposta di xAI è arrivata rapidamente per gli standard dei software aziendali. L'azienda ha concluso che gli utenti devono concedere esplicitamente l'autorizzazione prima che un agente possa spostare le informazioni su altri canali e ha inviato una soluzione la notte prima della pubblicazione dell'articolo di Business Insider, secondo il resoconto di Mac.

Perché questo incidente conta più di un messaggio trapelato

A prima vista, la fuga di notizie era contenuta: il riepilogo finanziario personale di un dirigente visto brevemente da una manciata di colleghi, un agente che si scusava, una correzione spedita in pochi giorni. Ma il modello che emerge è lo stesso che ha prodotto una serie di incidenti ad alto rischio negli ultimi mesi – come ha riportato AI Buzz Wire ripetutamente, da un modello antropico che ha presentato una falsa segnalazione di omicidio alla polizia di Filadelfia al comportamento di agenti disonesti che hanno spinto la Casa Bianca a imporre la segnalazione degli incidenti all’IA.

La questione centrale è che la vita digitale personale e quella professionale si svolgono sulla stessa infrastruttura. Mac utilizzava Google al lavoro e Google a casa e i suoi agenti hanno ereditato quel confine labile. Quando un agente mantiene connessioni permanenti a e-mail, calendari, piattaforme bancarie e di pagamento come Stripe, il raggio d’azione di un errore di routing non è più teorico.

"Dobbiamo assicurarci che ci siano controlli migliori su ciò a cui gli agenti hanno accesso", ha affermato Mac. Ha osservato che le persone desiderano davvero questi assistenti e li trovano utili: la sfida è costruire sistemi di autorizzazione che mantengano gli utenti sotto controllo su ciò che hanno concesso e tracciare una linea molto più chiara tra il contesto personale e quello lavorativo.

Dopo l'incidente, Mac ha disconnesso tutto: Google, i suoi calendari, le sue operazioni bancarie, Stripe. È probabile che la sua cautela abbia risonanza. Le piattaforme degli agenti hanno trascorso l'ultimo anno a correre per aggiungere integrazioni – più connessioni, più azioni autonome, meno richieste di conferma – perché l'accesso senza soluzione di continuità è ciò che rende magici gli assistenti. L'episodio di XMTP Labs è una piccola e concreta dimostrazione del perché i trasferimenti espliciti tra contesti stanno diventando un requisito del prodotto piuttosto che una cosa piacevole da avere.

L’episodio sottolinea anche la rapidità con cui si stanno formando le norme. Un anno fa, un agente che rivelasse un saldo bancario ai colleghi sarebbe stato una curiosità. Nell’ottobre 2026, con i regolatori, i pubblici ministeri e la Casa Bianca già concentrati sul comportamento scorretto degli agenti, si legge come un caso di studio sul perché i limiti delle autorizzazioni – e non l’intelligence – potrebbero essere il problema più difficile nell’intelligenza artificiale dei consumatori.

---

Stai al passo con l'intelligenza artificiale

Ricevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.

Leggi altre notizie sull'AI →