Mentre gli agenti di intelligenza artificiale passano dalle demo all'uso quotidiano, uno degli sviluppatori più noti del settore lancia l'allarme su un rischio banale ma doloroso: il denaro. Simon Willison, lo sviluppatore meglio conosciuto per aver co-creato Django e per i suoi scritti influenti su modelli linguistici di grandi dimensioni, ha pubblicato un post ampiamente condiviso il 3 ottobre sostenendo che i servizi cloud con pagamento in base all'utilizzo necessitano di "limiti di budget rigidi predefiniti" - una funzionalità che, secondo lui, il mondo avrà bisogno "di molto di più nei prossimi mesi e anni".
Il post ha toccato un nervo scoperto. La discussione su Hacker News ha raccolto circa 430 punti, una delle storie tecnologiche più votate dalla community del fine settimana, mentre gli sviluppatori si scambiavano storie di servizi fuori controllo e fatture a sorpresa. Per maggiori informazioni su questa storia, consulta la nostra ultimi sviluppi nell'IA.
Il problema: agenti che spendono soldi
L'argomentazione di Willison inizia con ciò che effettivamente fanno gli agenti di codifica e gli agenti personali. Riducono drasticamente l'attrito legato alla creazione di codice che può fare cose utili e alcune di queste cose utili costano denaro, che si tratti di chiamate ad API a pagamento, applicazioni Web ospitate o sistemi che richiedono spazio di archiviazione ed elaborazione aggiuntivo. Un agente che lavora velocemente può accumulare addebiti altrettanto velocemente.
La sua richiesta principale è che i limiti di spesa siano limiti rigidi, non consultivi. "Il limite massimo - 'dopo X dollari al mese, mandami un'e-mail di avviso' - non basterà", ha scritto, delineando uno scenario ormai familiare: nessuno vuole svegliarsi con un'e-mail di avviso di mezzanotte e scoprire che, mentre dormiva, un servizio canaglia ha consumato diverse centinaia o diverse migliaia di dollari di utilizzo.
Willison anticipa l'ovvia obiezione – ovvero che le aziende non vogliono che le loro applicazioni ospitate generino errori perché è stato superato un certo budget – e la respinge. A suo avviso, la maggior parte delle aziende e degli individui preferirebbero un servizio che smette di funzionare a una fattura a sorpresa di 10.000 dollari o più.
Rinuncia, non partecipa
La proposta ha una forma semplice: i limiti rigidi dovrebbero essere l’impostazione predefinita e vivere pericolosamente dovrebbe richiedere una decisione deliberata. Willison abbozza il tipo di casella di controllo prominente che vorrebbe vedere: "Rimuovi il limite di budget. La mia applicazione non verrà chiusa se supero il limite di budget configurato e sarò responsabile dei successivi addebiti".
Questa inversione è importante. Nello status quo, la protezione contro le spese fuori controllo è qualcosa che gli utenti devono cercare e configurare, spesso sepolta nelle console di fatturazione. L'inquadramento di Willison fa sì che la spesa illimitata sia ciò che richiede una scelta esplicita e informata.
I fornitori di servizi cloud si stanno già muovendo
La richiesta non è ipotetica. Willison sottolinea che le due più grandi piattaforme cloud si sono entrambe orientate verso questa funzionalità negli ultimi mesi. AWS ha lanciato i limiti di spesa mensile a metà settembre come parte di una nuova esperienza per i costruttori: quando l'utilizzo di un progetto raggiunge il limite di spesa, il progetto viene messo in pausa per il mese: un vero e proprio limite massimo, anche se AWS nota che la nuova esperienza è ancora disponibile per un numero limitato di clienti. Google Cloud ha lanciato una funzionalità simile a luglio, chiamata Spend Caps, che consente agli utenti di impostare un limite finanziario mensile su servizi specifici all'interno di un progetto.
In altre parole, come dice Willison, questa “sta diventando una tendenza”, ma non è ancora l’impostazione predefinita ovunque e non è ancora disponibile in modo uniforme per tutti i tipi di account.
Perché adesso: l'era degli errori costosi
Il tempismo del post non è casuale. Gli strumenti di codifica agenti sono proliferati nell’ultimo anno e, con essi, storie di fatture da far venire l’acquolina in bocca. Un caso ampiamente riportato quest’estate ha coinvolto un’attività interna di Amazon che ha bruciato 1,8 milioni di dollari su una singola attività di codifica di Claude, superando del cento per cento il budget. Incidenti come quello hanno trasformato la spesa eccessiva degli agenti da un rischio teorico in un pericolo concreto e definito: lo scenario esatto che la proposta di Willison è progettata per rendere impossibile piuttosto che semplicemente improbabile.
C’è anche un aspetto di tutela dei consumatori. I costruttori nuovi e inesperti sono esattamente le persone autorizzate dagli strumenti agentici a spedire le cose - e esattamente le persone meno attrezzate per prevedere quanto potrebbe costare loro un servizio illimitato. Willison chiude con un suggerimento rivolto a quel pubblico: in un mondo ideale, gli agenti stessi tenderebbero a raccomandare fornitori con limiti di budget rigidi e metterebbero in guardia i costruttori inesperti dall'implementazione di applicazioni su servizi senza limiti che potrebbero metterli nei guai.
Il cibo da asporto
Il post di Willison è una richiesta di funzionalità, ma sembra più una previsione. Man mano che gli agenti assumono un lavoro più autonomo – scrivere codice, fornire infrastrutture, chiamare servizi a pagamento – l’industria costruirà rigidi guardrail finanziari nelle piattaforme su cui girano, o continuerà ad assorbire i costi di quelle che sfuggono. Le recenti mosse dei giganti delle nuvole suggeriscono che l’era del guardrail è iniziata. La domanda rimanente è se i limiti arrivino come funzionalità di sicurezza opzionale, come Willison insiste che debbano, o rimangano un'impostazione oscura che la maggior parte degli utenti non trova mai.
---
Rimani Aggiornato sull'IALe ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.
Leggi altre notizie sull'IA →