Salesforce e NVIDIA hanno annunciato il 15 settembre Koa, un modello di ragionamento che le aziende descrivono come il primo creato appositamente per il lavoro di gestione delle relazioni con i clienti. Invece di addestrare un modello di base da zero, Salesforce ha effettuato il post-addestramento del modello Nemotron 3 Super open-weight di NVIDIA, una base di parametri 120B, su un set di dati sintetico proprietario modellato su quasi tre decenni di conoscenza dell'implementazione CRM. Il modello ora alimenta agenti specializzati sulla piattaforma Agentforce di Salesforce e clienti pilota tra cui Formula 1, Xero e UChicago Medicine lo stanno già provando.
L'annuncio, fatto durante la conferenza Dreamforce di Salesforce a San Francisco, segna un notevole cambiamento nel modo in cui i fornitori di software aziendale si stanno avvicinando all'intelligenza artificiale. Invece di noleggiare l’intelligence da laboratori di frontiera, Salesforce ha costruito il proprio modello specializzato e ha mantenuto il controllo dei pesi. Per ulteriori informazioni su questa storia, consulta la nostra copertura del settore dell'intelligenza artificiale in corso.
Come è stato costruito Koa: senza dati dei clienti
Salesforce è esplicito su un punto: per addestrare Koa non sono stati utilizzati dati dei clienti. Il corpus di formazione è costituito interamente da scenari sintetici che coprono il ragionamento, l'uso degli strumenti e il processo decisionale che gli agenti Agentforce eseguono nei flussi di lavoro CRM: generazione di lead, qualificazione di opportunità, risoluzione di casi di servizio.
Secondo l’annuncio congiunto, gli scenari simulano flussi di lavoro aziendali reali in più di 14 settori, tra cui produzione, servizi finanziari, sanità e viaggi. Ogni scenario associa una persona a una serie di attività e la sequenza di azioni e chiamate agli strumenti necessarie per completarle viene mappata in anticipo.
Per la fase post-formazione, Salesforce ha applicato un perfezionamento supervisionato seguito da un apprendimento di rinforzo utilizzando la Group Relative Policy Optimization (GRPO), eseguito sugli strumenti NeMo RL, NeMo Gym e NeMo AutoModel di NVIDIA. L’azienda afferma che la formazione su una serie mirata di attività aziendali prioritarie ha insegnato al modello a raggiungere gli obiettivi attraverso sequenze di azioni corrette, anziché semplicemente produrre una risposta corretta.
La ricerca dietro il modello
Un documento di ricerca presentato ad arXiv il 14 settembre descrive la componente distintiva di Koa come una catena di simulazione-ricompensa: le specifiche del flusso di lavoro vengono trasformate in attività a più turni condizionate dalla persona, con ricompense legate alla risoluzione di ciascuna attività attraverso l'uso efficace dello strumento. Per i domini aziendali, tali specifiche sono scritte in Agent Script, il linguaggio dichiarativo di Salesforce per la creazione di agenti Agentforce. La stessa simulazione e lo stesso meccanismo di ricompensa concreta hanno guidato il GRPO sia negli ambiti aziendali che in quelli di utilizzo degli strumenti pubblici.
Gli autori riferiscono che Koa migliora la sua base aperta rispetto ai benchmark di utilizzo degli strumenti pubblici, ragionamento degli agenti e CRM aziendale, con i guadagni più evidenti nell’uso degli strumenti multi-turn. Il modello supera una solida linea di base proprietaria pur rimanendo al di sotto dei modelli di frontiera più forti: un divario su cui Salesforce scommette non ha importanza per il lavoro CRM.
Benchmark: tre volte meno errori nelle attività CRM
Sul benchmark CRM di Salesforce, una serie di attività del mondo reale come l'aggiornamento di un'opportunità, l'instradamento di un caso o la pianificazione di un follow-up, l'azienda afferma che Koa eguaglia o supera le prestazioni del modello principale nelle azioni CRM con tre volte meno errori.
Questa affermazione conta meno per il numero del titolo che per la sua premessa: un modello più piccolo specializzato in un dominio può battere i modelli di frontiera generici nei compiti di quel dominio. È lo stesso argomento che i sostenitori del peso aperto hanno avanzato tutto l’anno, ora con un test aziendale allegato.
Confini di fiducia e spinta del governo
Salesforce afferma di controllare i pesi del modello Koa ed eseguire la post-formazione e l'inferenza interamente all'interno del proprio confine di fiducia, quindi nessun dato del cliente oltrepassa tale confine durante l'inferenza. Questo posizionamento è rivolto direttamente alle industrie regolamentate.
Oltre a Koa, le due società stanno introducendo modelli basati su Nemotron in Missionforce, l'offerta focalizzata sul governo di Salesforce. I modelli NVIDIA post-addestrati alimenteranno Missionforce Operations, che digitalizza i flussi di lavoro governativi tra cui approvvigionamento, gestione dei fornitori e logistica, comprese le implementazioni su reti air gap che non toccano mai le infrastrutture pubbliche. Missionforce Operations è generalmente disponibile ora nelle regioni degli Stati Uniti, con i modelli post-addestrati che raggiungeranno clienti selezionati nell’ottobre 2026.
Piloti in corso, disponibilità generale questo inverno
Koa è già utilizzato all'interno dello stesso Salesforce, incluso un agente Slack che aiuta i dipendenti a trovare informazioni e completare le attività quotidiane. Sono in corso progetti pilota per i clienti con 1-800Accountant, Baxter Credit Union, Engine, Formula 1, UChicago Medicine e Xero.
Ryan Teeples, direttore strategico di 1-800Accountant, ha affermato che Koa consente agli agenti dell'azienda di ragionare passo dopo passo attraverso le norme fiscali, i dati finanziari e i documenti dei clienti. Presso UChicago Medicine, il direttore marketing Andrew Chang ha affermato che il modello può gestire flussi di lavoro di coordinamento in più fasi più lunghi, liberando i team per la cura dei pazienti.
La disponibilità generale è prevista per l'inverno 2026 nelle regioni degli Stati Uniti.
Perché è importante
È difficile non notare il sottotesto strategico. Come ha notato Techzine, Salesforce ha annunciato il proprio modello poche settimane dopo aver ampliato la sua partnership con Anthropic per includere Claude nei suoi prodotti. Il CEO Marc Benioff ha definito Koa il prodotto di quell'esperienza accumulata: "La cosa più preziosa che Salesforce ha costruito non è la nostra piattaforma, ma la conoscenza accumulata su come funziona effettivamente il business aziendale. Con Koa, la conoscenza è inserita nel modello stesso."
Jensen Huang di NVIDIA ha affermato che i modelli aperti di Nemotron hanno fornito a Salesforce le basi per un modello CRM in grado di ragionare e agire in modo sicuro. Per NVIDIA, ogni azienda che effettua la post-formazione di Nemotron rappresenta un altro canale di distribuzione per il proprio stack informatico.
Koa è anche un indicatore di una tendenza più ampia per il 2026: le imprese specializzeranno modelli di base aperti per domini ristretti e di alto valore invece di aspettare che i laboratori di frontiera spediscano prodotti verticali. L’apprendimento per rinforzo basato sulle specifiche, concludono gli autori del documento su arXiv, offre un percorso pratico proprio per raggiungere questo obiettivo.
Se l’affermazione di tre volte meno errori vale anche nella produzione, aspettatevi che altri fornitori di software aziendali seguano lo stesso percorso – e aspettatevi che i laboratori di frontiera sostengano, con qualche giustificazione, che i loro prossimi modelli colmeranno comunque il divario specializzato.
---
Stai al passo con l'intelligenza artificialeRicevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.
Leggi altre notizie sull'AI →