Anthropic ha pubblicato Claude Sonnet 5, definendolo il modello di classe Sonnet più agente che l'azienda abbia costruito. Presentato il 30 giugno 2026, il nuovo modello può pianificare, utilizzare strumenti come browser e terminali e funzionare in modo autonomo a un livello che, solo pochi mesi fa, richiedeva modelli più grandi e molto più costosi. Il lancio arriva in un momento in cui l'intero settore dell'intelligenza artificiale sta facendo a gara per trasformare i chatbot in agenti capaci che possano agire per conto dell'utente anziché limitarsi a rispondere alle domande.
Per gli sviluppatori che seguono gli ultimi sviluppi, le notizie si aggiungono a una serie intensa di ultime notizie sull'intelligenza artificiale che hanno rimodellato il panorama competitivo. Anthropic inquadra Sonetto 5 come il momento in cui la capacità degli agenti arriva finalmente a prezzi di fascia media, un cambiamento che potrebbe cambiare il modo in cui i team pianificano il budget per i flussi di lavoro autonomi.
Prestazioni che rivaleggiano con l'ammiraglia
Secondo Anthropic, Sonnet 5 riduce il divario tra la linea Sonnet di fascia media e i modelli Opus di alto livello dell'azienda. Le sue prestazioni sono vicine a quelle di Opus 4.8, ma a prezzi sostanzialmente inferiori, e rappresenta un netto miglioramento rispetto al suo predecessore, Sonetto 4.6, nel ragionamento, nell'uso degli strumenti, nella codifica e nel lavoro di conoscenza.
Anthropic ha pubblicato curve costo-prestazioni che confrontano il modello con Sonnet 4.6 e Opus 4.8 su due valutazioni di agenti: BrowseComp, che misura la ricerca di agenti, e OSWorld-Verified, che testa l'uso del computer. L'azienda afferma che Sonnet 5 offre una gamma più ampia di opzioni di rapporto costo-prestazioni rispetto a Sonnet 4.6 e, a livelli di impegno più elevati, può eguagliare Opus 4.8 in alcune attività.
Prezzi aggressivi per gli agenti
Il prezzo è fondamentale per il campo. Claude Sonnet 5 verrà lanciato con un prezzo di lancio di 2 dollari per milione di token di input e 10 dollari per milione di token di output, disponibile fino al 31 agosto 2026. Dopo tale periodo, passerà a 3 dollari per milione di token di input e 15 dollari per milione di token di output.
Per fare un confronto, Opus 4.8 ha un prezzo di $ 5 per milione di token di input e $ 25 per milione di token di output. Poiché gli agenti bruciano un gran numero di token mentre ragionano e richiamano gli strumenti in molti passaggi, il divario di prezzo ha un enorme impatto sui budget aziendali. I tester ad accesso anticipato citati da Anthropic hanno descritto Sonnet 5 portando a termine compiti complessi in cui i precedenti modelli Sonnet si sarebbero fermati di colpo e controllando il proprio output senza che gli fosse chiesto esplicitamente.
Disponibilità su ogni piano
Claude Sonnet 5 è disponibile in tutti i piani di Anthropic dal giorno del lancio. È il modello predefinito per gli utenti Free e Pro ed è disponibile per i clienti Max, Team ed Enterprise. Gli sviluppatori possono accedervi tramite l'API Claude utilizzando l'identificatore del modello "claude-sonnet-5", nonché tramite Claude Code e la piattaforma Claude.
L’ampia implementazione è degna di nota perché mette le prestazioni degli agenti nelle mani degli utenti gratuiti, non solo dei clienti aziendali paganti. Anthropic ha affermato che la linea Sonnet è stata storicamente il luogo in cui è iniziata l'era degli agenti per molti sviluppatori, indicando Claude Sonnet 3.5, 3.6 e 3.7 come i primi modelli che hanno mostrato forti capacità di codifica e utilizzo degli strumenti.
Una storia di sicurezza integrata
La sicurezza è stata una parte fondamentale dell’annuncio. Anthropic ha affermato che le sue valutazioni hanno rilevato che il Sonetto 5 mostra un tasso complessivamente inferiore di comportamenti indesiderati rispetto al Sonetto 4.6 ed è generalmente più sicuro da utilizzare in contesti di agenti. La società ha inoltre osservato che il modello ha una capacità molto inferiore di eseguire compiti di sicurezza informatica rispetto ai suoi attuali modelli Opus, una scelta progettuale deliberata che riduce il rischio di uso improprio anche quando le capacità generali aumentano.
La Claude Sonnet 5 System Card, rilasciata insieme al modello, riporta in dettaglio un insieme più ampio di valutazioni. Anthropic ha posizionato la trasparenza sui test di sicurezza come un elemento di differenziazione competitiva mentre le autorità di regolamentazione negli Stati Uniti e in Europa esaminano attentamente i rilasci di modelli di frontiera.
Il momento agentetico più ampio
Il lancio atterra in mezzo a un'intensa competizione. I rivali, tra cui OpenAI, Google e una serie di laboratori cinesi in rapida evoluzione, stanno tutti spingendo verso modelli in grado di eseguire azioni in più fasi anziché semplicemente generare testo. Fornendo capacità di agenti adiacenti a Opus ai prezzi di Sonnet, Anthropic scommette che il prossimo campo di battaglia non saranno i punteggi di riferimento grezzi, ma il costo di gestione affidabile di un agente su compiti lunghi e complessi.
Con i prezzi di lancio bloccati fino alla fine di agosto, gli sviluppatori hanno ora la possibilità di sottoporre a stress test Sonnet 5 rispetto ai carichi di lavoro degli agenti più impegnativi prima che le tariffe più elevate entrino in vigore.
Stai al passo con l'intelligenza artificiale
Il ritmo del rilascio dei modelli non mostra segni di rallentamento. Per una copertura continua di nuovi lanci, cicli di finanziamento e cambiamenti politici, visita AI Buzz Wire per gli ultimi sviluppi dell'IA man mano che si verificano.
Leggi altre notizie sull'AI →





