Anthropic ha presentato Claude Opus 5, un nuovo modello di intelligenza artificiale che secondo l'azienda offre un'intelligenza quasi di frontiera a circa la metà del prezzo del suo modello Fable 5 di livello superiore. Rilasciato il 24 luglio 2026, Opus 5 è ora il modello predefinito su Claude Max e il modello più potente disponibile su Claude Pro, posizionandolo come il cavallo di battaglia quotidiano di Anthropic per la codifica, gli agenti autonomi e il lavoro di conoscenza professionale.

Il lancio avviene in un momento in cui le aziende stanno esaminando attentamente la spesa per l’intelligenza artificiale. Secondo la CNBC, il nuovo modello "rivaleggia con Fable 5 ed è più economico poiché le aziende si preoccupano dei costi", mentre Bloomberg lo ha definito un "modello più conveniente per le attività quotidiane". Per i team che seguono gli ultimi sviluppi dell'IA, Opus 5 rappresenta una scommessa deliberata secondo cui il prossimo campo di battaglia competitivo è il valore, non la pura supremazia dei benchmark.

Prestazioni benchmark: nuovo stato dell'arte in materia di codifica e lavoro sulla conoscenza

Anthropic riferisce che Opus 5 pubblica risultati all'avanguardia sulla codifica e sulle valutazioni del lavoro di conoscenza, tra cui Frontier-Bench e GDPval-AA. Su Frontier-Bench v0.1, la società afferma che Opus 5 supera tutti gli altri modelli e più che raddoppia le prestazioni del suo predecessore, Opus 4.8, a un costo per attività inferiore.

Su CursorBench 3.2, Opus 5 rientra nello 0,5% del punteggio massimo di Fable 5 pur costando la metà per attività, secondo i benchmark di Anthropic. Decrypt ha osservato che il modello "supera Fable 5 nella maggior parte dei benchmark, a metà prezzo".

I vantaggi si estendono alle valutazioni degli agenti e della risoluzione dei problemi:

  • ARC-AGI 3: Opus 5 ottiene un punteggio circa tre volte superiore rispetto al modello migliore in questo nuovo test di risoluzione dei problemi.
  • Zapier AutomationBench: una percentuale di superamento pari a circa 1,5 volte rispetto al modello migliore allo stesso costo, che misura il completamento delle attività aziendali end-to-end.
  • OSWorld 2.0 (uso del computer): Opus 5 supera il miglior risultato di Fable 5 a poco più di un terzo del costo.

In particolare, Anthropic riconosce che Opus 5 "rimane dietro Mythos 5 sui compiti di sicurezza informatica", un'area in cui un modello di frontiera rivale mantiene la leadership.

Agenzia e autoverifica più forti

Un tema ricorrente nell'annuncio è la migliore capacità dell'Opus 5 di verificare il proprio lavoro e di iterare fino a quando non ha successo. Anthropic ha descritto diversi esempi tratti da test di accesso anticipato che evidenziano questa autonomia.

In un'attività di Frontier-Bench, al modello è stato dato un disegno di una parte della macchina e gli è stato chiesto di scrivere il codice per ricostruirlo come modello 3D di FreeCAD, ma non gli è stato deliberatamente dato modo di visualizzare direttamente il disegno. Secondo quanto riferito, Opus 5 ha scritto la propria pipeline di visione artificiale per estrarre la geometria dai pixel grezzi, quindi ha ricostruito l'intera parte, riuscendo ripetutamente laddove nessun modello concorrente sarebbe riuscito a risolvere il compito dopo cinque tentativi.

Dato un vero bug in un popolare gestore di pacchetti open source, Opus 5 ha trovato la causa principale e risolto un caso limite che la patch della comunità non aveva rilevato, mentre un modello concorrente ha risolto solo il sintomo superficiale e ha dichiarato il bug risolto. Secondo quanto riferito, un ingegnere di una società commerciale ha utilizzato Opus 5 per creare un feed di dati di mercato per un nuovo scambio in un'unica sessione - un'attività che i modelli precedenti non potevano affatto completare - e, non trovando alcun feed live da convalidare, il modello ha costruito il proprio sistema di test.

Accoglienza clienti

I partner ad accesso anticipato hanno offerto valutazioni ampiamente positive. Scott Wu, CEO di Cognition (produttore dell'agente di codifica Devin), ha affermato che Opus 5 "si avvicina alle prestazioni di livello Fable a metà del costo" e mostra "particolare forza nelle difficili attività di debugging e analisi delle cause principali". Sualeh Asif, co-fondatore di Cursor, ha affermato che il modello offre "un'intelligenza simile a quella di Fable 5 alla velocità e ai costi di Opus".

Wade Foster, CEO di Zapier, ha riferito che Opus 5 "ha raggiunto la vetta della classifica di AutomationBench di Zapier senza spendere più token rispetto ai precedenti modelli Claude", completando un flusso di lavoro completo di prevenzione dell'abbandono end-to-end, segnalando gli account a rischio, avvisando il proprietario giusto e riepilogando per i team di fidelizzazione. I modelli precedenti non passavano; L'Opus 5 ha raggiunto il 100%.

Guadagni nella ricerca scientifica

Anthropic ha anche evidenziato i miglioramenti dell'Opus 5 per il lavoro scientifico. Il modello supera l'Opus 4.8 in tutte le valutazioni di scienze della vita di Anthropic, che coprono biologia strutturale, chimica organica e bioinformatica. L’azienda ha sottolineato un miglioramento di 10,2 punti percentuali su un benchmark interno di chimica organica (deducendo strutture molecolari dai dati spettroscopici) e un guadagno di 7,7 punti sui compiti di previsione della funzione proteica. Un cliente del settore genomico ha descritto il modello come un comportamento "più simile a quello di uno scienziato attento", che cerca i giusti test statistici e verifica incrociando i propri risultati.

La strategia dei prezzi

Valutando Opus 5 allo stesso livello di Opus 4.8 e avvicinandosi all'intelligenza di Fable 5, Anthropic sta effettivamente riducendo il divario tra le sue offerte di livello intermedio e di punta. VentureBeat ha definito il rilascio come "un modello di intelligenza artificiale più economico per codifica, agenti e flussi di lavoro aziendali" e Seeking Alpha ha osservato che Opus 5 è "più vicino ed economico al modello di frontiera Fable 5". L'azienda offre un'impostazione di "sforzo" regolabile che consente ai clienti di scambiare l'intelligenza con la velocità e ridurre i costi dei token, ottimizzando il rapporto costo-prestazioni per attività.

Cosa significa per la corsa all'intelligenza artificiale

L’Opus 5 sottolinea la rapidità con cui il costo dell’intelligenza artificiale vicino alla frontiera sta diminuendo. Un modello che si avvicina a una distanza impressionante dai sistemi più potenti disponibili – alla metà del prezzo simbolico – spinge i concorrenti a giustificare prezzi premium per guadagni marginali. Con Anthropic, OpenAI, Google e altri che si affrettano a creare modelli sufficientemente accessibili per l'implementazione quotidiana su larga scala, la domanda per le aziende si sta spostando da "quale modello è il più intelligente?" a "quale modello offre più intelligenza per dollaro?"

Per Anthropic il messaggio è chiaro: il ragionamento di fascia alta non è più un prodotto di lusso. Opus 5 porta la capacità di frontiera a un prezzo che rende realistica l’implementazione quotidiana e sostenuta – e questo potrebbe rivelarsi il dettaglio più consequenziale di tutti.

Stai al passo con l'intelligenza artificiale

Claude Opus 5 è disponibile a partire da oggi su Claude Pro, Claude Max e tramite l'API di Anthropic. Per ulteriori informazioni su questa storia e sul panorama più ampio dell'intelligenza artificiale, resta aggiornato sulle ultime notizie sull'intelligenza artificiale in tempo reale.

Leggi altre notizie sull'AI →