Anthropic ha rilasciato Claude Haiku 5.5 martedì, descrivendolo come "il modello piccolo più economico, veloce e più capace che abbiamo mai rilasciato". Il lancio prevede un forte taglio dei prezzi su due livelli che riduce i costi di input a 0,10 dollari per milione di token per la maggior parte delle richieste, una mossa che esercita una pressione diretta su GPT-6 Luna di OpenAI nel segmento dei modelli piccoli ed estende una guerra dei prezzi durata mesi in tutto il settore dell'intelligenza artificiale.
L'annuncio, pubblicato sul sito web di Anthropic il 7 ottobre 2026, posiziona Haiku 5.5 come il terzo modello nella famiglia Claude 5.5, insieme a Sonnet 5.5 e Opus 5.5. Reuters ha definito il rilascio come un'espansione della propria gamma di modelli da parte di Anthropic mentre si prepara per un'IPO pianificata e il modello è già disponibile in GitHub Copilot, Amazon Web Services, Google Cloud e Microsoft Foundry. Il lancio è l'ultimo di un mese di [ultime notizie sull'intelligenza artificiale] (https://aibuzzwire.news) che ha visto il rilascio di modelli, tagli di prezzo e mosse politiche arrivare quasi ogni giorno.
Un piccolo modello costruito per lavori ad alto volume
Secondo Anthropic, Claude Haiku 5.5 è progettato per compiti ad alto volume e sensibili ai costi piuttosto che per ragionamenti a livello di frontiera. L'azienda afferma che "gestisce in modo affidabile carichi di lavoro rapidi e ripetitivi" come riepiloghi, compattazione, query di database e richieste di classificazione.
Anthropic posiziona inoltre il nuovo modello come compagno dei suoi sistemi più grandi: Haiku 5.5 "si abbina bene con Opus 5.5 e Sonnet 5.5 come subagente sul lavoro di codifica", consentendo agli sviluppatori di indirizzare sottoattività economiche e veloci su Haiku riservando modelli più grandi per ragionamenti complessi. Poiché è il modello più veloce di Anthropic fino ad oggi a velocità standard, l'azienda lo consiglia per applicazioni sensibili alla latenza come l'assistenza clienti in tempo reale e l'uso del browser. Una nota a piè di pagina aggiunge un avvertimento: i modelli Opus di Anthropic funzionano ancora più velocemente in modalità Veloce.
Prezzo: fino al 90% più economico di Haiku 4.5
Il cambiamento principale è il prezzo. Anthropic afferma che Haiku 5.5 costa in media circa il 75% in meno rispetto a Haiku 4.5, con una struttura a più livelli che dipende dalle dimensioni del prompt.
Per le richieste con richieste fino a 100.000 token - che secondo Anthropic rappresentavano circa il 90% delle richieste del precedente modello Haiku - i prezzi sono inferiori del 90% rispetto a Haiku 4.5. I suggerimenti superiori a 100.000 token costano il 50% in meno.
La tabella dei prezzi per milione di token riportata nell'annuncio di Anthropic mostra l'entità del taglio:
- Token di input: 0,10 $ (richieste fino a 100.000) o 0,50 $ (oltre 100.000), in calo rispetto al prezzo fisso di 1,00 $ per Haiku 4.5
- Token di output: $ 0,50 o $ 2,50, in calo rispetto a $ 5,00
- Leggi la cache: $ 0,01 o $ 0,05, in calo rispetto a $ 0,10
- Scritture cache: $ 0,125 o $ 0,625, in calo rispetto a $ 1,25
Al livello inferiore a 100.000, ciò rende il prezzo di uscita di Haiku 5.5 un quinto dei $ 10,00 per milione di token di output di Sonnet 5.5.
Anthropic nota un dettaglio tecnico dietro i numeri: Haiku 5.5 utilizza un tokenizzatore aggiornato, simile a Sonnet 5.5 e Opus 5.5, il che significa che utilizza leggermente più token per attività rispetto a Haiku 4.5. L’azienda afferma che il calcolo del costo medio tiene conto di questa differenza.
Benchmark: davanti a GPT-6 Luna nella maggior parte delle righe
Anthropic ha pubblicato una tabella di benchmark che confronta Haiku 5.5 con Haiku 4.5, GPT-6 Luna e Sonnet 5.5. Nella maggior parte delle valutazioni elencate, il nuovo modello si colloca davanti a Luna e nettamente davanti al suo predecessore:
- GDPval-AA v2.1 (lavoro di conoscenza): 1620 per Haiku 5.5, contro 735 per Haiku 4.5, 1437 per GPT-6 Luna e 1840 per Sonnet 5.5
- AA-Briefcase v1.1: 1578, contro 614 per Haiku 4.5 e 1336 per Luna
- OSWorld 2.1, sottoinsieme offline (uso del computer): 72,4%, contro il 15,7% per Haiku 4.5, il 48,9% per Luna e l'83,9% per Sonnet 5.5
- L'Ultimo Esame dell'Umanità: 45,9% senza strumenti e 57,4% con strumenti, contro 10,2% e 18,7% per Haiku 4.5
- Terminal-Bench 4.0 (codifica agente): 39,2%, contro 16,4% per Luna e 70,6% per Sonnet 5.5
- FrontierCode 1.1, Principale: 46,4%, davanti al 42,4% di Luna
Lo schema è coerente: Haiku 5.5 colma gran parte del divario con GPT-6 Luna e, nell'uso del computer, lo batte nettamente, mentre Sonnet 5.5 di Anthropic è ancora in testa ad ogni categoria. La guida di Anthropic riflette quella gerarchia: l'azienda afferma che Sonnet 5.5 e Opus 5.5 "rimangono scelte migliori per compiti complessi di codifica ad agenti come quelli misurati da Terminal-Bench 4.0", mentre Haiku 5.5 si rivolge a lavori con ambito ristretto che "avrebbero potuto altrimenti essere proibitivi in termini di costi con le versioni precedenti di Claude."
Primo Haiku con quadrante di sforzo
Haiku 5.5 è anche il primo modello di classe Haiku a essere fornito con un'impostazione di sforzo regolabile, il controllo costo-contro-intelligenza Anthropic precedentemente offerto sui suoi modelli più grandi. Gli utenti possono scegliere la quantità di elaborazione consumata da ciascuna richiesta e i grafici di Anthropic mostrano i punteggi dei benchmark a ciascun livello di impegno, da Basso a Massimo.
Postura di sicurezza: più stretta dell'Haiku 4.5, più sciolta del sonetto
Per quanto riguarda la sicurezza, Anthropic afferma che Haiku 5.5 mostra "importanti miglioramenti in quasi tutte le nostre valutazioni di allineamento rispetto a Haiku 4.5", con molti meno casi di comportamento disallineato e una minore disponibilità a collaborare con un uso improprio.
Le misure di sicurezza informatica del modello sono più restrittive di quelle di Haiku 4.5, anche se un po' meno restrittive di quelle dei recenti modelli più grandi di Anthropic. Consentono una gamma più ampia di compiti di sicurezza difensivi rispetto alle garanzie di Sonnet 5.5, ma bloccano comunque i test di penetrazione e le tecniche che hanno maggiori probabilità di essere utilizzate dagli aggressori. Le tutele biologiche corrispondono a quelle di Sonnet 5, Sonnet 5.5 e Opus 5. Le organizzazioni che necessitano di un accesso più ampio possono fare domanda per i programmi di scienze della vita o di verifica informatica di Anthropic. I dettagli completi si trovano nella scheda di sistema Haiku 5.5.
Il resto dell'annuncio: sonetto più economico, crediti API gratuiti
Il lancio è stato confezionato con molte altre modifiche. Le letture della cache su Claude Sonnet 5.5 ora costano 0,10 dollari per milione di token invece di 0,20 dollari: un taglio del 50% che secondo Anthropic rende Sonnet 5.5 circa il 20% più economico sulla maggior parte del lavoro degli agenti, poiché le letture della cache dominano il consumo di token nei flussi di lavoro degli agenti.
Questa settimana Anthropic distribuirà anche crediti API mensili per i clienti in abbonamento: $ 100 al mese per gli utenti Max 5x, $ 200 per gli utenti Max 20x e fino a $ 500 raggruppati tra utenti per i piani Team, utilizzabili su qualsiasi modello. I crediti sono rivolti agli abbonati che creano strumenti e agenti sulla piattaforma Claude.
Gli sviluppatori ricevono anche aggiornamenti SDK: gli SDK Python e TypeScript di Anthropic ora supportano l'uso del computer e l'uso del browser in versione beta, funzionalità che secondo l'azienda si adattano al profilo velocità-prezzo di Haiku 5.5.
Una guerra dei prezzi senza fine in vista
La copertura del Decoder ha inquadrato il lancio come una prova che "la corsa agli armamenti sui prezzi dell'intelligenza artificiale è lungi dall'essere finita" e i numeri supportano questa lettura. A settembre, Anthropic e OpenAI hanno lanciato modelli di punta rivali a poche ore di distanza l’uno dall’altro, con tanto di tagli di prezzo concorrenti. Haiku 5.5 estende questa battaglia alla fascia bassa del mercato, dove i modelli più piccoli alimentano i carichi di lavoro a volume più elevato e più sensibili al prezzo.
Per gli sviluppatori, l’effetto immediato è semplice: l’inferenza di piccolo modello sulla piattaforma Claude ora parte da 0,10 dollari per milione di token di input e 0,50 dollari per milione di token di output, con GPT-6 Luna battuto sulla maggior parte dei benchmark pubblicati da Anthropic a quel prezzo. Se OpenAI risponderà con una riduzione del prezzo di Luna – o attenderà il prossimo rilascio di un modello piccolo – indicherà quanto sia duraturo questo prezzo minimo.
Haiku 5.5 è ora disponibile su app e API proprietari di Anthropic, Amazon Web Services, Google Cloud e Microsoft Foundry ed è già integrato in GitHub Copilot.
Stai al passo con l'intelligenza artificiale Leggi altre notizie sull'intelligenza artificiale su AI Buzz Wire