Anthropic a lansat marți Claude Haiku 5.5, descriindu-l drept „cel mai ieftin, mai rapid și mai capabil model mic pe care l-am lansat vreodată”. Lansarea vine cu o reducere abruptă a prețului pe două niveluri, care scade costurile de intrare la 0,10 USD per milion de jetoane pentru majoritatea cererilor, o mișcare care pune presiune directă asupra GPT-6 Luna de la OpenAI în segmentul modelelor mici și extinde un război al prețurilor de luni de zile în industria AI.

Anunțul, publicat pe site-ul Anthropic pe 7 octombrie 2026, poziționează Haiku 5.5 drept al treilea model din familia Claude 5.5, alături de Sonnet 5.5 și Opus 5.5. Reuters a caracterizat lansarea ca Anthropic și-a extins gama de modele în timp ce se pregătește pentru o IPO planificată, iar modelul este deja disponibil în GitHub Copilot, Amazon Web Services, Google Cloud și Microsoft Foundry. Lansarea este cea mai recentă intrare dintr-o lună de știri de ultimă oră AI care a văzut lansări de modele, reduceri de prețuri și schimbări de politică aproape în fiecare zi.

Un model mic construit pentru lucrări de volum mare

Potrivit Anthropic, Claude Haiku 5.5 este proiectat pentru sarcini de volum mare, sensibile la costuri, mai degrabă decât pentru raționament la nivel de frontieră. Compania spune că „tratează în mod fiabil sarcinile de lucru rapide și repetitive”, cum ar fi rezumatele, compactarea, interogările de baze de date și solicitările de clasificare.

De asemenea, Anthropic poziționează noul model ca un însoțitor al sistemelor sale mai mari: Haiku 5.5 „se împerechează bine cu Opus 5.5 și Sonnet 5.5 ca subagent în activitatea de codificare”, permițând dezvoltatorilor să direcționeze subsarcini ieftine și rapide către Haiku, rezervând în același timp modele mai mari pentru raționamentul complex. Deoarece este cel mai rapid model Anthropic până în prezent la viteză standard, compania îl recomandă pentru aplicații sensibile la latență, cum ar fi asistența pentru clienți live și utilizarea browserului. O notă de subsol adaugă o avertizare: modelele Opus de la Anthropic încă rulează mai repede în modul rapid.

Preț: cu până la 90% mai ieftin decât Haiku 4.5

Modificarea titlului este prețul. Anthropic spune că Haiku 5.5 costă cu aproximativ 75% mai puțin de rulat decât Haiku 4.5, în medie, cu o structură pe niveluri care depinde de dimensiunea promptă.

Pentru solicitările cu solicitări de până la 100.000 de jetoane – despre care Anthropic spune că au reprezentat aproximativ 90% din solicitările către modelul anterior Haiku – prețurile sunt cu 90% mai mici decât Haiku 4.5. Solicitările de peste 100.000 de jetoane costă cu 50% mai puțin.

Tabelul de prețuri per milion de token din anunțul Anthropic arată amploarea reducerii:

  • Jetoane de intrare: 0,10 USD (solicitari până la 100K) sau 0,50 USD (peste 100K), în scădere de la 1,00 USD fix pentru Haiku 4.5
  • Jetoane de ieșire: 0,50 USD sau 2,50 USD, în scădere de la 5,00 USD
  • Cache-ul citește: 0,01 USD sau 0,05 USD, în scădere de la 0,10 USD
  • Cache scrie: 0,125 USD sau 0,625 USD, în scădere de la 1,25 USD

La nivelul sub 100K, asta face ca prețul de ieșire al lui Haiku 5.5 să fie o cincime din cei 10,00 USD per milion de jetoane de ieșire ale Sonnet 5.5.

Anthropic notează un detaliu tehnic în spatele numerelor: Haiku 5.5 folosește un tokenizer actualizat, similar cu Sonnet 5.5 și Opus 5.5, ceea ce înseamnă că folosește puțin mai multe jetoane pe sarcină decât a făcut Haiku 4.5. Compania spune că calculul costului mediu ține seama de această diferență.

Benchmarks: înaintea GPT-6 Luna în cele mai multe rânduri

Anthropic a publicat un tabel de referință care compară Haiku 5.5 cu Haiku 4.5, GPT-6 Luna și Sonnet 5.5. Pe majoritatea evaluărilor enumerate, noul model termină înaintea lui Luna și cu mult înaintea predecesorului său:

  • GDPval-AA v2.1 (lucru de cunoștințe): 1620 pentru Haiku 5.5, față de 735 pentru Haiku 4.5, 1437 pentru GPT-6 Luna și 1840 pentru Sonnet 5.5
  • AA-Briefcase v1.1: 1578, față de 614 pentru Haiku 4.5 și 1336 pentru Luna
  • OSWorld 2.1, subset offline (utilizarea computerului): 72,4%, față de 15,7% pentru Haiku 4.5, 48,9% pentru Luna și 83,9% pentru Sonnet 5.5
  • Ultimul examen al umanității: 45,9% fără unelte și 57,4% cu instrumente, față de 10,2% și 18,7% pentru Haiku 4.5
  • Terminal-Bench 4.0 (codare agentică): 39,2%, față de 16,4% pentru Luna și 70,6% pentru Sonnet 5.5
  • FrontierCode 1.1, Principal: 46,4%, înaintea lui Luna de 42,4%

Modelul este consecvent: Haiku 5.5 reduce o mare parte din decalajul față de GPT-6 Luna și, în utilizarea computerelor, îl bate de-a dreptul, în timp ce Sonnet 5.5 de la Anthropic conduce în continuare fiecare categorie. Îndrumările Anthropic reflectă această ierarhie - compania spune că Sonnet 5.5 și Opus 5.5 „rămîn alegeri mai bune pentru sarcini complexe de codare agentică, cum ar fi cele măsurate de Terminal-Bench 4.0”, în timp ce Haiku 5.5 vizează lucrări cu sferă restrânsă care „ar fi putut, altfel, să fi fost prohibitive din punct de vedere al costurilor cu versiunile anterioare ale lui Claude”.

Primul Haiku cu un apel de efort

Haiku 5.5 este, de asemenea, primul model din clasa Haiku livrat cu o setare de efort reglabilă, controlul cost-versus-intelligence oferit anterior de Anthropic pe modelele sale mai mari. Utilizatorii pot alege cât de mult de calcul consumă fiecare solicitare, iar graficele Anthropic arată scorurile de referință la fiecare nivel de efort de la Scăzut la Max.

Poziție de siguranță: mai strâns decât Haiku 4.5, mai liber decât Sonnet

În ceea ce privește siguranța, Anthropic spune că Haiku 5.5 prezintă „îmbunătățiri majore în aproape toate evaluările noastre de aliniere în raport cu Haiku 4.5”, cu mult mai puține cazuri de comportament nealiniat și o disponibilitate mai scăzută de a coopera cu utilizarea greșită.

Garanțiile de securitate cibernetică ale modelului sunt mai restrictive decât cele ale lui Haiku 4.5, deși oarecum mai puțin restrictive decât cele de pe modelele mai mari recente ale Anthropic. Acestea permit o gamă mai largă de sarcini de securitate defensive decât măsurile de protecție ale Sonnet 5.5, dar blochează totuși testele de penetrare și tehnicile mai susceptibile de a fi utilizate de atacatori. Măsurile de protecție ale biologiei se potrivesc cu cele din Sonnet 5, Sonnet 5.5 și Opus 5. Organizațiile care au nevoie de un acces mai larg pot aplica la programele Anthropic Life Sciences sau Cyber ​​Verification. Detaliile complete sunt în cardul de sistem Haiku 5.5.

Restul anunțului: Sonet mai ieftin, credite API gratuite

Lansarea a fost inclusă cu alte câteva modificări. Citirile cache pe Claude Sonnet 5.5 costă acum 0,10 USD per milion de jetoane în loc de 0,20 USD - o reducere de 50% despre care Anthropic spune că face Sonnet 5.5 mai ieftin cu aproximativ 20% pentru majoritatea lucrărilor agentice, deoarece citirile cache domină consumul de jetoane în fluxurile de lucru ale agenților.

Anthropic lansează, de asemenea, credite API lunare săptămâna aceasta pentru clienții cu abonament: 100 USD pe lună pentru utilizatorii de Max 5x, 200 USD pentru utilizatorii de Max 20x și până la 500 USD cumulat între utilizatori pentru planurile de echipă, utilizabile pe orice model. Creditele sunt destinate abonaților care construiesc instrumente și agenți pe Platforma Claude.

Dezvoltatorii primesc și actualizări SDK: SDK-urile Python și TypeScript de la Anthropic acceptă acum utilizarea computerului și utilizarea browserului în versiune beta, capabilități despre care compania spune că se potrivesc profilului de viteză-preț al lui Haiku 5.5.

Un război al prețurilor fără sfârșit

Acoperirea Decoderului a încadrat lansarea ca o dovadă că „cursa înarmărilor de stabilire a prețurilor AI este departe de a se termina”, iar cifrele susțin această lectură. În septembrie, Anthropic și OpenAI au lansat modele emblematice rivale la câteva ore unul de celălalt, complet cu reduceri de prețuri concurente. Haiku 5.5 extinde această luptă la nivelul de jos al pieței, unde modelele mici alimentează cele mai mari încărcături de lucru, cele mai sensibile la preț.

Pentru dezvoltatori, efectul imediat este simplu: deducerea modelelor mici pe platforma Claude începe acum de la 0,10 USD per milion de jetoane de intrare și 0,50 USD per milion de jetoane de ieșire, cu GPT-6 Luna depășit de majoritatea benchmark-urilor publicate de Anthropic la acel preț. Dacă OpenAI răspunde cu o reducere a prețului Luna - sau așteaptă următoarea lansare a modelului mic - va semnala cât de durabil este cu adevărat acest nivel de preț.

Haiku 5.5 este disponibil acum în aplicațiile și API-ul primar Anthropic, Amazon Web Services, Google Cloud și Microsoft Foundry și este deja integrat în GitHub Copilot.

Rămâneți înaintea AI Citiți mai multe știri despre AI pe AI Buzz Wire