Anthropic släppte Claude Haiku 5.5 på tisdagen och beskrev den som "den billigaste, snabbaste och mest kapabla lilla modellen vi någonsin har släppt." Lanseringen kommer med en kraftig prissänkning i två nivåer som sänker insatskostnaderna till $0,10 per miljon tokens för de flesta förfrågningar, ett drag som sätter direkt press på OpenAI:s GPT-6 Luna i småmodellsegmentet och förlänger ett månader långt priskrig över AI-industrin.
Tillkännagivandet, publicerat på Anthropics webbplats den 7 oktober 2026, placerar Haiku 5.5 som den tredje modellen i Claude 5.5-familjen, tillsammans med Sonnet 5.5 och Opus 5.5. Reuters karakteriserade releasen som att Anthropic utökade sin modellserie när den förbereder sig för en planerad börsnotering, och modellen är redan tillgänglig i GitHub Copilot, Amazon Web Services, Google Cloud och Microsoft Foundry. Lanseringen är det senaste inlägget under en månad av bristande AI-nyheter som har sett modellsläpp, prissänkningar och policyrörelser landa nästan varje dag.
En liten modell byggd för högvolymarbete
Enligt Anthropic är Claude Haiku 5.5 designad för höga volymer, kostnadskänsliga uppgifter snarare än resonemang på gränsnivå. Företaget säger att det "tillförlitligt hanterar snabba och repetitiva arbetsbelastningar" såsom sammanfattningar, komprimering, databasfrågor och klassificeringsförfrågningar.
Anthropic positionerar också den nya modellen som en följeslagare till sina större system: Haiku 5.5 "passar väl ihop med Opus 5.5 och Sonnet 5.5 som en subagent på kodningsarbete", vilket låter utvecklare dirigera billiga, snabba deluppgifter till Haiku samtidigt som de reserverar större modeller för komplexa resonemang. Eftersom det är Anthropics snabbaste modell hittills med standardhastighet, rekommenderar företaget den för latenskänsliga applikationer som live kundsupport och webbläsaranvändning. En fotnot lägger till en varning: Anthropics Opus-modeller kör fortfarande snabbare i snabbläge.
Prissättning: Upp till 90 % billigare än Haiku 4.5
Rubrikändringen är priset. Anthropic säger att Haiku 5.5 kostar cirka 75 % mindre att köra än Haiku 4.5 i genomsnitt, med en struktur i nivåer som beror på snabb storlek.
För förfrågningar med uppmaningar på upp till 100 000 tokens - som Anthropic säger stod för ungefär 90% av förfrågningarna till den tidigare Haiku-modellen - är priserna 90% lägre än Haiku 4.5. Uppmaningar över 100 000 tokens kostar 50 % mindre.
Pristabellen per miljon token från Anthropics tillkännagivande visar omfattningen av nedskärningen:
- Inmatningstokens: $0,10 (uppmaning upp till 100K) eller $0,50 (över 100K), ner från $1,00 platt för Haiku 4.5
- Utdatatokens: 0,50 USD eller 2,50 USD, ned från 5,00 USD
- Cache: 0,01 USD eller 0,05 USD, ned från 0,10 USD
- Cache skriver: $0,125 eller $0,625, ned från $1,25
På nivån under 100K gör det Haiku 5.5:s utgångspris till en femtedel av Sonnet 5.5:s $10,00 per miljon output-tokens.
Anthropic noterar en teknisk detalj bakom siffrorna: Haiku 5.5 använder en uppdaterad tokenizer, liknande Sonnet 5.5 och Opus 5.5, vilket innebär att den använder något fler tokens per uppgift än Haiku 4.5 gjorde. Företaget säger att dess genomsnittliga kostnadsberäkning står för den skillnaden.
Benchmarks: Före GPT-6 Luna i de flesta rader
Anthropic publicerade en benchmarktabell som jämför Haiku 5.5 med Haiku 4.5, GPT-6 Luna och Sonnet 5.5. På de flesta av de listade utvärderingarna slutar den nya modellen före Luna och dramatiskt före sin föregångare:
- GDPval-AA v2.1 (kunskapsarbete): 1620 för Haiku 5.5, mot 735 för Haiku 4.5, 1437 för GPT-6 Luna och 1840 för Sonnet 5.5
- AA-Portfölj v1.1: 1578, mot 614 för Haiku 4.5 och 1336 för Luna
- OSWorld 2.1, offline-delmängd (datoranvändning): 72,4 %, mot 15,7 % för Haiku 4,5, 48,9 % för Luna och 83,9 % för Sonnet 5,5
- Humanity's Last Exam: 45,9 % utan verktyg och 57,4 % med verktyg, jämfört med 10,2 % och 18,7 % för Haiku 4,5
- Terminal-Bench 4.0 (agentkodning): 39,2 %, mot 16,4 % för Luna och 70,6 % för Sonnet 5,5
- FrontierCode 1.1, Main: 46,4 %, före Lunas 42,4 %
Mönstret är konsekvent: Haiku 5.5 täpper till mycket av gapet till GPT-6 Luna och, vid datoranvändning, slår det direkt, medan Anthropics egen Sonnet 5.5 fortfarande leder varje kategori. Anthropics vägledning återspeglar den hierarkin - företaget säger att Sonnet 5.5 och Opus 5.5 "fortfarande är bättre val för komplexa agentkodningsuppgifter som de som mäts av Terminal-Bench 4.0", medan Haiku 5.5 är inriktat på arbete med snäv omfattning som "annars kunde ha varit kostnadseffektivt med tidigare versioner av Claude."
Första haiku med en ansträngningsratt
Haiku 5.5 är också den första modellen i Haiku-klassen som levereras med en justerbar ansträngningsinställning, den kostnads-mot-intelligenskontroll som Anthropic tidigare erbjöd på sina större modeller. Användare kan välja hur mycket beräkning varje förfrågan förbrukar, och Anthropics diagram visar benchmarkpoäng på varje insatsnivå från låg till max.
Säkerhetshållning: Tighter Than Haiku 4.5, Looser Than Sonnet
När det gäller säkerhet säger Anthropic att Haiku 5.5 visar "stora förbättringar i nästan alla våra anpassningsutvärderingar i förhållande till Haiku 4.5", med mycket färre fall av felaktigt beteende och en lägre vilja att samarbeta med missbruk.
Modellens cybersäkerhetsgarantier är mer restriktiva än Haiku 4.5, men något mindre restriktiva än de på Anthropics senaste större modeller. De tillåter ett bredare utbud av defensiva säkerhetsuppgifter än Sonnet 5.5:s skyddsåtgärder men blockerar fortfarande penetrationstestning och tekniker som mer sannolikt kommer att användas av angripare. Biologiska skyddsåtgärder matchar de för Sonnet 5, Sonnet 5.5 och Opus 5. Organisationer som behöver bredare tillgång kan ansöka till Anthropics Life Sciences eller Cyber Verification Program. Fullständig information finns i Haiku 5.5-systemkortet.
Resten av meddelandet: billigare sonett, gratis API-krediter
Lanseringen var förpackad med flera andra förändringar. Cacheläsning på Claude Sonnet 5.5 kostar nu 0,10 USD per miljon tokens istället för 0,20 USD – en minskning på 50 % som Anthropic säger gör Sonnet 5.5 cirka 20 % billigare för de flesta agentarbeten, eftersom cacheläsningar dominerar tokenkonsumtionen i agentarbetsflöden.
Anthropic rullar också ut månatliga API-krediter denna vecka för prenumerationskunder: 100 USD per månad för Max 5x användare, 200 USD för Max 20x användare och upp till 500 USD sammanslagna mellan användare för Team-planer, användbara på alla modeller. Krediterna riktar sig till prenumeranter som bygger verktyg och agenter på Claude-plattformen.
Utvecklare får också SDK-uppdateringar: Anthropics Python- och TypeScript SDK:er stöder nu datoranvändning och webbläsaranvändning i beta, kapaciteter som företaget säger passar Haiku 5.5:s hastighets-prisprofil.
Ett priskrig utan slut i sikte
Dekoderns täckning inramade lanseringen som ett bevis på att "AI-prissättningskapprustningen är långt ifrån över", och siffrorna stöder den läsningen. I september lanserade Anthropic och OpenAI rivaliserande flaggskeppsmodeller inom några timmar från varandra, komplett med konkurrerande prissänkningar. Haiku 5.5 utökar den kampen till den låga delen av marknaden, där små modeller driver de högsta volymerna och mest priskänsliga arbetsbelastningarna.
För utvecklare är den omedelbara effekten okomplicerad: slutledning av små modeller på Claude-plattformen börjar nu på $0,10 per miljon inmatade tokens och $0,50 per miljon output-tokens, med GPT-6 Luna slagen på de flesta av Anthropics publicerade riktmärken vid den prispunkten. Om OpenAI svarar med en prissänkning av Luna – eller väntar på nästa släpp av småmodeller – kommer att signalera hur hållbart detta prisgolv verkligen är.
Haiku 5.5 är tillgängligt nu över Anthropics förstapartsappar och API, Amazon Web Services, Google Cloud och Microsoft Foundry, och är redan integrerat i GitHub Copilot.
Lägg dig före AI Läs fler AI-nyheter på AI Buzz Wire