Anthropic heeft dinsdag Claude Haiku 5.5 uitgebracht en beschrijft het als "het goedkoopste, snelste en meest capabele kleine model dat we ooit hebben uitgebracht." De lancering gaat gepaard met een steile tweeledige prijsverlaging die de inputkosten voor de meeste verzoeken verlaagt tot $0,10 per miljoen tokens, een zet die directe druk uitoefent op OpenAI's GPT-6 Luna in het kleine modelsegment en een maandenlange prijzenoorlog in de AI-industrie verlengt.
De aankondiging, gepubliceerd op de website van Anthropic op 7 oktober 2026, positioneert Haiku 5.5 als het derde model in de Claude 5.5-familie, naast Sonnet 5.5 en Opus 5.5. Reuters typeerde de release als Anthropic die zijn modellenreeks uitbreidt terwijl het zich voorbereidt op een geplande beursintroductie, en het model is al beschikbaar in GitHub Copilot, Amazon Web Services, Google Cloud en Microsoft Foundry. De lancering is de laatste inzending in een maand vol breaking AI news waarin bijna elke dag modelreleases, prijsverlagingen en beleidswijzigingen plaatsvinden.
Een klein model gebouwd voor werk met grote volumes
Volgens Anthropic is Claude Haiku 5.5 ontworpen voor grote, kostengevoelige taken in plaats van redeneren op grensniveau. Het bedrijf zegt dat het "op betrouwbare wijze snelle en repetitieve werklasten afhandelt", zoals samenvattingen, compactie, databasequery's en classificatieverzoeken.
Anthropic positioneert het nieuwe model ook als aanvulling op zijn grotere systemen: Haiku 5.5 "past goed bij Opus 5.5 en Sonnet 5.5 als subagent voor codeerwerk", waardoor ontwikkelaars goedkope, snelle subtaken naar Haiku kunnen routeren terwijl grotere modellen worden gereserveerd voor complex redeneren. Omdat het Anthropic's snelste model tot nu toe is op standaardsnelheid, raadt het bedrijf het aan voor latentiegevoelige toepassingen zoals live klantenondersteuning en browsergebruik. Eén voetnoot voegt een voorbehoud toe: de Opus-modellen van Anthropic werken nog steeds sneller in de snelle modus.
Prijzen: tot 90% goedkoper dan Haiku 4.5
De belangrijkste verandering is de prijs. Anthropic zegt dat Haiku 5.5 gemiddeld ongeveer 75% minder kost dan Haiku 4.5, met een gelaagde structuur die afhankelijk is van de promptgrootte.
Voor verzoeken met prompts tot 100.000 tokens – die volgens Anthropic ongeveer 90% van de verzoeken naar het vorige Haiku-model vertegenwoordigden – zijn de prijzen 90% lager dan die van Haiku 4.5. Prompts van meer dan 100.000 tokens kosten 50% minder.
De prijstabel per miljoen token uit de aankondiging van Anthropic toont de omvang van de verlaging:
- Invoertokens: $ 0,10 (aanwijzingen tot 100.000) of $ 0,50 (meer dan 100.000), lager dan $ 1,00 voor Haiku 4.5
- Uitvoertokens: $ 0,50 of $ 2,50, lager dan $ 5,00
- Cache luidt: $ 0,01 of $ 0,05, lager dan $ 0,10
- Cache schrijft: $ 0,125 of $ 0,625, lager dan $ 1,25
Op het sub-100K-niveau betekent dat dat de uitvoerprijs van Haiku 5.5 een vijfde is van de uitvoertokens van $ 10,00 per miljoen van Sonnet 5.5.
Anthropic merkt één technisch detail achter de cijfers op: Haiku 5.5 gebruikt een bijgewerkte tokenizer, vergelijkbaar met Sonnet 5.5 en Opus 5.5, wat betekent dat het iets meer tokens per taak gebruikt dan Haiku 4.5. Het bedrijf zegt dat de berekening van de gemiddelde kosten rekening houdt met dat verschil.
Benchmarks: voorsprong op GPT-6 Luna in de meeste rijen
Anthropic publiceerde een benchmarktabel waarin Haiku 5.5 werd vergeleken met Haiku 4.5, GPT-6 Luna en Sonnet 5.5. Op de meeste van de genoemde evaluaties eindigt het nieuwe model voor Luna en dramatisch voor zijn voorganger:
- GDPval-AA v2.1 (kenniswerk): 1620 voor Haiku 5.5, versus 735 voor Haiku 4.5, 1437 voor GPT-6 Luna en 1840 voor Sonnet 5.5
- AA-aktetas v1.1: 1578, versus 614 voor Haiku 4.5 en 1336 voor Luna
- OSWorld 2.1, offline subset (computergebruik): 72,4%, versus 15,7% voor Haiku 4.5, 48,9% voor Luna en 83,9% voor Sonnet 5.5
- Het laatste examen van de mensheid: 45,9% zonder gereedschap en 57,4% met gereedschap, versus 10,2% en 18,7% voor Haiku 4.5
- Terminal-Bench 4.0 (agentische codering): 39,2%, versus 16,4% voor Luna en 70,6% voor Sonnet 5.5
- FrontierCode 1.1, Main: 46,4%, hoger dan Luna's 42,4%
Het patroon is consistent: Haiku 5.5 dicht een groot deel van de kloof met GPT-6 Luna en verslaat het, wat computergebruik betreft, ronduit, terwijl Anthropic's eigen Sonnet 5.5 nog steeds aan de leiding staat in elke categorie. De richtlijnen van Anthropic weerspiegelen die hiërarchie. Het bedrijf zegt dat Sonnet 5.5 en Opus 5.5 "betere keuzes blijven voor complexe codeertaken zoals die gemeten door Terminal-Bench 4.0", terwijl Haiku 5.5 zich richt op werk met een beperkte reikwijdte dat "anders misschien onbetaalbaar zou zijn geweest met eerdere versies van Claude."
Eerste haiku met een inspanningsknop
De Haiku 5.5 is ook het eerste model uit de Haiku-klasse dat wordt geleverd met een instelbare inspanningsinstelling, de kosten- versus-intelligentiecontrole die Anthropic eerder op zijn grotere modellen aanbood. Gebruikers kunnen kiezen hoeveel rekenkracht elk verzoek verbruikt, en de grafieken van Anthropic tonen benchmarkscores op elk inspanningsniveau, van Laag tot Max.
Veiligheidshouding: strakker dan Haiku 4.5, losser dan sonnet
Wat de veiligheid betreft, zegt Anthropic dat Haiku 5.5 "grote verbeteringen laat zien in bijna al onze afstemmingsevaluaties ten opzichte van Haiku 4.5", met veel minder gevallen van slecht uitgelijnd gedrag en een lagere bereidheid om mee te werken aan misbruik.
De cyberbeveiligingsmaatregelen van het model zijn restrictiever dan die van Haiku 4.5, hoewel iets minder restrictief dan die van de recente grotere modellen van Anthropic. Ze maken een breder scala aan defensieve beveiligingstaken mogelijk dan de beveiligingsmaatregelen van Sonnet 5.5, maar blokkeren nog steeds penetratietests en technieken die waarschijnlijker door aanvallers zullen worden gebruikt. Biologische waarborgen komen overeen met die van Sonnet 5, Sonnet 5.5 en Opus 5. Organisaties die bredere toegang nodig hebben, kunnen zich aanmelden voor de Life Sciences- of Cyber Verification-programma's van Anthropic. Volledige details staan op de Haiku 5.5-systeemkaart.
De rest van de aankondiging: goedkoper sonnet, gratis API-credits
De lancering ging gepaard met een aantal andere wijzigingen. Cache-reads op Claude Sonnet 5.5 kosten nu $0,10 per miljoen tokens in plaats van $0,20 – een korting van 50% die volgens Anthropic Sonnet 5.5 ongeveer 20% goedkoper maakt op het meeste agentic-werk, omdat cache-reads het tokenverbruik in agent-workflows domineren.
Anthropic introduceert deze week ook maandelijkse API-credits voor abonnementsklanten: $ 100 per maand voor maximaal 5x gebruikers, $ 200 voor maximaal 20x gebruikers en tot $ 500 gebundeld over gebruikers voor teamabonnementen, bruikbaar op elk model. De credits zijn bedoeld voor abonnees die tools en agenten bouwen op het Claude Platform.
Ontwikkelaars krijgen ook SDK-updates: de Python- en TypeScript-SDK's van Anthropic ondersteunen nu computergebruik en browsergebruik in bèta, mogelijkheden die volgens het bedrijf passen bij het snelheids-prijsprofiel van Haiku 5.5.
Een prijzenoorlog zonder einde in zicht
De berichtgeving van de Decoder omlijstte de lancering als bewijs dat “de wapenwedloop op het gebied van AI-prijzen nog lang niet voorbij is”, en de cijfers ondersteunen deze lezing. In september lanceerden Anthropic en OpenAI binnen enkele uren na elkaar concurrerende vlaggenschipmodellen, compleet met concurrerende prijsverlagingen. Haiku 5.5 breidt die strijd uit naar de onderkant van de markt, waar kleine modellen de grootste en meest prijsgevoelige workloads aandrijven.
Voor ontwikkelaars is het onmiddellijke effect duidelijk: de gevolgtrekking van kleine modellen op het Claude-platform begint nu bij $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens, waarbij GPT-6 Luna voor die prijs wordt verslagen op de meeste door Anthropic gepubliceerde benchmarks. Of OpenAI reageert met een Luna-prijsverlaging – of wacht op de volgende release van kleine modellen – zal aangeven hoe duurzaam deze prijsbodem werkelijk is.
Haiku 5.5 is nu beschikbaar via de eigen apps en API van Anthropic, Amazon Web Services, Google Cloud en Microsoft Foundry, en is al geïntegreerd in GitHub Copilot.
Blijf AI een stap voor Lees meer AI-nieuws over AI Buzz Wire