Anthropic veröffentlichte am Dienstag Claude Haiku 5.5 und beschrieb es als „das günstigste, schnellste und leistungsfähigste kleine Modell, das wir je herausgebracht haben“. Der Start geht mit einer starken zweistufigen Preissenkung einher, die die Eingabekosten für die meisten Anfragen auf 0,10 US-Dollar pro Million Token senkt. Dieser Schritt übt direkten Druck auf OpenAIs GPT-6 Luna im Kleinmodellsegment aus und verlängert einen monatelangen Preiskampf in der gesamten KI-Branche.
Die Ankündigung, die am 7. Oktober 2026 auf der Website von Anthropic veröffentlicht wurde, positioniert Haiku 5.5 neben Sonnet 5.5 und Opus 5.5 als drittes Modell in der Claude 5.5-Familie. Reuters bezeichnete die Veröffentlichung als eine Erweiterung seiner Modellpalette durch Anthropic im Zuge der Vorbereitungen für einen geplanten Börsengang. Das Modell sei bereits in GitHub Copilot, Amazon Web Services, Google Cloud und Microsoft Foundry verfügbar. Der Start ist der neueste Eintrag in einem Monat mit aktuellen KI-Nachrichten, in dem es fast täglich zu Modellveröffentlichungen, Preissenkungen und politischen Maßnahmen kam.
Ein kleines Modell für großvolumige Arbeiten
Laut Anthropic ist Claude Haiku 5.5 eher für großvolumige, kostensensible Aufgaben als für Grenzüberlegungen konzipiert. Das Unternehmen gibt an, dass es „schnelle und sich wiederholende Arbeitslasten“ wie Zusammenfassungen, Komprimierung, Datenbankabfragen und Klassifizierungsanfragen „zuverlässig bewältigt“.
Anthropic positioniert das neue Modell auch als Begleiter seiner größeren Systeme: Haiku 5.5 „passt gut mit Opus 5.5 und Sonnet 5.5 als Subagent für Codierungsarbeiten“, sodass Entwickler kostengünstige, schnelle Unteraufgaben an Haiku weiterleiten können, während größere Modelle für komplexe Überlegungen reserviert sind. Da es das bisher schnellste Modell von Anthropic mit Standardgeschwindigkeit ist, empfiehlt das Unternehmen es für latenzempfindliche Anwendungen wie Live-Kundensupport und Browsernutzung. Eine Fußnote fügt einen Vorbehalt hinzu: Die Opus-Modelle von Anthropic laufen im Schnellmodus immer noch schneller.
Preise: Bis zu 90 % günstiger als Haiku 4.5
Die wichtigste Änderung betrifft den Preis. Laut Anthropic kostet der Betrieb von Haiku 5.5 im Durchschnitt etwa 75 % weniger als Haiku 4.5, mit einer abgestuften Struktur, die von der Größe der Eingabeaufforderung abhängt.
Für Anfragen mit Eingabeaufforderungen bis zu 100.000 Token – was laut Anthropic etwa 90 % der Anfragen an das vorherige Haiku-Modell ausmachte – sind die Preise 90 % niedriger als bei Haiku 4.5. Eingabeaufforderungen über 100.000 Token kosten 50 % weniger.
Die Preistabelle pro Million Token aus der Ankündigung von Anthropic zeigt das Ausmaß der Kürzung:
- Eingabe-Tokens: 0,10 $ (Aufforderungen bis zu 100.000) oder 0,50 $ (über 100.000), gegenüber der Pauschalsumme von 1,00 $ für Haiku 4.5
- Ausgabe-Token: 0,50 $ oder 2,50 $, statt 5,00 $
- Cache lautet: 0,01 $ oder 0,05 $, statt 0,10 $
- Cache schreibt: 0,125 $ oder 0,625 $, gegenüber 1,25 $
Auf der Stufe unter 100.000 beträgt der Ausgabepreis von Haiku 5.5 ein Fünftel des Ausgabepreises von Sonnet 5.5 in Höhe von 10,00 US-Dollar pro Million Ausgabetoken.
Anthropic weist auf ein technisches Detail hinter den Zahlen hin: Haiku 5.5 verwendet einen aktualisierten Tokenizer, ähnlich wie Sonnet 5.5 und Opus 5.5, was bedeutet, dass pro Aufgabe etwas mehr Token verwendet werden als bei Haiku 4.5. Das Unternehmen gibt an, dass seine Durchschnittskostenberechnung diesen Unterschied berücksichtigt.
Benchmarks: In den meisten Zeilen vor GPT-6 Luna
Anthropic hat eine Benchmark-Tabelle veröffentlicht, in der Haiku 5.5 mit Haiku 4.5, GPT-6 Luna und Sonnet 5.5 verglichen wird. In den meisten der aufgeführten Bewertungen liegt das neue Modell vor Luna und deutlich vor seinem Vorgänger:
- GDPval-AA v2.1 (Wissensarbeit): 1620 für Haiku 5.5, gegenüber 735 für Haiku 4.5, 1437 für GPT-6 Luna und 1840 für Sonnet 5.5
- AA-Briefcase v1.1: 1578, gegenüber 614 für Haiku 4.5 und 1336 für Luna
- OSWorld 2.1, Offline-Teilmenge (Computernutzung): 72,4 %, gegenüber 15,7 % für Haiku 4.5, 48,9 % für Luna und 83,9 % für Sonnet 5.5
- Die letzte Prüfung der Menschheit: 45,9 % ohne Werkzeuge und 57,4 % mit Werkzeugen, gegenüber 10,2 % und 18,7 % für Haiku 4.5
- Terminal-Bench 4.0 (agentische Codierung): 39,2 %, gegenüber 16,4 % für Luna und 70,6 % für Sonnet 5.5
- FrontierCode 1.1, Main: 46,4 %, vor Lunas 42,4 %
Das Muster ist konsistent: Haiku 5.5 schließt einen Großteil der Lücke zu GPT-6 Luna und schlägt es bei der Computernutzung deutlich, während Anthropics eigenes Sonnet 5.5 immer noch in jeder Kategorie anführt. Die Leitlinien von Anthropic spiegeln diese Hierarchie wider – das Unternehmen sagt, dass Sonnet 5.5 und Opus 5.5 „nach wie vor die bessere Wahl für komplexe Agenten-Codierungsaufgaben bleiben, wie sie von Terminal-Bench 4.0 gemessen werden“, während Haiku 5.5 auf eng begrenzte Arbeiten abzielt, die „ansonsten mit früheren Versionen von Claude möglicherweise zu teuer gewesen wären“.
Erstes Haiku mit Mühe
Haiku 5.5 ist außerdem das erste Modell der Haiku-Klasse, das mit einer einstellbaren Leistungseinstellung ausgeliefert wird, der Kosten-Intelligenz-Kontrolle, die Anthropic zuvor bei seinen größeren Modellen bot. Benutzer können wählen, wie viel Rechenleistung jede Anfrage verbraucht, und die Diagramme von Anthropic zeigen Benchmark-Ergebnisse für jede Aufwandsstufe von niedrig bis maximal.
Sicherheitshaltung: Enger als Haiku 4.5, lockerer als Sonett
In Bezug auf die Sicherheit weist Anthropic darauf hin, dass Haiku 5.5 „bei fast allen unserer Ausrichtungsbewertungen im Vergleich zu Haiku 4.5 erhebliche Verbesserungen aufweist“, mit weitaus weniger Fällen von Fehlverhalten und einer geringeren Bereitschaft, bei Missbrauch zu kooperieren.
Die Cybersicherheitsmaßnahmen des Modells sind restriktiver als die des Haiku 4.5, wenn auch etwas weniger restriktiv als die der jüngsten größeren Modelle von Anthropic. Sie ermöglichen ein breiteres Spektrum an defensiven Sicherheitsaufgaben als die Schutzmaßnahmen von Sonnet 5.5, blockieren aber dennoch Penetrationstests und Techniken, die mit größerer Wahrscheinlichkeit von Angreifern eingesetzt werden. Biologische Schutzmaßnahmen entsprechen denen von Sonnet 5, Sonnet 5.5 und Opus 5. Organisationen, die einen breiteren Zugang benötigen, können sich für die Life Sciences- oder Cyber-Verifizierungsprogramme von Anthropic bewerben. Ausführliche Informationen finden Sie in der Haiku 5.5-Systemkarte.
Der Rest der Ankündigung: Billigeres Sonett, kostenlose API-Credits
Der Start war mit mehreren weiteren Änderungen verbunden. Cache-Lesevorgänge auf Claude Sonnet 5.5 kosten jetzt 0,10 US-Dollar pro Million Token statt 0,20 US-Dollar – eine Senkung um 50 %, die laut Anthropic Sonnet 5.5 bei den meisten Agentenarbeiten um etwa 20 % günstiger macht, da Cache-Lesevorgänge den Token-Verbrauch in Agenten-Workflows dominieren.
Anthropic führt diese Woche außerdem monatliche API-Gutschriften für Abonnementkunden ein: 100 US-Dollar pro Monat für Max. 5x-Benutzer, 200 US-Dollar für Max. 20x-Benutzer und bis zu 500 US-Dollar, gebündelt über alle Benutzer hinweg für Team-Pläne, nutzbar auf jedem Modell. Die Credits richten sich an Abonnenten, die Tools und Agenten auf der Claude-Plattform erstellen.
Entwickler erhalten auch SDK-Updates: Die Python- und TypeScript-SDKs von Anthropic unterstützen jetzt die Computernutzung und Browsernutzung in der Beta-Phase, Funktionen, die nach Angaben des Unternehmens zum Geschwindigkeits-Preis-Profil von Haiku 5.5 passen.
Ein Preiskampf ohne Ende in Sicht
In der Berichterstattung des Decoders wurde der Start als Beweis dafür dargestellt, dass „das Wettrüsten um die KI-Preisgestaltung noch lange nicht vorbei ist“, und die Zahlen stützen diese Lesart. Im September brachten Anthropic und OpenAI konkurrierende Flaggschiffmodelle innerhalb weniger Stunden auf den Markt, komplett mit konkurrierenden Preissenkungen. Haiku 5.5 weitet diesen Kampf auf das untere Ende des Marktes aus, wo kleine Modelle die umfangreichsten und preisempfindlichsten Arbeitslasten bewältigen.
Für Entwickler ist der unmittelbare Effekt unkompliziert: Die Inferenz kleiner Modelle auf der Claude-Plattform beginnt jetzt bei 0,10 US-Dollar pro Million Input-Tokens und 0,50 US-Dollar pro Million Output-Tokens, wobei GPT-6 Luna bei den meisten veröffentlichten Benchmarks von Anthropic zu diesem Preis geschlagen wird. Ob OpenAI mit einer Preissenkung für Luna reagiert – oder auf die nächste Veröffentlichung eines kleinen Modells wartet – wird zeigen, wie dauerhaft diese Preisuntergrenze wirklich ist.
Haiku 5.5 ist ab sofort für die Erstanbieter-Apps und APIs von Anthropic, Amazon Web Services, Google Cloud und Microsoft Foundry verfügbar und bereits in GitHub Copilot integriert.
Bleiben Sie der KI immer einen Schritt voraus Lesen Sie weitere KI-Neuigkeiten auf AI Buzz Wire