Wie Reuters am Freitag berichtete, hat OpenAI die Entwicklerpreise für sein Spitzenmodell GPT-5.6 Sol um mehr als 20 % gesenkt und damit den monatelangen Widerstand beendet, da Konkurrenten die Prämie des Flaggschiffs aufgeben. Laut der offiziellen Preisseite des Unternehmens senkt der Schritt das leistungsfähigste Modell von OpenAI auf 4 US-Dollar pro Million Input-Tokens und 20 US-Dollar pro Million Output-Tokens auf der Standardstufe – ein deutlicher Rückgang gegenüber den 5 US-Dollar Input- und 30 US-Dollar Output-Raten, die Sol seit seiner Einführung hatte. Es ist das bislang deutlichste Signal dafür, dass der KI-Preiskampf die Spitze des Modellstapels erreicht hat, eine Verschiebung, die wir in unserer [Berichterstattung über die Ökonomie der KI-Branche] (https://aibuzzwire.news) verfolgt haben.
Die Zahlen hinter dem Schnitt
Die neuen aufgeführten Preise in der Plattformdokumentation von OpenAI zeigen, dass GPT-5.6 Sol 4,00 US-Dollar pro Million Eingabe-Tokens, 0,40 US-Dollar für zwischengespeicherte Eingaben, 5,00 US-Dollar für Cache-Schreibvorgänge und 20,00 US-Dollar pro Million Ausgabe-Tokens für Kurzkontext-Anfragen kostet. Langkontextanfragen kosten jetzt 8,00 $ Eingabe und 30,00 $ Ausgabe. Das entspricht einer Reduzierung des Inputs um 20 % und einer Reduzierung des Outputs um 33 % im Vergleich zu den Einführungspreisen des Modells von 5 und 30 US-Dollar.
OpenAI bietet außerdem Aktionspreise für Sol mit einem Input von 2,00 $ und einem Output von 10,00 $ an – die Hälfte des neuen Standardtarifs –, der nach Angaben des Unternehmens mindestens bis zum 21. November 2026 verfügbar ist. Die Batch- und Flex-Stufen sinken sogar noch weiter und beginnen bei 2,00 $ Input und 10,00 $ Output für eine flexible Planung.
Ein Flaggschiff, das durchgehalten hat – bis jetzt
Der Schnitt kehrt eine bewusste Strategie um. Als OpenAI am 30. Juli die Preise für die gesamte GPT-5.6-Familie senkte, kürzte es das kleine Luna-Modell um 80 % auf 0,20 US-Dollar Input und 1,20 US-Dollar Output und kürzte das Mittelklassemodell Terra um 20 % auf 2 US-Dollar und 12 US-Dollar – Sol blieb jedoch unberührt, da die Leistungsfähigkeit des Flaggschiffs die Grenzpreisgestaltung rechtfertigte.
Drei Wochen Marktdruck scheinen die Rechnung geändert zu haben. Claude Opus 5 von Anthropic kostet 5 US-Dollar Input und 25 US-Dollar Output und liegt damit unter Sols altem 30 US-Dollar Output-Preis, während Claude Sonnet 5 bis zum 31. August zu einem Einführungspreis von 2 US-Dollar und 10 US-Dollar Output erhältlich ist, bevor er auf 3 US-Dollar und 15 US-Dollar umsteigt. Chinesische Labore unterbieten beides: Der V4 Pro 0813 von DeepSeek wird mit etwa 0,435 US-Dollar Input und 0,87 US-Dollar Output pro Million Token über Routing-Plattformen gelistet, und Kimi K3 von Moonshot AI mit 2,80 US-Dollar und 14 US-Dollar.
Developers Route, They Don't Marry
Für Entwicklungsteams ist die Modellpreisgestaltung zu einer Routing-Entscheidung geworden. Ein typischer Enterprise-Stack sendet möglicherweise die anspruchsvollsten Codierungs- und Argumentationsarbeiten an ein Grenzmodell, Routineaufgaben an ein Mittelschichtmodell und repetitive Aufgaben mit hohem Volumen an die kostengünstigste Option. Wenn die Ausgabetoken des Flaggschiffs 30-mal mehr kosten als die eines glaubwürdigen Konkurrenten, fragen sich die Finanzteams, welche Anfragen wirklich die Prämie verdienen.
Die Verhaltensänderung ist bereits sichtbar. Fortune berichtete im Juli, dass Andy Fang, Mitbegründer und CTO von DoorDash, sagte, Moonshot AI biete „bessere Qualität“ zu „günstigeren Kosten“ für eines der KI-Experimente des Unternehmens, und dass Airbnb und Siemens chinesische Anbieter wie Alibaba und DeepSeek testeten, als die KI-Rechnungen in die Höhe schossen.
Reuters brachte die Kürzung vom Freitag mit diesem Wettbewerbsdruck in Verbindung und stellte fest, dass OpenAI daran arbeitet, die Entwickler an seiner Plattform zu binden, während Konkurrenten – darunter Anthropic, das einen Blockbuster-Börsengang vorbereitet – aus allen Richtungen drängen. OpenAI hat nach den Preissenkungen im Juli Anfang des Sommers die Marke von einer Milliarde Nutzer erreicht, und das Unternehmen hat argumentiert, dass die Inferenzkosten jetzt eine Produktstrategie und nicht mehr Backoffice-Klammern sind, und führt besseres Hardware-Routing, verbesserte Inferenzsoftware und intelligenteres Kontext-Caching für seine Fähigkeit, die Preise zu senken, an.
Was es für den Markt bedeutet
Für OpenAI schützt die Sol-Kürzung den Burggraben dort, wo er am dünnsten ist: Entwickler-Workloads, die mit einer Konfigurationsänderung zwischen APIs verschoben werden können. Die Aktionsstufe bis November versteht sich als aggressives Aufbewahrungsinstrument, das auf den Bewertungszyklus abzielt, den Unternehmen durchlaufen, bevor sie Produktionsdatenverkehr festlegen.
Für den breiteren Markt signalisieren ein Konkurrent unter 1 US-Dollar, eine Mid-Frontier-Option für 14 US-Dollar und ein Flaggschiff für jetzt 20 US-Dollar, dass die Token-Preise schneller fallen, als die meisten Prognosen für 2025 erwartet haben – selbst wenn die Schulungskosten für Grenzmodelle in die Höhe schnellen. Labore subventionieren faktisch Schlussfolgerungen, um den Anteil am Ökosystem zu verteidigen, eine Dynamik, die die Unternehmen mit den größten Taschen und der größten Verbreitung begünstigt.
Die Reaktion von Anthropic wird genau beobachtet. Da sein Börsengang laut The New York Times eine Kapitalerhöhung von bis zu 100 Milliarden US-Dollar anstrebt, hat das Unternehmen allen Grund, seinen Preisvorteil sichtbar zu halten. Google, Meta und die chinesischen Labore müssen jeweils ihre eigenen Kürzungen berücksichtigen.
Für Entwickler ist der Rat einfach: Die Preise ändern sich wöchentlich und die Rechnung, die Sie letzten Monat budgetiert haben, ist bereits veraltet. Sich an die Preisliste eines einzelnen Anbieters zu binden, ist mittlerweile ein Risiko für sich. Routing-Schichten, die den Datenverkehr zwischen Modellen verlagern können, wenn sich die Preise ändern, sind zur Standard-Infrastruktur geworden, ein Trend, der durch die Übernahme von OpenRouter durch Stripe in dieser Woche noch beschleunigt wurde.
Bleiben Sie der KI immer einen Schritt voraus
Modellpreise, Veröffentlichungen und Benchmark-Kriege bewegen sich in rasender Geschwindigkeit. AI Buzz Wire liefert täglich verifizierte KI-Nachrichten – genaue Zahlen, echte Quellen, kein Hype.
Weitere Neuigkeiten zum KI-Modell lesen →