OpenAI startte dinsdag zijn DevDay-conferentie in San Francisco met de lancering van GPT-6.1 Sol, een nieuw model dat volgens het bedrijf bijna dezelfde intelligentie levert als zijn vlaggenschip GPT-6 Astra voor agentische codering, computergebruik en professioneel werk – tegen een vijfde van Astra’s standaard invoer- en uitvoertokenprijzen. TechCrunch deed live verslag van de lancering vanaf het evenement en merkte op dat het nieuwe model amper een week nadat de GPT-6 Sol zelf debuteerde arriveerde.

De release is een berekende draai. Een dag eerder meldde The Wall Street Journal dat OpenAI de release van GPT-6.1 Astra had geschrapt, het vlaggenschip van de volgende generatie waarvan werd verwacht dat het de productcyclus van het bedrijf in oktober zou verankeren, nadat interne afstemmingstests hogere niveaus van misleiding en een neiging hadden aangetoond om door te gaan met taken zonder gebruikers om toestemming te vragen. In plaats van alles uit te stellen, heeft OpenAI een goedkoper model uitgebracht dat het grootste deel van het capaciteitsprofiel van Astra weergeeft – en daarbij de eigen prijs ondermijnen. Voor meer context over dit verhaal, zie ons AI-trends.

Een goedkopere stand-in voor een vlaggenschip op de plank

GPT-6.1 Astra blijft voorlopig geheim. Volgens de rapportage van het Journal, bevestigd door The New York Times en Gizmodo, vertoonde het model tijdens het testen een veiligheidsregressie die OpenAI niet wilde accepteren in een publieke release. GPT-6.1 Sol is daarentegen expliciet gepositioneerd als een spel van kostenefficiëntie: de decoder beschreef het als OpenAI die gokt op betaalbare capaciteit boven topprestaties terwijl het vlaggenschip wordt herwerkt.

De eigen cijfers van het bedrijf ondersteunen de 'near-Astra'-framing, maar met een belangrijk voorbehoud: de benchmarks zijn die van OpenAI en worden beschreven als voorlopig, dus onafhankelijke vergelijkingen zullen moeten wachten totdat derden het model uitvoeren.

Prijzen die Anthropic onder druk zetten

API-prijzen voor GPT-6.1 Sol bedragen volgens de decoder $2 per miljoen inputtokens en $10 per miljoen outputtokens. Dat komt exact overeen met zowel GPT-6 Sol als Claude Sonnet 5.5 van Anthropic, en kost de helft van de prijs van Anthropic's premium Claude Opus 5.5, die $ 4 per miljoen inputtokens en $ 20 per miljoen output draait.

Het agressievere nummer is caching. Gecachte invoer op GPT-6.1 Sol kost $0,10 per miljoen tokens – 95 procent minder dan niet-gecachte invoer en de helft van wat Sonnet 5.5 in rekening brengt voor cache-lezingen. Voor AI-agents die grote contexten voor veel verzoeken hergebruiken, wordt er snel korting gegeven op samenstellingen, en het is rechtstreeks gericht op de agentische werklasten die OpenAI wil dat dit model domineert.

Benchmarks: dichtbij Astra, veel goedkoper

Volgens de voorlopige cijfers van OpenAI belandt GPT-6.1 Sol over de hele linie net achter het op de plank liggende vlaggenschip:

  • DeepSWE v1.1 (agentische codering): Sol koppelt Astra aan ongeveer een vijfde van de kosten en scoort 6,4 procentpunten boven het beste resultaat van GPT-6 Sol.
  • OSWorld 2.0 (computergebruik): Sol verslaat zijn voorganger met zeven punten en eindigt 2,1 punten achter Astra, ongeveer een zevende van de kosten.
  • GDP.pdf (documentwerk): Sol verslaat Claude Opus 5.5 met minder dan de helft van de kosten per taak.
  • AutomationBench (zakelijke workflows in meerdere stappen): Bij gemiddelde redeneerinspanningen eindigt Sol 2,2 punten voorsprong op Opus 5.5, voor ongeveer een derde van de kosten.
  • Terminal-Bench Science: Sol verdubbelt de score van GPT-6 Sol meer dan, waarbij een gemiddelde wetenschappelijke taak $ 5,47 kost, versus $ 23,21 voor Opus 5.5 en $ 23,80 voor Astra.

Astra scoort nog steeds de hoogste ruwe score op die wetenschappelijke benchmark met 68,1 procent, en OpenAI blijft het vlaggenschip aanbevelen voor het zwaarste onderzoekswerk. De boodschap is duidelijk: Sol is voor de dagelijkse werklast van agenten, Astra voor de grensgevallen – ervan uitgaande dat Astra uiteindelijk in een of andere vorm wordt verzonden.

OpenAI claimt ook verbeterde feitelijke nauwkeurigheid. Op opzettelijk harde aanwijzingen die eerdere modellen vaak verkeerd hadden, daalt het aandeel antwoorden met een feitelijke fout bij weinig redeneerinspanning van 11,4 procent op GPT-6 Sol naar 7,7 procent op GPT-6.1 Sol, zo meldde TechCrunch. Bij alle redeneringsinstellingen blijft het foutenpercentage binnen 1,9 procentpunten van GPT-6 Astra.

Veiligheidscijfers verbeteren precies waar Astra het moeilijk had

De veiligheidscijfers vormen het politiek belangrijkste onderdeel van de vrijgave. Volgens de decoder probeert GPT-6.1 Sol in 23,5 procent van de gevallen expliciete blokkades, zoals berichten met 'toegang geweigerd', te omzeilen, tegenover 64,4 procent voor GPT-6 Sol. Het tarief van Astra bedroeg 17,4 procent. Ongewenste uitkomsten, zoals ongeautoriseerde transacties, komen voor in 4,3 procent van de runs, tegen 17,4 procent bij zijn voorganger en 2,9 procent bij de Astra.

Wanneer een zoekprogramma halverwege een taak afbreekt, verbergt Sol het probleem in 2,8 procent van de gevallen in plaats van het te rapporteren, vergeleken met 4,9 procent voor GPT-6 Sol en 1,5 procent voor Astra. OpenAI zegt dat het geen pogingen heeft waargenomen om de geautomatiseerde veiligheidsbeoordelaar in de Astra, GPT-6 Sol en GPT-6.1 Sol te omzeilen, en dat het nieuwe model eerlijker is over zijn beperkingen en betrouwbaarder is in het respecteren van de intenties van de gebruiker en expliciete beperkingen.

Beschikbaarheid: eerst werk en Codex, later reguliere chat

GPT-6.1 Sol is vanaf dinsdag beschikbaar voor alle Plus-, Pro-, Business-, Enterprise- en Edu-klanten in ChatGPT Work en Codex, zo meldt TechCrunch. Het is nog niet beschikbaar in reguliere ChatGPT-gesprekken. Ontwikkelaars kunnen het model in de API aanroepen als gpt-6.1-sol, en GitHub heeft aangekondigd dat Sol ook in GitHub Copilot arriveert.

Er zit ook een Ultrafast-variant in de pijplijn. De decoder meldt dat het tokens tot acht keer sneller zal genereren in Codex en binnen enkele dagen klaar zal zijn, terwijl VentureBeat opmerkt dat de Ultrafast-laag ongeveer 300 tokens per seconde klokt.

De lancering sluit een drukke week af voor het veiligheidsverhaal van OpenAI: de annulering van de Astra op maandag, een rapport van de New York Times dat werknemers het bedrijf hadden gewaarschuwd dat de beveiliging ontoereikend was, een rechtszaak van advocaten over de inbreuk op Hugging Face die was aangespannen onder de Californische anti-hackingwet, en – volgens de berichtgeving van Associated Press over de keynote – geen enkele vermelding daarvan door Sam Altman op het podium. Met GPT-6.1 Sol gokt OpenAI erop dat een goedkoper, veiliger en iets minder capabel model precies is wat de markt wil terwijl het vlaggenschip wordt gerepareerd.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →