OpenAI vydala GPT-6.1 Sol 29. září a podle nezávislé srovnávací firmy Artificial Analysis ukončí provoz GPT-6 Sol pouhých sedm dní po debutu tohoto modelu. Výměna se shodovala s vývojářskou konferencí společnosti DevDay, kde CNET oznámila, že účastníci mohli okamžitě začít používat GPT-6.1 Sol spolu s nově spuštěnými agenty Dots a sadou změn předplatného.
Sedmidenní výměna vlajkové lodi za vlajkovou loď je neobvyklá i ve zrychlených standardech z roku 2026 a benchmarky naznačují, proč se OpenAI rychle posunula. AI Buzz Wire sleduje vývoj, na kterém záleží, průběžně, aby bylo zajištěno nepřetržité pokrytí uvedení modelů na trh, srovnávacích bojů a cenové války pod nimi.
Měřitelný skok za sedm dní
Umělá analýza uvádí, že GPT-6.1 Sol získává 4 body na indexu inteligence firmy oproti GPT-6 Sol a 5 bodů oproti GPT-5.6 Sol, což je jen 1 bod pod GPT-6 Astra, nejschopnějším modelem OpenAI. Firemní hodnocení spojuje uvažování, znalostní práci, matematické a agentské úkoly do jediného srovnávacího skóre.
Dílčí skóre ukazují, kam se soustředí zisky. GPT-6.1 Sol si polepšil o 4 body ve verzi AA-Briefcase v1.1 a o 5 bodů v GDPval-AA v2.1, přičemž obě testují fungování agentních znalostí. 12bodový skok v Terminal-Bench 4.0 bodů k podstatně lepšímu výkonu v reálných terminálových prostředích, zatímco Humanity's Last Exam vzrostl o 5 bodů a GDP.pdf vzrostl o 6.
Jedno číslo vyniká pro každého, kdo používá modely pro výzkum: přesnost na AA-Omniscience se vyšplhala o 8 bodů, zatímco míra halucinací klesla z 60 procent na 54 procent. Obě čísla zůstávají v absolutních číslech vysoká, ale směr cesty je důležitý pro pracovní postupy, kde je sebevědomá špatná odpověď horší než žádná.
Stejná cena nálepky, v praxi levnější
Pokud jde o ceny, GPT-6.1 Sol si ponechává ceník GPT-6 Sol ve výši 2 $ za milion vstupních tokenů a 10 $ za milion výstupních tokenů, ale sleva na čtení mezipaměti se zvyšuje z 90 procent na 95 procent. Umělá analýza poznamenává, že kombinovaná cena GPT-6.1 Sol pro agentní pracovní zátěže je proto o něco nižší než cena GPT-6 Sol, což rozšiřuje řadu efektivních snížení cen, která začala, když byl GPT-6 Sol uveden na trh s 50procentní slevou na GPT-5.6 Sol.
Cenová trajektorie je zde skutečným příběhem. V rozmezí dvou verzí OpenAI dvakrát snížila efektivní náklady své střední řady zhruba na polovinu, přičemž pokaždé posunula kvalitu nahoru.
Cena za úkol: 0,72 USD oproti 3,26 USD
Cena za úkol je místo, kde se mezera s GPT-6 Astra stává výraznou. Při maximálním úsilí umělá analýza nastaví GPT-6.1 Sol na 0,72 USD za úlohu Intelligence Index, což je méně než čtvrtina 3,26 USD u GPT-6 Astra. Oproti vlastnímu předchůdci jsou úspory 31 procent (1,05 $ za GPT-6 Sol) a oproti GPT-5,6 Sol dosahují 64 procent (1,99 $).
Podle firmy každá úroveň úsilí GPT-6.1 Sol posouvá Paretovu hranici nákladové efektivity – což znamená, že pro danou úroveň inteligence neexistuje mezi sledovanými modely žádná levnější varianta. Obraz efektivity tokenů je smíšenější: GPT-6.1 Sol spotřebuje zhruba o 10 až 30 procent více výstupních tokenů než GPT-6 Sol napříč úrovněmi úsilí, i když jeho nastavení nízkého a středního úsilí zůstává Pareto-optimální pro efektivitu tokenu, jakmile je započítána vyšší inteligence. V kódování získal model 3 body oproti GPT-6 Sol při maximálním úsilí agenta firmy.
Proč na sedmidenním obratu záleží
Širší panel DevDay posiluje stejný obraz. Zpráva CNET zarámovala konferenci kolem tří věcí, které by vývojáři mohli okamžitě použít – GPT-6.1 Sol, agenti Dots a přepracované plány předplatného – spíše než vzdálený náhled na výzkum. Zpráva vývojářům byla dostupnost dnes, nikoli možnost zítra.
Vlajková loď kadence vysílá tento krátký signál, že konkurenční omezení se přesunulo z tréninkových běhů na zdokonalování po tréninku a obsluhu infrastruktury. Upgrade na úrovni bodu, který bude odeslán za týden, vypadá spíše jako optimalizovaný kontrolní bod a nový ceník než model od nuly a soupeři se chovají stejně: 30. září Google oznámil Gemini 4 Argon, hraniční model, který zpočátku oslovuje důvěryhodné kybernetické obránce prostřednictvím programu Fairwind za stejnou sazbu 2 $ / 10 $ za milion tokenů.
Pro vývojáře vyplývají z ověřených čísel tři praktické poznatky. Za prvé, agentní pracovní zátěže s velkým opakovaným používáním mezipaměti okamžitě těží z 95procentní slevy na mezipaměť. Za druhé, rozpočty by měly před migrací modelovat vyšší spotřebu výstupního tokenu, protože cena za token se nemění, i když model uvažuje déle. Za třetí, Astra zůstává stropem pro úkoly, kde poslední bod inteligence stojí za 4x vyšší cenu – případ GPT-6.1 Sol je takový, že u většiny práce tomu tak není.
Upozornění, které stojí za to zopakovat: tato čísla pocházejí od jediného nezávislého hodnotitele, jakkoli je jeho metodika přísná, a indexové skóre odměňuje specifické kombinace pracovního zatížení. Týmy s náročným pracovním zatížením by měly před přesměrováním produkčního provozu znovu provést svá vlastní hodnocení.
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →