OpenAI ilitoa GPT-6.1 Sol mnamo Septemba 29, na kuacha GPT-6 Sol siku saba tu baada ya kuanza kwa mtindo huo, kulingana na Uchambuzi Bandia wa kampuni huru. Mabadilishano hayo yaliambatana na mkutano wa wasanidi programu wa DevDay wa kampuni, ambapo CNET iliripoti kuwa waliohudhuria wanaweza kuanza kutumia GPT-6.1 Sol mara moja pamoja na mawakala wapya wa Dots waliozinduliwa na seti ya mabadiliko ya usajili.

Ubadilishaji wa bendera kwa siku saba sio kawaida hata kulingana na viwango vilivyoharakishwa vya 2026, na vigezo vinapendekeza kwa nini OpenAI ilisonga haraka. Kwa utangazaji unaoendelea wa uzinduzi wa miundo, mapigano ya viwango, na vita vya bei chini yao, AI Buzz Wire hufuatilia maendeleo muhimu kadri yanavyotokea.

Rukia inayoweza kupimika ndani ya siku saba

Uchanganuzi Bandia unaripoti kuwa GPT-6.1 Sol inapata pointi 4 kwenye Kielezo cha Upelelezi cha kampuni hiyo zaidi ya GPT-6 Sol, na pointi 5 zaidi ya GPT-5.6 Sol, ikitua kwa pointi 1 tu chini ya GPT-6 Astra, muundo wenye uwezo zaidi wa OpenAI. Tathmini ya kampuni inachanganya hoja, kazi ya maarifa, hesabu na kazi za kiakala kuwa alama moja linganishi.

Alama ndogo zinaonyesha ambapo faida huzingatia. GPT-6.1 Sol iliboresha pointi 4 katika AA-Briefcase v1.1 na pointi 5 katika GDPval-AA v2.1, zote mbili ambazo hujaribu maarifa ya kikali. Kuruka kwa pointi 12 katika Terminal-Bench 4.0 kunaonyesha utendakazi bora zaidi katika mazingira halisi ya wastaafu, huku Mtihani wa Mwisho wa Humanity ukipanda pointi 5 na GDP.pdf ilipanda 6.

Nambari moja inatosha kwa mtu yeyote anayetumia miundo ya utafiti: usahihi kwenye AA-Omniscience ilipanda pointi 8 huku kiwango cha kuona macho kilishuka kutoka asilimia 60 hadi asilimia 54. Nambari zote mbili zinasalia kuwa za juu katika hali kamili, lakini mwelekeo wa mambo ya kusafiri kwa mtiririko wa kazi ambapo jibu lisilo sahihi ni mbaya zaidi kuliko kutokuwa na jibu.

Bei sawa ya vibandiko, nafuu kiutendaji

Kwenye bei, GPT-6.1 Sol huhifadhi kadi ya kiwango cha GPT-6 Sol ya $2 kwa kila tokeni za pembejeo milioni na $10 kwa kila tokeni za pato milioni, lakini punguzo la akiba linalosomwa hupanda kutoka asilimia 90 hadi 95. Uchanganuzi Bandia unabainisha kuwa bei iliyochanganywa ya GPT-6.1 Sol ya mzigo wa kazi wa mawakala kwa hiyo ni ya chini kidogo kuliko GPT-6 Sol's, ikiendeleza mfululizo wa kupunguza bei bora ulioanza GPT-6 Sol ilipozinduliwa kwa punguzo la asilimia 50 hadi GPT-5.6 Sol.

Njia ya bei ni hadithi ya kweli hapa. Ndani ya muda wa matoleo mawili, OpenAI imepunguza takriban nusu ya gharama madhubuti ya mstari wa mpaka wa daraja la kati mara mbili, huku ikiinua ubora kwenda juu kila wakati.

Gharama kwa kila kazi: $0.72 dhidi ya $3.26

Gharama kwa kila kazi ni pale pengo na GPT-6 Astra inakuwa kali. Kwa juhudi kubwa zaidi, Uchambuzi Bandia huweka GPT-6.1 Sol kwa $0.72 kwa kila kazi ya Kielezo cha Ujasusi, chini ya robo ya $3.26 ya GPT-6 Astra. Dhidi ya mtangulizi wake akiba ni asilimia 31 ($1.05 kwa GPT-6 Sol), na dhidi ya GPT-5.6 Sol wanafikia asilimia 64 ($1.99).

Kulingana na kampuni hiyo, kila kiwango cha juhudi cha GPT-6.1 Sol huondoa mpaka wa Pareto wa gharama nafuu - kumaanisha kuwa kwa kiwango fulani cha akili, hakuna chaguo nafuu zaidi kati ya miundo inayofuata. Picha ya utendakazi wa tokeni imechanganyika zaidi: GPT-6.1 Sol hutumia takriban asilimia 10 hadi 30 ya tokeni zaidi kuliko GPT-6 Sol katika viwango vya juhudi, ingawa mipangilio yake ya chini na ya kati inasalia kuwa Pareto-bora kwa ufanisi wa tokeni mara tu akili ya juu inapowekwa alama. Katika usimbaji, muundo ulipata pointi 3 zaidi ya GPT-6 Sol ya Coding A Index kwenye max firm's Index.

Kwa nini mabadiliko ya siku saba ni muhimu

Slate pana ya DevDay inaimarisha picha sawa. Ripoti ya CNET iliandaa mkutano kuhusu mambo matatu ambayo wasanidi wanaweza kutumia mara moja - GPT-6.1 Sol, mawakala wa Dots, na mipango ya usajili iliyofanyiwa kazi upya - badala ya hakikisho la mbali la utafiti. Ujumbe kwa wasanidi programu ulikuwa upatikanaji leo, hauwezekani kesho.

Bendera inapunguza ishara hii fupi kwamba kikwazo cha ushindani kimehama kutoka kukimbia kwa mafunzo hadi uboreshaji wa baada ya mafunzo na miundombinu ya huduma. Uboreshaji wa kiwango cha uhakika ambao husafirishwa kwa wiki moja unaonekana zaidi kama kituo cha ukaguzi kilichoboreshwa na karatasi mpya ya bei kuliko muundo wa msingi kutoka mwanzo, na wapinzani wanatenda vivyo hivyo: Google ilitangaza Gemini 4 Argon mnamo Septemba 30, muundo wa mipaka ambao mwanzoni unawafikia watetezi wa mtandao wanaoaminika kupitia Mpango wake wa Fairwind kwa kiwango sawa cha $2/$10 kwa kila milioni.

Kwa wasanidi programu, vidokezo vitatu vya vitendo vinafuata kutoka kwa nambari zilizothibitishwa. Kwanza, mzigo wa kazi wa mawakala wenye utumiaji tena wa akiba nzito hufaidika mara moja kutoka kwa punguzo la asilimia 95 la akiba. Pili, bajeti zinapaswa kuiga matumizi ya tokeni ya juu zaidi kabla ya kuhama, kwa kuwa bei ya kila ishara haibadilishwi hata modeli inapofikiria kwa muda mrefu. Tatu, Astra inasalia kuwa dari kwa kazi ambapo hatua ya mwisho ya akili inastahili malipo ya gharama ya mara 4 - kesi ya GPT-6.1 Sol ni kwamba kwa kazi nyingi, sivyo.

Tahadhari inayostahili kurudiwa: takwimu hizi zinatoka kwa mtathmini mmoja huru, hata hivyo mbinu yake ni kali, na alama za faharasa hulipa michanganyiko mahususi ya mzigo wa kazi. Timu zilizo na mzigo mkubwa wa kazi zinapaswa kufanya tathmini zao wenyewe kabla ya kurekebisha trafiki ya uzalishaji.

---

Kaa Mbele ya AI

Pata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.

Soma habari zaidi za AI →