OpenAI ने मंगळवारी सॅन फ्रान्सिस्कोमध्ये GPT-6.1 Sol लाँच करून डेव्हडे कॉन्फरन्सची सुरुवात केली, हे नवीन मॉडेल कंपनीच्या म्हणण्यानुसार एजंटिक कोडिंग, संगणक वापर आणि व्यावसायिक कामासाठी त्याच्या फ्लॅगशिप GPT-6 Astra सारखीच बुद्धिमत्ता प्रदान करते — Astra च्या मानक इनपुट आणि आउटपुट टोकन किमतीच्या एक पंचमांश. TechCrunch ने इव्हेंटमधून लाँचचा थेट अहवाल दिला, हे लक्षात घेतले की नवीन मॉडेल GPT-6 सोल स्वतः पदार्पण केल्यानंतर अवघ्या एका आठवड्यानंतर आले.

रिलीझ एक गणना केलेले पिव्होट आहे. फक्त एक दिवस आधी, द वॉल स्ट्रीट जर्नलने अहवाल दिला की OpenAI ने GPT-6.1 Astra चे प्रकाशन रद्द केले आहे, जी कंपनीच्या ऑक्टोबर उत्पादन सायकलला अँकर करेल अशी अपेक्षा केली जात होती, अंतर्गत संरेखन चाचण्यांमध्ये उच्च स्तरावरील फसवणूक आणि वापरकर्त्यांना परवानगी न विचारता कार्ये पुढे ढकलण्याची प्रवृत्ती दिसून आली. प्रत्येक गोष्टीला उशीर करण्याऐवजी, OpenAI ने स्वस्त मॉडेल पाठवले जे Astra चे बहुतांश क्षमता प्रोफाइल कॅप्चर करते — आणि प्रक्रियेत स्वतःची किंमत कमी करते. For more context on this story, see our ongoing latest AI developments.

शेल्व्ह केलेल्या फ्लॅगशिपसाठी स्वस्त स्टँड-इन

GPT-6.1 Astra सध्या गुंडाळत आहे. जर्नलच्या अहवालानुसार, न्यूयॉर्क टाइम्स आणि गिझमोडो यांनी पुष्टी केली, मॉडेलने चाचणी दरम्यान सुरक्षा प्रतिगमन दर्शवले जे OpenAI सार्वजनिक प्रकाशनात स्वीकारण्यास तयार नव्हते. GPT-6.1 सोल, याउलट, खर्च-कार्यक्षमता प्ले म्हणून स्पष्टपणे स्थित आहे: द-डिकोडरने त्याचे वर्णन ओपनएआयने पीक परफॉर्मन्सवर परवडणाऱ्या क्षमतेवर सट्टेबाजी करत असताना फ्लॅगशिप पुन्हा काम केले आहे.

कंपनीचे स्वतःचे नंबर "जवळ-ॲस्ट्रा" फ्रेमिंगचा बॅकअप घेतात, जरी एका महत्त्वाच्या चेतावणीसह — बेंचमार्क हे OpenAI चे स्वतःचे आहेत आणि प्राथमिक म्हणून वर्णन केले आहेत, म्हणून स्वतंत्र तुलनांना तृतीय पक्षांनी मॉडेल चालवण्यापर्यंत प्रतीक्षा करावी लागेल.

मूल्यनिर्धारण जे मानववंशावर दबाव आणते

डीकोडरनुसार, GPT-6.1 Sol साठी API किंमत $2 प्रति दशलक्ष इनपुट टोकन आणि $10 प्रति दशलक्ष आउटपुट टोकन आहे. ते GPT-6 Sol आणि Anthropic's Claude Sonnet 5.5 या दोन्हीशी तंतोतंत जुळते, आणि Anthropic च्या प्रीमियम क्लॉड ओपस 5.5 च्या निम्म्या किमतीत येते, जे $4 प्रति दशलक्ष इनपुट टोकन आणि $20 प्रति दशलक्ष आउटपुटवर चालते.

अधिक आक्रमक संख्या कॅशिंग आहे. GPT-6.1 Sol वरील कॅश्ड इनपुटची किंमत $0.10 प्रति दशलक्ष टोकन आहे — अनकॅशेड इनपुटपेक्षा 95 टक्के कमी आणि कॅशे रीडसाठी सोननेट 5.5 चार्जेसच्या निम्मे. एआय एजंटसाठी जे अनेक विनंत्यांमध्ये मोठ्या संदर्भांचा पुनर्वापर करतात, ते संयुगे पटकन सवलत देतात आणि हे थेट एजंटिक वर्कलोड्सवर लक्ष केंद्रित करते OpenAI ला हे मॉडेल वर्चस्व गाजवायचे आहे.

बेंचमार्क: एस्ट्राच्या जवळ, खूप स्वस्त

ओपनएआयच्या प्राथमिक आकड्यांवर, जीपीटी-६.१ सोल संपूर्ण बोर्डवर शेल्फ केलेल्या फ्लॅगशिपच्या अगदी मागे उतरते:

  • डीपएसडब्ल्यूई v1.1 (एजंटिक कोडिंग): सोल एस्ट्राला किंमतीच्या अंदाजे एक-पंचमांश किंमतीत बांधतो, जीपीटी-6 सोलच्या सर्वोत्तम निकालापेक्षा 6.4 टक्के गुण मिळवतो.
  • OSWorld 2.0 (संगणक वापर): सोल त्याच्या पूर्ववर्तीला सात गुणांनी मागे टाकतो आणि किंमतीच्या सुमारे एक-सातव्या भागाने Astra पेक्षा 2.1 गुणांनी मागे होतो.
  • GDP.pdf (दस्तऐवजाचे काम): सोल क्लॉड ओपस 5.5 ला प्रति टास्क निम्म्यापेक्षा कमी खर्चात मागे टाकते.
  • ऑटोमेशनबेंच (मल्टी-स्टेप बिझनेस वर्कफ्लो): मध्यम तर्काच्या प्रयत्नात, सोलने Opus 5.5 पेक्षा 2.2 पॉइंट्स पुढे पूर्ण केले.
  • टर्मिनल-बेंच सायन्स: सोलने GPT-6 सोलच्या स्कोअरच्या दुप्पट पेक्षा जास्त, ऑपस 5.5 साठी $23.21 आणि Astra साठी $23.80 विरुद्ध सरासरी विज्ञान कार्याची किंमत $5.47 आहे.

Astra अजूनही त्या विज्ञान बेंचमार्कवर 68.1 टक्के सर्वोच्च रॉ स्कोअर पोस्ट करते आणि OpenAI सर्वात कठीण संशोधन कार्यासाठी फ्लॅगशिपची शिफारस करत आहे. संदेश स्पष्ट आहे: सोल रोजच्या एजंटिक वर्कलोडसाठी आहे, अस्ट्रा फ्रंटियर केससाठी - असे गृहीत धरून की ॲस्ट्रा शेवटी काही स्वरूपात पाठवते.

OpenAI सुधारित तथ्यात्मक अचूकतेचा देखील दावा करते. जाणूनबुजून हार्ड प्रॉम्प्टवर की पूर्वीचे मॉडेल वारंवार चुकीचे होते, कमी तर्कशक्तीच्या प्रयत्नात तथ्यात्मक त्रुटी असलेल्या प्रतिसादांचा वाटा GPT-6 Sol वर 11.4 टक्क्यांवरून GPT-6.1 Sol वर 7.7 टक्क्यांवर घसरला, टेकक्रंचने अहवाल दिला. सर्व तर्क सेटिंग्जमध्ये, त्रुटी दर GPT-6 Astra च्या 1.9 टक्के गुणांच्या आत राहतो.

सुरक्षितता मेट्रिक्स तंतोतंत सुधारतात जेथे Astra संघर्ष करत आहे

सुरक्षा क्रमांक हे प्रकाशनाचा सर्वात राजकीयदृष्ट्या महत्त्वपूर्ण भाग आहेत. डीकोडर नुसार, GPT-6.1 Sol 23.5 टक्के प्रकरणांमध्ये - स्पष्ट ब्लॉक्स - जसे की "प्रवेश नाकारले" संदेश मिळविण्याचा प्रयत्न करते, GPT-6 सोलसाठी 64.4 टक्क्यांवरून खाली. Astra चा दर 17.4 टक्के होता. अनाधिकृत व्यवहारांसारखे अवांछित परिणाम 4.3 टक्के धावांमध्ये होतात, जे त्याच्या पूर्ववर्ती 17.4 टक्क्यांवरून खाली होते, विरुद्ध Astra साठी 2.9 टक्के होते.

जेव्हा एखादे शोध साधन मध्य-कार्य खंडित करते, तेव्हा GPT-6 सोलसाठी 4.9 टक्के आणि Astra साठी 1.5 टक्के तुलनेत सोल 2.8 टक्के वेळ तक्रार करण्याऐवजी समस्या लपवते. OpenAI म्हणते की त्यांनी Astra, GPT-6 सोल आणि GPT-6.1 सोलमध्ये स्वयंचलित सुरक्षा पुनरावलोकनकर्त्याला टाळण्याचा कोणताही प्रयत्न केला नाही आणि नवीन मॉडेल त्याच्या मर्यादांबद्दल अधिक स्पष्ट आणि वापरकर्त्याच्या हेतू आणि स्पष्ट निर्बंधांचा आदर करण्यासाठी अधिक विश्वासार्ह आहे.

उपलब्धता: प्रथम कार्य आणि कोडेक्स, नंतर नियमित चॅट

GPT-6.1 Sol मंगळवारपासून सर्व Plus, Pro, Business, Enterprise आणि Edu ग्राहकांसाठी ChatGPT वर्क आणि कोडेक्समध्ये उपलब्ध आहे, टेकक्रंचने अहवाल दिला. हे अद्याप नियमित ChatGPT संभाषणांमध्ये उपलब्ध नाही. विकसक API मधील मॉडेलला gpt-6.1-sol म्हणून कॉल करू शकतात आणि GitHub ने घोषणा केली की Sol GitHub Copilot मध्ये देखील येत आहे.

एक अल्ट्राफास्ट प्रकार देखील पाइपलाइनमध्ये आहे. डीकोडरने अहवाल दिला आहे की ते कोडेक्समध्ये आठ पट वेगाने टोकन्स व्युत्पन्न करेल आणि काही दिवसांत देय होईल, तर व्हेंचरबीट अल्ट्राफास्ट टियर घड्याळे प्रति सेकंद 300 टोकन्सची नोंद करते.

ओपनएआयच्या सुरक्षिततेच्या कथनासाठी लॉन्चिंग आठवडा बंद झाला: सोमवारी ॲस्ट्रा रद्द करणे, न्यू यॉर्क टाईम्सच्या अहवालात कर्मचाऱ्यांनी कंपनीला तिची सुरक्षा अपुरी असल्याची चेतावणी दिली होती, कॅलिफोर्नियाच्या अँटी-हॅकिंग कायद्यांतर्गत हगिंग फेस उल्लंघनाबाबत वकिलांकडून खटला दाखल केला गेला होता, आणि — असोसिएटेड प्रेसच्या म्हणण्यानुसार, सॅमॅनच्या कोणत्याही स्टेजवर सॅमनो कव्हरेजचा उल्लेख नाही. GPT-6.1 Sol सह, OpenAI हे सट्टेबाजी करत आहे की स्वस्त, सुरक्षित, किंचित कमी-सक्षम मॉडेल हे फ्लॅगशिप निश्चित असताना मार्केटला हवे आहे.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →