OpenAI ने तीन दोषों को ठीक किया है, जिसमें कहा गया है कि उपयोगकर्ता की एक सप्ताह की शिकायतों से पता चलता है कि GPT-6 एस्ट्रा, इसका नवीनतम फ्रंटियर मॉडल, लॉन्च के बाद से सुस्त हो गया था - और यह एक प्रकार की माफी के रूप में कोडेक्स ग्राहकों के लिए उपयोग की सीमा को रीसेट कर रहा है। शनिवार को प्रकाशित एक अपडेट के अनुसार, यह अपडेट कोडेक्स उत्पाद प्रमुख टिबो सॉटियाक्स की ओर से आया, जिन्होंने कहा कि टीम ने दोषों का पता लगाने के लिए उपयोगकर्ताओं के साथ काम किया, फिर स्थानीय समयानुसार आधी रात से पहले सुधार और पूर्ण उपयोग रीसेट भेज दिया।
यह प्रवेश ओपनएआई द्वारा आज तक के अपने सबसे सक्षम मॉडल के रूप में पेश किए गए एक कठिन दौर को समाप्त करता है। चूंकि एस्ट्रा सितंबर की शुरुआत में व्यापक उपलब्धता तक पहुंच गया था, एक्स पर डेवलपर्स लॉन्च-डे एस्ट्रा और वर्तमान संस्करण के खिलाफ समान संकेत चला रहे थे, हर सेटिंग को समान रखते हुए, और साइड-बाय-साइड तुलना पोस्ट कर रहे थे जो चुपचाप कमजोर मॉडल दिखाते थे। इस बहस को चलाने वाले मॉडलों के बारे में अधिक जानकारी के लिए, हमारा नवीनतम एआई विकास कवरेज देखें।
तीन अवगुण, नामधारी
सॉटियाक्स के अनुसार, पहला दोषी कौशल था - पहले के मॉडलों के लिए लिखी गई शीघ्र फ़ाइलें जो एस्ट्रा के तहत बहुत बार ट्रिगर हो रही थीं, कभी-कभी मॉडल को अपने स्वयं के काम की जांच करने से रोकती थीं। दूसरा एक वैकल्पिक संदर्भ प्रबंधन प्रयोग था जो मॉडल को जल्दी नौकरी छोड़ने या पुराने संदेशों का जवाब देने के लिए मजबूर कर सकता था। कंपनी ने कहा कि लगभग 4,000 से 5,000 उपयोगकर्ताओं के प्रभावित होने के बाद ओपनएआई ने प्रयोग को अक्षम कर दिया।
तीसरे दोष में मॉडल के बजाय बुनियादी ढांचा शामिल था: कुछ अनुमान इंजनों को गलत तरीके से कॉन्फ़िगर किया गया था और उनके माध्यम से आने वाले टेल ट्रैफिक की गुणवत्ता में काफी गिरावट आई थी। OpenAI ने उन इंजनों को हटा दिया और कई छोटी मरम्मतें कीं। सॉटियाक्स ने लिखा है कि मॉडल अब उपयोगकर्ता के नवीनतम संदेश को अधिक सटीक रूप से ट्रैक करता है - उन शिकायतों का संकेत है कि एस्ट्रा उन सवालों का जवाब दे रहा था जिन्हें उपयोगकर्ता पहले ही पार कर चुका था।
डेवलपर्स पहले ही आगे बढ़ चुके थे
सप्ताह भर में शिकायतें बनीं। डेवलपर प्रांजल पालीवाल, जिन्होंने कुछ दिन पहले एस्ट्रा की प्रशंसा की थी, वापस गए और उसके लिए लिखे गए कोड को पढ़ा, फिर परिणाम को प्रगति के बजाय प्रतिगमन कहा। कोडिंग टूल ओपनकोड बनाने वाले डैक्स राड ने एस्ट्रा पर खर्च दोगुना होने के बाद अपनी टीम को पुराने जीपीटी-5.6 सोल में वापस ले लिया, क्योंकि उनके अनुसार यह पैसे के लायक नहीं था। एक फ़ोरम पोस्टर में एस्ट्रा को समान पुनर्प्रयासों के साथ समान कार्यों में सोल के बराबर बताया गया है।
सभी ने उस पाठ को स्वीकार नहीं किया। एंटीकिथेरा नाम से लिखने वाले एक छद्मनाम उपयोगकर्ता ने तर्क दिया कि मॉडल हमेशा आलसी और बुलेट पॉइंट का शौकीन रहा है, और उपयोगकर्ताओं ने चकाचौंध होना बंद कर दिया है। यह असहमति दर्शाती है कि मॉडल-गुणवत्ता के दावों को निपटाना कितना कठिन है: समान संकेत, अलग-अलग फैसले।
पृष्ठभूमि में क्षमता संबंधी परेशानी
गुणवत्ता पंक्ति उतर गई जबकि क्षमता ने रोलआउट को छायांकित कर दिया है। उपयोगकर्ता रिपोर्टों के अनुसार ओपनएआई ने भारी चैटजीपीटी उपयोगकर्ताओं के लिए एस्ट्रा उपयोग सीमा में कटौती की है, और नए $200 प्रो सब्सक्रिप्शन को रोक दिया है - मांग का हवाला देते हुए सोटियाक्स ने 10 सितंबर को एक कदम की पुष्टि की। मॉडल की कीमत अभी भी $10 प्रति मिलियन इनपुट टोकन और $50 प्रति मिलियन आउटपुट टोकन है, जो लॉन्च के समय सोल द्वारा चार्ज किए गए शुल्क का 2.5 गुना है।
एक असुविधाजनक मिसाल भी है: भुगतान करने वाले उपयोगकर्ताओं से समान आरोप प्राप्त करने वाला यह दो महीने में दूसरा ओपनएआई फ्लैगशिप है। जुलाई में, उपयोगकर्ताओं ने कहा कि सोल का शीर्ष तर्क मोड रातों-रात ख़राब हो गया था। सॉटियाक्स ने उस समय जानबूझकर इसे कमजोर करने से इनकार किया, जबकि पुष्टि की कि कंपनी तर्कपूर्ण प्रयास के साथ प्रयोग कर रही थी। "मॉडल खराब हो गया" और उसके बाद "हमें खामियां मिलीं" के बार-बार चक्र एक पैटर्न बन रहे हैं जिसे कंपनी को प्रबंधित करना होगा - पारदर्शिता मदद करती है, लेकिन स्थिरता भी।
OpenAI की अपनी सलाह: कम रेलिंग का उपयोग करें
सुधारों के साथ-साथ, ओपनएआई ने इंजीनियर एरिक प्रोवेन्चर से माइग्रेशन मार्गदर्शन प्रकाशित किया जो एक प्रति-सहज अनुशंसा के बराबर है: अधिक सक्षम मॉडल को कम हाथ से पकड़ने की आवश्यकता होती है। मार्गदर्शन में कहा गया है कि अत्यधिक लंबे कौशल विवरण, व्यापक पढ़ने की आवश्यकताएं और कठोर अनुमोदन नियम एस्ट्रा के रास्ते में आ सकते हैं। समय के साथ ढेर हुए निर्देश संदर्भ को ख़राब कर सकते हैं या मॉडल को बहुत जल्दी काम बंद करने का कारण बन सकते हैं।
प्रोवेन्चर अनुशंसा करता है कि टीमें जब भी मॉडल स्विच करें तो अपने कौशल, AGENTS.md फ़ाइलों और कार्य संकेतों की समीक्षा करें, विशिष्ट कार्यों के लिए निर्देशों को कसकर बांधें, और जब कोई कार्य पूरा हो जाए तो स्पष्ट रूप से परिभाषित करें - क्योंकि प्रतिबंधों के बिना भी, एस्ट्रा GPT-5.6 Sol की तुलना में पहले बंद हो सकता है। जिन टीमों ने पहले के मॉडल खराब होने के बाद चीजों को बंद कर दिया था, उन्हें उन नियमों पर फिर से गौर करना चाहिए: पोस्ट में तर्क दिया गया है कि एस्ट्रा के पास बेहतर निर्णय है, लेकिन यह पुराने प्रतिबंधों की इतनी शाब्दिक व्याख्या कर सकता है कि जब आप इसे जारी रखना चाहते हैं तो यह बंद हो जाता है।
आगे क्या होता है
उपयोग रीसेट कोडेक्स ग्राहकों को मॉडल का पुनर्मूल्यांकन करने के लिए एक स्पष्ट स्लेट देता है, और ओपनएआई अपने उपयोगकर्ताओं द्वारा चलाए जा रहे समान साइड-बाय-साइड परीक्षणों को देखेगा। गहरा सवाल भरोसे का है: भुगतान करने वाले डेवलपर्स, जिन्होंने लॉन्च के एक सप्ताह के भीतर फ्लैगशिप में गिरावट देखी, उनके पास अब एक दस्तावेजी स्पष्टीकरण, तीन नामित दोष और एक रीसेट है - लेकिन प्रत्येक मॉडल अपडेट को उसके शिप किए गए दिन के अनुसार बेंचमार्क करने का एक नया कारण भी है।
एआई से आगे रहें
मॉडल लॉन्च, ख़राब पोस्ट-मॉर्टम, और टूल को नया आकार देने वाले सॉफ़्टवेयर कार्य - हर दिन ट्रैक किए जाते हैं।
अधिक AI समाचार पढ़ें →