काय बदलले
OpenAI च्या प्रकाशित रेट कार्ड आणि API चेंजलॉगनुसार, मानक प्रति-दशलक्ष-टोकन किंमती आता वाचतात:
- GPT-5.6 लुना: 20 सेंट इनपुट आणि $1.20 आउटपुट, $1 आणि $6 वरून खाली - 80% कपात
- GPT-5.6 टेरा: $2 आणि $12, $2.50 आणि $15 वरून खाली - 20% कपात
- GPT-5.6 Sol (फ्लॅगशिप): $5 आणि $30, अपरिवर्तित
सर्व तीन टियर्स 9 जुलै 2026 रोजी सामान्य उपलब्धतेसाठी उच्च दराने लाँच केले गेले, कुटुंबाच्या व्यावसायिक जीवनात केवळ 21 दिवसांची पुनर्मूल्यांकन करून. रॉयटर्स आणि सीएनबीसी या दोघांनीही कपातीची पुष्टी केली आणि एक्सिओसने नोंदवले की सर्वात जास्त कपात लुना मॉडेलवर झाली आहे.
प्रत्येक सेवा स्तरातून कट प्रवाह
कपात हेडलाइन किंमतीपुरते मर्यादित नाहीत. ते दर कार्डावरील प्रत्येक पर्यायातून प्रवाहित होतात:
- बॅच आणि फ्लेक्स प्रोसेसिंग, दोन्ही मानक किमतीच्या अर्ध्या, लूनाला १० सेंट्स इनपुट आणि ६० सेंट आउटपुट प्रति दशलक्ष टोकन्सवर ठेवतात.
- कॅश्ड इनपुट रीड, 90% सवलत, Luna वर प्रति दशलक्ष टोकन दोन सेंट आणि टेरा वर 20 सेंट.
- दीर्घ-संदर्भ विनंत्या, इनपुट दराच्या दुप्पट आणि आउटपुटच्या 1.5 पटीने बिल, 40 सेंट आणि लुनासाठी $1.80.
स्वस्त टियर्सद्वारे मोठ्या प्रमाणात वर्गीकरण, उतारा किंवा लांब एजंट लूप राउटिंग करणाऱ्या संघांसाठी, तेच कॉल्स आता त्यांनी एक दिवस आधी केलेल्या कामाच्या काही अंशी खर्च करतात.
कट्स अँथ्रोपिकशी कसे तुलना करतात
20 सेंट आणि $1.20 वर, लुना आता अँथ्रोपिकच्या सर्वात स्वस्त प्रकाशित मॉडेल, हायकू 4.5, इनपुटवर अंदाजे पाच पट आणि आउटपुटवर चार पट कमी करते, अँथ्रोपिकच्या किंमत पृष्ठानुसार. Terra चा नवीन दर $3 आणि $15 च्या खाली बसला आहे जो क्लॉड सॉनेट 5 ने 31 ऑगस्ट, 2026 रोजी त्याची प्रास्ताविक किंमत संपल्यानंतर आकारला जाईल.
दोन्ही लाइनअपच्या शीर्षस्थानी, Anthropic च्या Opus 5 पेक्षा सोलची किंमत अजूनही जास्त आहे, ज्याची किंमत $5 आणि $25 आहे.
प्राधान्य प्रक्रिया जलद मोड बनते
त्याच चेंजलॉग एंट्रीने "प्राधान्य प्रक्रिया" निवृत्त केले आणि ते "फास्ट मोड" ने बदलले. फ्लॅगशिप सोल मॉडेलसाठी, ओपनएआय म्हणते की फास्ट मोड दुप्पट किमतीच्या 2.5 पट प्रमाण गतीने चालतो आणि स्विच बॅकवर्ड कंपॅटिबल आहे — कोड बदलाशिवाय फास्ट मोडला प्राधान्य मार्गासाठी आधीच टॅग केलेल्या विनंत्या.
फास्ट-मोड दर सोलसाठी $10 आणि $60, टेरासाठी $4 आणि $24 आणि लुनासाठी 40 सेंट आणि $2.40 आहेत. विशेष म्हणजे, अँथ्रोपिक समान नावाने आणि समान अटींखाली समान उत्पादन विकते आणि दोन रेट कार्डे आता प्रदेश-पिन केलेल्या अनुमानांवर देखील एकत्रित होतात: जेव्हा ग्राहकाला डेटा रेसिडेन्सीची आवश्यकता असते तेव्हा OpenAI 5 मार्च 2026 रोजी किंवा त्यानंतर रिलीज झालेल्या मॉडेल्सवर 10% उत्थान शुल्क आकारते, तर Anthropic बिल यूएस-केवळ त्याच्या मानक रेट 111 च्या वेळा अनुमान करते.
स्वस्त टियर्स स्वस्त का झाले
कटच्या एक दिवस आधी, ओपनएआयने त्याच्या अनुमान स्टॅकवर ऑप्टिमायझेशनचे वर्णन करणारे एक अभियांत्रिकी पोस्ट प्रकाशित केले. कंपनीच्या तांत्रिक कर्मचाऱ्यांच्या पाच सदस्यांनी लिहिले की सोल, त्याच्या कोडेक्स कोडिंग टूलमध्ये चालत, उत्पादन GPU कर्नलचे पुनर्लेखन केले - काम OpenAI म्हणते की एंड-टू-एंड सर्व्हिंग कॉस्ट 20% कमी करते. मॉडेलने शेकडो प्रयोगांमध्ये स्वतःचे सट्टा-डिकोडिंग मसुदा मॉडेलची पुनर्रचना केली, जो टोकन-जनरेशन कार्यक्षमता 15% पेक्षा जास्त वाढवण्याचे श्रेय दिलेला आहे.
हे OpenAI च्या स्वतःच्या स्टॅकसाठीचे स्वतःचे आकडे आहेत, परंतु ते समान किंमत केंद्रावर किंमत कपात पत्ते दर्शवतात: कोडेक्स आणि ChatGPT च्या मागे एजंट हार्नेस. OpenAI टूल आउटपुट 10,000 टोकन्सवर डीफॉल्टनुसार कॅप्स करते आणि मॉडेल-दृश्यमान इतिहास केवळ जोडण्यासाठी ठेवते, म्हणून प्रत्येक टप्प्यावर त्याच्या सूचना पुन्हा पाठवणारा एजंट लूप पूर्ण इनपुट दर देण्याऐवजी प्रॉम्प्ट कॅशेवर हिट करतो. कंपनीने "आमच्या वापरकर्त्यांना अधिक व्यापकपणे उपलब्ध, किफायतशीर बुद्धिमत्तेच्या रूपात अंडर-द-हुड सुधारणा परत देण्याच्या वचनबद्धतेसह पोस्ट बंद केली." एका दिवसानंतर रेट कार्ड आले.
क्लाउड भागीदार आणि बिलिंग
OpenAI ने नमूद केले की Amazon Bedrock द्वारे ट्रॅफिक रूट करणाऱ्या खरेदीदारांना AWS द्वारे बिल दिले जाते आणि ते दर त्यांच्या स्वतःच्या प्रकाशित कार्डपेक्षा भिन्न असू शकतात. अधिक एंटरप्राइजेस एकाच क्लाउड विक्रेत्याद्वारे मॉडेल ॲक्सेस केंद्रीकृत केल्यामुळे, OpenAI च्या थेट किंमती आणि मध्यस्थांद्वारे ग्राहक प्रत्यक्षात काय अदा करतात यामधील अंतर हे हेडलाइन क्रमांकांइतकेच महत्त्वाचे असेल.
प्रत्येक टोकन मोजणारा बाजार
एंटरप्राइझ खरेदीदार लेखापरीक्षण निष्कर्ष नेहमीपेक्षा अधिक बारकाईने खर्च करतात म्हणून जमीन कमी होते. आठवड्याच्या सुरुवातीला, रिपोर्टिंगने दस्तऐवजीकरण केले की अनियंत्रित "टोकनमॅक्सिंग" चे युग - खर्च न पाहता व्हॉल्यूम पुश करणे - मोठ्या प्लॅटफॉर्मवर कॉर्पोरेट एआय बिले वाढत असताना लुप्त होत आहे. बँक मार्जिन ऐवजी अंतर्गत खर्च बचत ग्राहकांपर्यंत पोचवण्याचा OpenAI चा निर्णय, स्पर्धात्मक लढाई आता कुठे लढली जात आहे यावर विश्वास ठेवण्याचे स्पष्ट संकेत आहे: सीमेवर नाही, जिथे सोल अजूनही प्रीमियम किंमतीचे आदेश देते, परंतु स्वस्त, उच्च-व्हॉल्यूम स्तरांवर जिथे बहुतेक उत्पादन रहदारी वास्तवात असते.
सोलच्या किमतीत बदल न केल्यामुळे, डेव्हलपरसाठी थेट निर्णय कुटुंबाने पाठवल्यापासून OpenAI ने जिथे ठेवला आहे तिथेच राहतो: प्रत्येक विनंतीला कोणत्या श्रेणीची आवश्यकता आहे. फरक असा आहे की तो निर्णय चुकीचा होण्याचा खर्च आताच नाटकीयरित्या कमी झाला आहे.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →