کیا بدلا؟
OpenAI کے شائع شدہ ریٹ کارڈ اور API چینج لاگ کے مطابق، معیاری فی ملین ٹوکن قیمتیں اب پڑھیں:
- GPT-5.6 Luna: 20 سینٹ ان پٹ اور $1.20 آؤٹ پٹ، $1 اور $6 سے نیچے - 80% کمی
- GPT-5.6 Terra: $2 اور $12، $2.50 اور $15 سے نیچے - 20% کٹوتی
- GPT-5.6 Sol (فلیگ شپ): $5 اور $30، کوئی تبدیلی نہیں۔
تینوں درجات 9 جولائی 2026 کو اعلیٰ نرخوں پر عام دستیابی کے لیے شروع کیے گئے، جس سے خاندان کی تجارتی زندگی میں صرف 21 دن کی دوبارہ قیمت رکھی گئی۔ رائٹرز اور CNBC دونوں نے کٹوتیوں کی تصدیق کی، اور Axios نے اطلاع دی کہ سب سے تیز کمی لونا ماڈل پر پڑی۔
ہر سروس ٹائر میں کٹوتیاں ہوتی ہیں۔
کمی صرف سرخی کی قیمتوں تک محدود نہیں ہے۔ وہ ریٹ کارڈ پر ہر آپشن سے گزرتے ہیں:
- بیچ اور فلیکس پروسیسنگ، دونوں معیاری قیمت سے نصف، Luna کو 10 سینٹ ان پٹ اور 60 سینٹ آؤٹ پٹ فی ملین ٹوکن پر ڈالتے ہیں۔
- کیشڈ ان پٹ ریڈز، 90% رعایت، لونا پر دو سینٹ فی ملین ٹوکن اور ٹیرا پر 20 سینٹس۔
- طویل سیاق و سباق کی درخواستیں، ان پٹ ریٹ سے دوگنا اور 1.5 گنا آؤٹ پٹ پر بل، 40 سینٹ اور لونا کے لیے $1.80۔
ٹیموں کے لیے جو پہلے ہی سستے درجوں کے ذریعے بلک درجہ بندی، نکالنے، یا طویل ایجنٹ لوپس کو روٹ کر رہی ہیں، اب وہی کالز کی لاگت ایک دن پہلے کی گئی تھی۔
کٹس کا موازنہ اینتھروپک سے کیسے ہوتا ہے۔
20 سینٹ میں اور $1.20 میں، لونا اب اینتھروپک کے سب سے سستے شائع شدہ ماڈل، ہائیکو 4.5 کو ان پٹ پر تقریباً پانچ گنا اور آؤٹ پٹ پر چار گنا کم کر دیتی ہے، اینتھروپک کے قیمتوں کے صفحہ کے مطابق۔ Terra کی نئی شرح $3 اور $15 سے نیچے ہے جسے Claude Sonnet 5 نے 31 اگست 2026 کو تعارفی قیمتوں کا تعین ختم ہونے کے بعد چارج کرنا ہے۔
دونوں لائن اپ کے اوپری حصے میں، سول کی اب بھی پیداوار پر انتھروپک کے Opus 5 سے زیادہ لاگت آتی ہے، جس کی قیمت $5 اور $25 ہے۔
ترجیحی پروسیسنگ فاسٹ موڈ بن جاتی ہے۔
اسی چینج لاگ انٹری نے "ترجیحی پروسیسنگ" کو ریٹائر کر دیا اور اسے "فاسٹ موڈ" سے بدل دیا۔ فلیگ شپ سول ماڈل کے لیے، اوپن اے آئی کا کہنا ہے کہ فاسٹ موڈ دو گنا قیمت پر معیاری رفتار سے 2.5 گنا تک چلتا ہے، اور سوئچ پسماندہ مطابقت رکھتا ہے — درخواستوں کو پہلے ہی کوڈ کی تبدیلی کے بغیر فاسٹ موڈ کے ترجیحی راستے کے لیے ٹیگ کیا گیا ہے۔
فاسٹ موڈ ریٹس سول کے لیے $10 اور $60، Terra کے لیے $4 اور $24، اور Luna کے لیے 40 سینٹ اور $2.40 ہیں۔ خاص طور پر، Anthropic ایک ہی پروڈکٹ کو ایک ہی نام اور ایک جیسی شرائط کے تحت فروخت کرتا ہے، اور اب دونوں ریٹ کارڈز ریجن کے لحاظ سے لگائے گئے تخمینے پر بھی اکٹھے ہو جاتے ہیں: OpenAI 5 مارچ 2026 کو یا اس کے بعد ریلیز ہونے والے ماڈلز پر 10% اضافہ وصول کرتا ہے جب کسی صارف کو ڈیٹا ریذیڈنسی کی ضرورت ہوتی ہے، جبکہ Anthropic صرف US کے حساب سے اس کی معیاری شرح 111 پر بل کرتا ہے۔
سستے درجے سستے کیوں ہوئے؟
کٹ سے ایک دن پہلے، اوپن اے آئی نے ایک انجینئرنگ پوسٹ شائع کی جس میں اس کے انفرنس اسٹیک میں اصلاح کی وضاحت کی گئی تھی۔ کمپنی کے تکنیکی عملے کے پانچ اراکین نے لکھا کہ سول، اپنے کوڈیکس کوڈنگ ٹول کے اندر چلتے ہوئے، پروڈکشن GPU کرنل کو دوبارہ لکھتے ہیں - کام OpenAI کا کہنا ہے کہ آخر سے آخر تک سرونگ کے اخراجات میں 20 فیصد کمی کی گئی ہے۔ ماڈل نے سینکڑوں تجربات میں اپنے قیاس آرائی پر مبنی ڈیکوڈنگ ڈرافٹ ماڈل کو بھی دوبارہ ڈیزائن کیا، اس تبدیلی کا سہرا ٹوکن جنریشن کی کارکردگی کو 15% سے زیادہ بڑھایا گیا۔
یہ اس کے اپنے اسٹیک کے لیے OpenAI کے اپنے اعداد و شمار ہیں، لیکن وہ قیمتوں میں کٹوتی کے پتے کو اسی قیمت کے مرکز کی طرف اشارہ کرتے ہیں: Codex اور ChatGPT کے پیچھے ایجنٹ کا استعمال۔ OpenAI ٹول آؤٹ پٹ کو 10,000 ٹوکنز پر ڈیفالٹ کیپ کرتا ہے اور صرف ماڈل کی نظر آنے والی ہسٹری کو اپنڈ کے لیے رکھتا ہے، اس لیے ایک ایجنٹ لوپ جو ہر قدم پر اپنی ہدایات کو دوبارہ بھیجتا ہے مکمل ان پٹ ریٹ ادا کرنے کے بجائے پرامپٹ کیش سے ٹکرا جاتا ہے۔ کمپنی نے "زیادہ وسیع پیمانے پر دستیاب، لاگت سے موثر ذہانت کی شکل میں اپنے صارفین کو انڈر دی ہڈ بہتریوں کو واپس" منتقل کرنے کے عزم کے ساتھ پوسٹ کو بند کر دیا۔ ریٹ کارڈ ایک دن بعد آیا۔
کلاؤڈ پارٹنرز اور بلنگ
OpenAI نے نوٹ کیا کہ Amazon Bedrock کے ذریعے ٹریفک کو روٹ کرنے والے خریداروں کو AWS کے ذریعے بل دیا جاتا ہے، اور وہ شرحیں اس کے اپنے شائع کردہ کارڈ سے مختلف ہو سکتی ہیں۔ چونکہ مزید کاروباری ادارے ایک ہی کلاؤڈ وینڈر کے ذریعے ماڈل تک رسائی کو مرکزی بناتے ہیں، OpenAI کی براہ راست قیمتوں اور بیچوانوں کے ذریعے صارفین کی ادائیگی کے درمیان فرق اتنا ہی اہم ہوگا جتنا کہ خود ہیڈ لائن نمبرز۔
ہر ٹوکن کی گنتی کرنے والی مارکیٹ
انٹرپرائز کے خریداروں کے آڈٹ تخمینہ کی وجہ سے زمین میں کٹوتی پہلے سے کہیں زیادہ قریب سے ہوتی ہے۔ ہفتے کے اوائل میں، رپورٹنگ نے دستاویزی طور پر بتایا کہ کس طرح بے لگام "ٹوکن میکسنگ" کا دور - لاگت کو دیکھے بغیر حجم کو آگے بڑھانا - بڑے پلیٹ فارمز پر کارپوریٹ AI بلوں میں اضافے کے طور پر ختم ہو رہا ہے۔ اوپن اے آئی کا اپنی داخلی لاگت کی بچت کو بینک مارجن کے بجائے صارفین تک پہنچانے کا فیصلہ اس بات کا واضح اشارہ ہے کہ اس کا خیال ہے کہ اب مسابقتی جنگ کہاں لڑی جا رہی ہے: فرنٹیئر پر نہیں، جہاں سول اب بھی پریمیم قیمتوں کا حکم دیتا ہے، بلکہ سستے، اعلیٰ حجم والے درجات پر جہاں زیادہ تر پیداواری ٹریفک اصل میں رہتی ہے۔
سول کی قیمت میں کوئی تبدیلی نہ ہونے کے ساتھ، ڈویلپرز کے لیے لائیو فیصلہ بالکل وہی رہتا ہے جہاں OpenAI نے اسے خاندان کے بھیجے جانے کے بعد رکھا ہے: ہر درخواست کے لیے جس درجے کی ضرورت ہوتی ہے۔ فرق یہ ہے کہ اس فیصلے کو غلط کرنے کی قیمت میں ڈرامائی طور پر کمی آئی ہے۔
---
AI سے آگے رہیںتازہ ترین AI خبریں، تجزیہ اور کامیابیاں حاصل کریں — سب ایک جگہ پر۔
مزید AI خبریں پڑھیں →