چه چیزی تغییر کرد
با توجه به کارت نرخ منتشر شده OpenAI و تغییرات API، قیمت استاندارد در هر میلیون توکن اکنون به شرح زیر است:
- GPT-5.6 Luna: ورودی 20 سنت و خروجی 1.20 دلار، از 1 دلار و 6 دلار کاهش - 80٪ کاهش
- GPT-5.6 Terra: 2 دلار و 12 دلار، کاهش از 2.50 دلار و 15 دلار - کاهش 20٪
- GPT-5.6 Sol (گل سرسبد): 5 دلار و 30 دلار، بدون تغییر
هر سه طبقه در تاریخ 9 ژوئیه 2026 با نرخهای بالاتر در دسترس عموم قرار گرفتند و تنها 21 روز از زندگی تجاری خانواده میگذرد. رویترز و CNBC هر دو این کاهش را تایید کردند و Axios گزارش داد که شدیدترین کاهش در مدل لونا بوده است.
برش ها از طریق هر ردیف خدمات جریان می یابد
کاهش ها به قیمت های اصلی محدود نمی شود. آنها از طریق هر گزینه در کارت نرخ جریان دارند:
- پردازش دسته ای و فلکس ، هر دو نیمی از قیمت استاندارد، لونا را در ورودی 10 سنت و خروجی 60 سنت در هر میلیون توکن قرار می دهد.
- خوانش ورودی ذخیره شده، تخفیف 90٪، کاهش به دو سنت در هر میلیون توکن در Luna و 20 سنت در Terra.
- درخواست های طولانی، با نرخ دو برابر ورودی و 1.5 برابر خروجی صورتحساب، قیمت 40 سنت و 1.80 دلار برای لونا.
برای تیم هایی که قبلاً طبقه بندی انبوه، استخراج یا حلقه های عامل طولانی را از طریق لایه های ارزان تر مسیریابی می کنند، همین تماس ها اکنون کسری از آنچه یک روز قبل انجام داده اند هزینه دارد.
چگونه برش ها با آنتروپیک مقایسه می شوند
طبق صفحه قیمت گذاری آنتروپیک، لونا اکنون با قیمت 20 سنت و 1.20 دلار، ارزان ترین مدل منتشر شده آنتروپیک، هایکو 4.5 را تقریباً پنج برابر در ورودی و چهار برابر در خروجی کاهش می دهد. نرخ جدید Terra کمتر از 3 و 15 دلار است که Claude Sonnet 5 قرار است پس از پایان قیمت اولیه آن در 31 آگوست 2026 اعمال کند.
در صدر هر دو خط، Sol هنوز هم هزینه خروجی بیشتری نسبت به Opus 5 آنتروپیک دارد که قیمتی معادل 5 و 25 دلار دارد.
پردازش اولویت به حالت سریع تبدیل می شود
همان ورودی تغییرات «پردازش اولویت» را بازنشسته کرد و آن را با «حالت سریع» جایگزین کرد. برای مدل پرچمدار Sol، OpenAI میگوید که حالت سریع تا ۲.۵ برابر سرعت استاندارد با دو برابر قیمت اجرا میشود، و سوئیچ سازگار با عقب است - درخواستهایی که قبلاً برای مسیر اولویت به حالت سریع بدون تغییر کد برچسبگذاری شدهاند.
نرخ های حالت سریع 10 دلار و 60 دلار برای Sol، 4 دلار و 24 دلار برای Terra، و 40 سنت و 2.40 دلار برای لونا هستند. قابل توجه است که Anthropic محصول مشابهی را با همان نام و شرایط یکسان به فروش میرساند، و اکنون دو کارت نرخ بر اساس استنتاج منطقهای همگرا میشوند: OpenAI برای مدلهایی که در 5 مارس 2026 یا پس از آن عرضه میشوند، 10 درصد افزایش میدهد، در حالی که آنتروپیک صورتحسابها را تنها 1 برابر نرخ استاندارد آن است.
چرا طبقات ارزان تر ارزان تر شدند
یک روز قبل از برش، OpenAI یک پست مهندسی منتشر کرد که بهینهسازیها را در پشته استنتاج خود توضیح میداد. پنج نفر از کارکنان فنی این شرکت نوشتند که Sol، با اجرای ابزار کدکس خود، هستههای GPU تولیدی را بازنویسی کرده است - OpenAI میگوید که هزینههای سرویسدهی سرتاسر را تا 20 درصد کاهش میدهد. این مدل همچنین مدل پیش نویس رمزگشایی حدس و گمان خود را در صدها آزمایش دوباره طراحی کرد، تغییری که باعث افزایش بازده تولید توکن تا بیش از 15 درصد شد.
اینها ارقام خود OpenAI برای پشته خود هستند، اما آنها به همان مرکز هزینه آدرس های کاهش قیمت اشاره می کنند: مهار عامل پشت Codex و ChatGPT. OpenAI به طور پیشفرض خروجی ابزار را روی 10000 توکن محدود میکند و تاریخچه قابل مشاهده مدل را فقط به صورت پیوست نگه میدارد، بنابراین حلقه عاملی که دستورالعملهای خود را در هر مرحله دوباره ارسال میکند به جای پرداخت نرخهای ورودی کامل، به حافظه نهان سریعالسیر برخورد میکند. این شرکت این پست را با تعهد به ارائه "بهبودهای زیربنایی به کاربران خود در قالب هوشمندی مقرونبهصرفهتر و در دسترستر" بسته است. کارت نرخ یک روز بعد دنبال شد.
شرکای ابری و صورتحساب
OpenAI اشاره کرد که خریداران مسیریابی ترافیک از طریق Amazon Bedrock توسط AWS صورتحساب میشوند و این نرخها میتوانند با کارت منتشر شده خود متفاوت باشند. از آنجایی که شرکتهای بیشتری دسترسی مدل را از طریق یک فروشنده ابری متمرکز میکنند، شکاف بین قیمتگذاری مستقیم OpenAI و آنچه که مشتریان واقعاً از طریق واسطهها میپردازند، به اندازه خود اعداد سرفصل اهمیت خواهد داشت.
بازاری که هر توکن را میشمرد
این کاهشها زمانی رخ میدهد که خریداران سازمانی استنباط را با دقت بیشتری از همیشه خرج میکنند. در اوایل هفته، گزارشها نشان میداد که چگونه دوران «tokenmaxxing» بدون محدودیت - افزایش حجم بدون تماشای هزینه - با افزایش صورتحسابهای هوش مصنوعی شرکتها در پلتفرمهای اصلی در حال محو شدن است. تصمیم OpenAI برای کاهش هزینههای داخلی خود به مشتریان، به جای بانکی، نشانهای واضح از جایی است که معتقد است نبرد رقابتی اکنون در حال انجام است: نه در مرز، جایی که Sol هنوز قیمتگذاری ممتاز را دارد، بلکه در سطوح ارزان و با حجم بالا که بیشتر ترافیک تولید در آن زندگی میکند.
با تغییر قیمت Sol، تصمیم زنده برای توسعهدهندگان دقیقاً همان جایی است که OpenAI آن را از زمان ارسال خانواده قرار داده است: هر درخواست به کدام سطح نیاز دارد. تفاوت این است که هزینه اشتباه گرفتن آن تصمیم به طور چشمگیری کاهش یافته است.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →