OpenAI قیمت های API را در دو مدل از سه مدل GPT-5.6 خود در 30 ژوئیه 2026 کاهش داد و به سختی سه هفته پس از در دسترس بودن خانواده، ارزان ترین رده را 80 درصد کاهش داد. این حرکت نشان می‌دهد که سازنده مدل‌های پیشرو چقدر به شدت برای حجم کاری بالا و حساس به هزینه رقابت می‌کند - و مشتریانش در حال حاضر چقدر به دقت تمام نشانه‌ها را می‌شمارند. برای اطلاعات بیشتر در مورد تغییر گسترده تر در اقتصاد هوش مصنوعی، [آخرین تحولات هوش مصنوعی] ما را دنبال کنید (https://aibuzzwire.news).

چه چیزی تغییر کرد

با توجه به کارت نرخ منتشر شده OpenAI و تغییرات API، قیمت استاندارد در هر میلیون توکن اکنون به شرح زیر است:

  • GPT-5.6 Luna: ورودی 20 سنت و خروجی 1.20 دلار، از 1 دلار و 6 دلار کاهش - 80٪ کاهش
  • GPT-5.6 Terra: 2 دلار و 12 دلار، کاهش از 2.50 دلار و 15 دلار - کاهش 20٪
  • GPT-5.6 Sol (گل سرسبد): 5 دلار و 30 دلار، بدون تغییر

هر سه طبقه در تاریخ 9 ژوئیه 2026 با نرخ‌های بالاتر در دسترس عموم قرار گرفتند و تنها 21 روز از زندگی تجاری خانواده می‌گذرد. رویترز و CNBC هر دو این کاهش را تایید کردند و Axios گزارش داد که شدیدترین کاهش در مدل لونا بوده است.

برش ها از طریق هر ردیف خدمات جریان می یابد

کاهش ها به قیمت های اصلی محدود نمی شود. آنها از طریق هر گزینه در کارت نرخ جریان دارند:

  • پردازش دسته ای و فلکس ، هر دو نیمی از قیمت استاندارد، لونا را در ورودی 10 سنت و خروجی 60 سنت در هر میلیون توکن قرار می دهد.
  • خوانش ورودی ذخیره شده، تخفیف 90٪، کاهش به دو سنت در هر میلیون توکن در Luna و 20 سنت در Terra.
  • درخواست های طولانی، با نرخ دو برابر ورودی و 1.5 برابر خروجی صورتحساب، قیمت 40 سنت و 1.80 دلار برای لونا.

برای تیم هایی که قبلاً طبقه بندی انبوه، استخراج یا حلقه های عامل طولانی را از طریق لایه های ارزان تر مسیریابی می کنند، همین تماس ها اکنون کسری از آنچه یک روز قبل انجام داده اند هزینه دارد.

چگونه برش ها با آنتروپیک مقایسه می شوند

طبق صفحه قیمت گذاری آنتروپیک، لونا اکنون با قیمت 20 سنت و 1.20 دلار، ارزان ترین مدل منتشر شده آنتروپیک، هایکو 4.5 را تقریباً پنج برابر در ورودی و چهار برابر در خروجی کاهش می دهد. نرخ جدید Terra کمتر از 3 و 15 دلار است که Claude Sonnet 5 قرار است پس از پایان قیمت اولیه آن در 31 آگوست 2026 اعمال کند.

در صدر هر دو خط، Sol هنوز هم هزینه خروجی بیشتری نسبت به Opus 5 آنتروپیک دارد که قیمتی معادل 5 و 25 دلار دارد.

پردازش اولویت به حالت سریع تبدیل می شود

همان ورودی تغییرات «پردازش اولویت» را بازنشسته کرد و آن را با «حالت سریع» جایگزین کرد. برای مدل پرچم‌دار Sol، OpenAI می‌گوید که حالت سریع تا ۲.۵ برابر سرعت استاندارد با دو برابر قیمت اجرا می‌شود، و سوئیچ سازگار با عقب است - درخواست‌هایی که قبلاً برای مسیر اولویت به حالت سریع بدون تغییر کد برچسب‌گذاری شده‌اند.

نرخ های حالت سریع 10 دلار و 60 دلار برای Sol، 4 دلار و 24 دلار برای Terra، و 40 سنت و 2.40 دلار برای لونا هستند. قابل توجه است که Anthropic محصول مشابهی را با همان نام و شرایط یکسان به فروش می‌رساند، و اکنون دو کارت نرخ بر اساس استنتاج منطقه‌ای همگرا می‌شوند: OpenAI برای مدل‌هایی که در 5 مارس 2026 یا پس از آن عرضه می‌شوند، 10 درصد افزایش می‌دهد، در حالی که آنتروپیک صورت‌حساب‌ها را تنها 1 برابر نرخ استاندارد آن است.

چرا طبقات ارزان تر ارزان تر شدند

یک روز قبل از برش، OpenAI یک پست مهندسی منتشر کرد که بهینه‌سازی‌ها را در پشته استنتاج خود توضیح می‌داد. پنج نفر از کارکنان فنی این شرکت نوشتند که Sol، با اجرای ابزار کدکس خود، هسته‌های GPU تولیدی را بازنویسی کرده است - OpenAI می‌گوید که هزینه‌های سرویس‌دهی سرتاسر را تا 20 درصد کاهش می‌دهد. این مدل همچنین مدل پیش نویس رمزگشایی حدس و گمان خود را در صدها آزمایش دوباره طراحی کرد، تغییری که باعث افزایش بازده تولید توکن تا بیش از 15 درصد شد.

اینها ارقام خود OpenAI برای پشته خود هستند، اما آنها به همان مرکز هزینه آدرس های کاهش قیمت اشاره می کنند: مهار عامل پشت Codex و ChatGPT. OpenAI به طور پیش‌فرض خروجی ابزار را روی 10000 توکن محدود می‌کند و تاریخچه قابل مشاهده مدل را فقط به صورت پیوست نگه می‌دارد، بنابراین حلقه عاملی که دستورالعمل‌های خود را در هر مرحله دوباره ارسال می‌کند به جای پرداخت نرخ‌های ورودی کامل، به حافظه نهان سریع‌السیر برخورد می‌کند. این شرکت این پست را با تعهد به ارائه "بهبودهای زیربنایی به کاربران خود در قالب هوشمندی مقرون‌به‌صرفه‌تر و در دسترس‌تر" بسته است. کارت نرخ یک روز بعد دنبال شد.

شرکای ابری و صورتحساب

OpenAI اشاره کرد که خریداران مسیریابی ترافیک از طریق Amazon Bedrock توسط AWS صورت‌حساب می‌شوند و این نرخ‌ها می‌توانند با کارت منتشر شده خود متفاوت باشند. از آنجایی که شرکت‌های بیشتری دسترسی مدل را از طریق یک فروشنده ابری متمرکز می‌کنند، شکاف بین قیمت‌گذاری مستقیم OpenAI و آنچه که مشتریان واقعاً از طریق واسطه‌ها می‌پردازند، به اندازه خود اعداد سرفصل اهمیت خواهد داشت.

بازاری که هر توکن را می‌شمرد

این کاهش‌ها زمانی رخ می‌دهد که خریداران سازمانی استنباط را با دقت بیشتری از همیشه خرج می‌کنند. در اوایل هفته، گزارش‌ها نشان می‌داد که چگونه دوران «tokenmaxxing» بدون محدودیت - افزایش حجم بدون تماشای هزینه - با افزایش صورت‌حساب‌های هوش مصنوعی شرکت‌ها در پلت‌فرم‌های اصلی در حال محو شدن است. تصمیم OpenAI برای کاهش هزینه‌های داخلی خود به مشتریان، به جای بانکی، نشانه‌ای واضح از جایی است که معتقد است نبرد رقابتی اکنون در حال انجام است: نه در مرز، جایی که Sol هنوز قیمت‌گذاری ممتاز را دارد، بلکه در سطوح ارزان و با حجم بالا که بیشتر ترافیک تولید در آن زندگی می‌کند.

با تغییر قیمت Sol، تصمیم زنده برای توسعه‌دهندگان دقیقاً همان جایی است که OpenAI آن را از زمان ارسال خانواده قرار داده است: هر درخواست به کدام سطح نیاز دارد. تفاوت این است که هزینه اشتباه گرفتن آن تصمیم به طور چشمگیری کاهش یافته است.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →