OpenAI سه نقص را برطرف کرده است که می‌گوید یک هفته شکایت کاربران را توضیح می‌دهد که GPT-6 Astra، جدیدترین مدل مرزی آن، از زمان راه‌اندازی احمقانه‌تر شده است - و به عنوان یک عذرخواهی، محدودیت‌های استفاده مشترکین Codex را بازنشانی می‌کند. طبق به‌روزرسانی منتشر شده در روز شنبه، این به‌روزرسانی از سوی Tibo Sottiaux، سرپرست محصول Codex، ارائه شد، او گفت که تیم با کاربران برای ردیابی ایرادات کار کرده، سپس اصلاح‌ها و بازنشانی کامل استفاده را قبل از نیمه‌شب به وقت محلی ارسال کرده است.

این پذیرش، بخش سختی را برای آنچه که OpenAI به عنوان تواناترین مدل خود تا به امروز معرفی کرده است، می بندد. از زمانی که Astra در اوایل سپتامبر در دسترس قرار گرفت، توسعه‌دهندگان X در برابر Astra روز راه‌اندازی و نسخه فعلی دستورات یکسانی را اجرا می‌کردند، همه تنظیمات را یکسان نگه می‌داشتند، و مقایسه‌هایی را که به نظر می‌رسید مدل ضعیف‌شده‌ای را نشان می‌داد، ارسال کردند. برای اطلاعات بیشتر درباره مدل‌هایی که این بحث را پیش می‌برند، پوشش [آخرین پیشرفت‌های هوش مصنوعی] (https://aibuzzwire.news) ما را ببینید.

سه نقص، نامگذاری شده است

به گفته Sottiaux، اولین مقصر مهارت‌ها بود - فایل‌های سریعی که برای مدل‌های قبلی نوشته می‌شدند که اغلب تحت Astra فعال می‌شدند و گاهی اوقات مدل را از بررسی کار خود باز می‌داشت. دومین آزمایش یک آزمایش مدیریت زمینه اختیاری بود که می‌توانست مدل را زودتر ترک کند یا به پیام‌های قدیمی پاسخ دهد. این شرکت گفت که OpenAI آزمایش را پس از اینکه تقریباً 4000 تا 5000 کاربر تحت تأثیر قرار گرفتند غیرفعال کرد.

نقص سوم به جای خود مدل مربوط به زیرساخت‌ها بود: برخی از موتورهای استنتاج به اشتباه پیکربندی شده بودند و به‌طور قابل اندازه‌گیری کیفیت را در ترافیک دنباله‌ای که از طریق آن‌ها هدایت می‌شد تنزل داده بودند. OpenAI آن موتورها را حذف کرد و چندین تعمیر کوچکتر انجام داد. Sottiaux نوشت که این مدل اکنون آخرین پیام کاربر را با دقت بیشتری ردیابی می کند - اشاره ای به شکایات مبنی بر اینکه Astra به سؤالاتی پاسخ می دهد که کاربر قبلاً از آن عبور کرده است.

توسعه دهندگان قبلاً حرکت کرده بودند

شکایات در طول هفته ایجاد شد. توسعه‌دهنده Pranjal Paliwal که چند روز پیش از Astra ستایش کرده بود، برگشت و کدی را که برای او نوشته بود خواند، سپس نتیجه را به‌جای پیشرفت، پسرفت نامید. Dax Raad که ابزار کد نویسی Opencode را می‌سازد، تیمش را پس از دوبرابر شدن هزینه‌های Astra به GPT-5.6 Sol برگرداند زیرا به نظر او ارزش پول را نداشت. یکی از پوسترهای انجمن، Astra را توصیف می‌کند که در حال حاضر با Sol در وظایف یکسان، با تکرارهای مشابه، هم سطح است.

همه آن خواندن را قبول نداشتند. یک کاربر با نام مستعار که به عنوان Antikythera می نویسد، استدلال می کند که این مدل همیشه تنبل بوده و به نقاط گلوله علاقه مند بوده است و کاربران به سادگی از خیره شدن دست کشیده اند. این اختلاف نشان می دهد که ادعاهای کیفیت مدل چقدر دشوار است: درخواست های یکسان، احکام متفاوت.

مشکل ظرفیت در پس‌زمینه

ردیف کیفیت فرود آمد در حالی که ظرفیت عرضه را تحت الشعاع قرار داده است. طبق گزارشات کاربران، OpenAI محدودیت‌های استفاده Astra را برای کاربران سنگین ChatGPT کاهش داده و اشتراک‌های حرفه‌ای 200 دلاری جدید را متوقف کرده است - مرحله‌ای که Sottiaux در 10 سپتامبر تأیید کرد و به استناد تقاضا انجام شد. این مدل همچنان 10 دلار به ازای هر میلیون توکن ورودی و 50 دلار به ازای هر میلیون توکن خروجی هزینه دارد، که 2.5 برابر قیمتی است که سول در زمان عرضه آن شارژ می کرد.

همچنین یک سابقه ناخوشایند وجود دارد: این دومین پرچمدار OpenAI در دو ماه گذشته است که همین اتهامات را از جانب کاربران پرداخت می کند. در ماه جولای، کاربران گفتند که حالت استدلال برتر Sol یک شبه کم عمق شده است. سوتیو در آن زمان تضعیف عمدی آن را رد کرد، در حالی که تایید کرد که شرکت تلاش های استدلالی را آزمایش کرده است. چرخه‌های مکرر «مدل بدتر شد» و به دنبال آن «نقایصی پیدا کردیم» در حال تبدیل شدن به الگویی است که شرکت باید آن را مدیریت کند – شفافیت کمک می‌کند، اما ثبات نیز کمک می‌کند.

توصیه های خود OpenAI: از نرده های محافظ کمتری استفاده کنید

در کنار اصلاحات، OpenAI راهنمای مهاجرت از مهندس اریک پروونچر را منتشر کرد که به یک توصیه غیرمستقیم تبدیل می شود: مدل های توانمندتر نیاز کمتری به نگه داشتن دست دارند. این راهنما می‌گوید که شرح مهارت‌های بسیار طولانی، الزامات خواندن کامل و قوانین تأیید سفت و سخت می‌توانند مانع Astra شوند. دستورالعمل‌هایی که در طول زمان روی هم انباشته شده‌اند می‌توانند زمینه را بخورند یا باعث شوند که مدل خیلی زود کار کند.

Provencher توصیه می‌کند که تیم‌ها مهارت‌ها، فایل‌های AGENTS.md و اعلان‌های وظایف خود را هر زمان که مدل‌ها را تغییر می‌دهند، بررسی کنند، دستورالعمل‌ها را محکم به وظایف خاص گره بزنند، و مشخص کنند که چه زمانی کار انجام می‌شود – زیرا حتی بدون محدودیت، Astra ممکن است زودتر از GPT-5.6 Sol متوقف شود. تیم‌هایی که پس از سرکشی مدل‌های قبلی، همه چیز را قفل کردند، باید این قوانین را دوباره بررسی کنند: Astra قضاوت بهتری دارد، اما می‌تواند محدودیت‌های قدیمی را به‌طور تحت اللفظی تفسیر کند که وقتی می‌خواهید ادامه دهید متوقف می‌شود.

بعد چه اتفاقی می افتد

بازنشانی استفاده به مشترکین Codex فرصتی برای ارزیابی مجدد مدل می‌دهد و OpenAI همان تست‌های جانبی را که کاربرانش اجرا می‌کنند تماشا خواهد کرد. سوال عمیق‌تر اعتماد است: توسعه‌دهندگان پولی که شاهد کاهش قیمت یک پرچم‌دار در عرض یک هفته پس از راه‌اندازی بودند، اکنون یک توضیح مستند، سه نقص نام‌گذاری شده و یک بازنشانی دارند - اما همچنین دلیل جدیدی برای ارزیابی هر به‌روزرسانی مدل با روز عرضه آن است.

[از هوش مصنوعی جلوتر بمانید] (https://aibuzzwire.news)

راه اندازی مدل، نقص پس از مرگ، و ابزارهای تغییر شکل نرم افزار کار می کنند - هر روز ردیابی می شوند.

اخبار هوش مصنوعی را بیشتر بخوانید →