OpenAI سه نقص را برطرف کرده است که میگوید یک هفته شکایت کاربران را توضیح میدهد که GPT-6 Astra، جدیدترین مدل مرزی آن، از زمان راهاندازی احمقانهتر شده است - و به عنوان یک عذرخواهی، محدودیتهای استفاده مشترکین Codex را بازنشانی میکند. طبق بهروزرسانی منتشر شده در روز شنبه، این بهروزرسانی از سوی Tibo Sottiaux، سرپرست محصول Codex، ارائه شد، او گفت که تیم با کاربران برای ردیابی ایرادات کار کرده، سپس اصلاحها و بازنشانی کامل استفاده را قبل از نیمهشب به وقت محلی ارسال کرده است.
این پذیرش، بخش سختی را برای آنچه که OpenAI به عنوان تواناترین مدل خود تا به امروز معرفی کرده است، می بندد. از زمانی که Astra در اوایل سپتامبر در دسترس قرار گرفت، توسعهدهندگان X در برابر Astra روز راهاندازی و نسخه فعلی دستورات یکسانی را اجرا میکردند، همه تنظیمات را یکسان نگه میداشتند، و مقایسههایی را که به نظر میرسید مدل ضعیفشدهای را نشان میداد، ارسال کردند. برای اطلاعات بیشتر درباره مدلهایی که این بحث را پیش میبرند، پوشش [آخرین پیشرفتهای هوش مصنوعی] (https://aibuzzwire.news) ما را ببینید.
سه نقص، نامگذاری شده است
به گفته Sottiaux، اولین مقصر مهارتها بود - فایلهای سریعی که برای مدلهای قبلی نوشته میشدند که اغلب تحت Astra فعال میشدند و گاهی اوقات مدل را از بررسی کار خود باز میداشت. دومین آزمایش یک آزمایش مدیریت زمینه اختیاری بود که میتوانست مدل را زودتر ترک کند یا به پیامهای قدیمی پاسخ دهد. این شرکت گفت که OpenAI آزمایش را پس از اینکه تقریباً 4000 تا 5000 کاربر تحت تأثیر قرار گرفتند غیرفعال کرد.
نقص سوم به جای خود مدل مربوط به زیرساختها بود: برخی از موتورهای استنتاج به اشتباه پیکربندی شده بودند و بهطور قابل اندازهگیری کیفیت را در ترافیک دنبالهای که از طریق آنها هدایت میشد تنزل داده بودند. OpenAI آن موتورها را حذف کرد و چندین تعمیر کوچکتر انجام داد. Sottiaux نوشت که این مدل اکنون آخرین پیام کاربر را با دقت بیشتری ردیابی می کند - اشاره ای به شکایات مبنی بر اینکه Astra به سؤالاتی پاسخ می دهد که کاربر قبلاً از آن عبور کرده است.
توسعه دهندگان قبلاً حرکت کرده بودند
شکایات در طول هفته ایجاد شد. توسعهدهنده Pranjal Paliwal که چند روز پیش از Astra ستایش کرده بود، برگشت و کدی را که برای او نوشته بود خواند، سپس نتیجه را بهجای پیشرفت، پسرفت نامید. Dax Raad که ابزار کد نویسی Opencode را میسازد، تیمش را پس از دوبرابر شدن هزینههای Astra به GPT-5.6 Sol برگرداند زیرا به نظر او ارزش پول را نداشت. یکی از پوسترهای انجمن، Astra را توصیف میکند که در حال حاضر با Sol در وظایف یکسان، با تکرارهای مشابه، هم سطح است.
همه آن خواندن را قبول نداشتند. یک کاربر با نام مستعار که به عنوان Antikythera می نویسد، استدلال می کند که این مدل همیشه تنبل بوده و به نقاط گلوله علاقه مند بوده است و کاربران به سادگی از خیره شدن دست کشیده اند. این اختلاف نشان می دهد که ادعاهای کیفیت مدل چقدر دشوار است: درخواست های یکسان، احکام متفاوت.
مشکل ظرفیت در پسزمینه
ردیف کیفیت فرود آمد در حالی که ظرفیت عرضه را تحت الشعاع قرار داده است. طبق گزارشات کاربران، OpenAI محدودیتهای استفاده Astra را برای کاربران سنگین ChatGPT کاهش داده و اشتراکهای حرفهای 200 دلاری جدید را متوقف کرده است - مرحلهای که Sottiaux در 10 سپتامبر تأیید کرد و به استناد تقاضا انجام شد. این مدل همچنان 10 دلار به ازای هر میلیون توکن ورودی و 50 دلار به ازای هر میلیون توکن خروجی هزینه دارد، که 2.5 برابر قیمتی است که سول در زمان عرضه آن شارژ می کرد.
همچنین یک سابقه ناخوشایند وجود دارد: این دومین پرچمدار OpenAI در دو ماه گذشته است که همین اتهامات را از جانب کاربران پرداخت می کند. در ماه جولای، کاربران گفتند که حالت استدلال برتر Sol یک شبه کم عمق شده است. سوتیو در آن زمان تضعیف عمدی آن را رد کرد، در حالی که تایید کرد که شرکت تلاش های استدلالی را آزمایش کرده است. چرخههای مکرر «مدل بدتر شد» و به دنبال آن «نقایصی پیدا کردیم» در حال تبدیل شدن به الگویی است که شرکت باید آن را مدیریت کند – شفافیت کمک میکند، اما ثبات نیز کمک میکند.
توصیه های خود OpenAI: از نرده های محافظ کمتری استفاده کنید
در کنار اصلاحات، OpenAI راهنمای مهاجرت از مهندس اریک پروونچر را منتشر کرد که به یک توصیه غیرمستقیم تبدیل می شود: مدل های توانمندتر نیاز کمتری به نگه داشتن دست دارند. این راهنما میگوید که شرح مهارتهای بسیار طولانی، الزامات خواندن کامل و قوانین تأیید سفت و سخت میتوانند مانع Astra شوند. دستورالعملهایی که در طول زمان روی هم انباشته شدهاند میتوانند زمینه را بخورند یا باعث شوند که مدل خیلی زود کار کند.
Provencher توصیه میکند که تیمها مهارتها، فایلهای AGENTS.md و اعلانهای وظایف خود را هر زمان که مدلها را تغییر میدهند، بررسی کنند، دستورالعملها را محکم به وظایف خاص گره بزنند، و مشخص کنند که چه زمانی کار انجام میشود – زیرا حتی بدون محدودیت، Astra ممکن است زودتر از GPT-5.6 Sol متوقف شود. تیمهایی که پس از سرکشی مدلهای قبلی، همه چیز را قفل کردند، باید این قوانین را دوباره بررسی کنند: Astra قضاوت بهتری دارد، اما میتواند محدودیتهای قدیمی را بهطور تحت اللفظی تفسیر کند که وقتی میخواهید ادامه دهید متوقف میشود.
بعد چه اتفاقی می افتد
بازنشانی استفاده به مشترکین Codex فرصتی برای ارزیابی مجدد مدل میدهد و OpenAI همان تستهای جانبی را که کاربرانش اجرا میکنند تماشا خواهد کرد. سوال عمیقتر اعتماد است: توسعهدهندگان پولی که شاهد کاهش قیمت یک پرچمدار در عرض یک هفته پس از راهاندازی بودند، اکنون یک توضیح مستند، سه نقص نامگذاری شده و یک بازنشانی دارند - اما همچنین دلیل جدیدی برای ارزیابی هر بهروزرسانی مدل با روز عرضه آن است.
[از هوش مصنوعی جلوتر بمانید] (https://aibuzzwire.news)
راه اندازی مدل، نقص پس از مرگ، و ابزارهای تغییر شکل نرم افزار کار می کنند - هر روز ردیابی می شوند.
اخبار هوش مصنوعی را بیشتر بخوانید →