OpenAI виправив три дефекти, які, за його словами, пояснюють тижневу скаргу користувачів на те, що GPT-6 Astra, її найновіша передова модель, стала дурнішою з моменту запуску — і вона скидає обмеження на використання для передплатників Codex як свого роду вибачення. Оновлення надійшло від керівника продукту Codex Тібо Соттіо, який сказав, що команда працювала з користувачами, щоб відстежити помилки, а потім надіслала виправлення та повне скидання до опівночі за місцевим часом, згідно з оновленням, опублікованим у суботу.
Прийняття закриває грубу частину для того, що OpenAI назвав своєю найпотужнішою моделлю на сьогоднішній день. Відколи Astra стала доступною на початку вересня, розробники на X запускали ідентичні підказки щодо Astra в день запуску та поточної версії, зберігаючи всі налаштування однаковими та публікуючи паралельні порівняння, які, здавалося, показували тихо ослаблену модель. Щоб дізнатися більше про моделі, що ведуть цю дискусію, перегляньте наш останній розвиток ШІ.
Три вади, названі
За словами Соттіо, першим винуватцем були навички — файли підказок, написані для попередніх моделей, які запускалися надто часто під Astra, іноді заважаючи моделі перевіряти власну роботу. Другий був необов’язковий експеримент із керування контекстом, який міг змусити модель закритися раніше або відповісти на застарілі повідомлення. За словами компанії, OpenAI вимкнув експеримент після того, як постраждали приблизно від 4000 до 5000 користувачів.
Третій дефект стосувався інфраструктури, а не самої моделі: деякі механізми логічного висновку були налаштовані неправильно, що помітно погіршувало якість хвостового трафіку, що проходив через них. OpenAI видалив ці двигуни та зробив кілька менших ремонтів. Sottiaux написав, що модель тепер точніше відстежує останнє повідомлення користувача — кивок на скарги, що Astra відповідала на запитання, які користувач уже обійшов.
Розробники вже пішли далі
Скарги накопичувалися протягом тижня. Розробник Пранджал Палівал, який кілька днів тому хвалив Astra, повернувся назад і прочитав код, який вона написала для нього, а потім назвав результат регресією, а не прогресом. Дакс Раад, який розробляє інструмент кодування Opencode, перевів свою команду назад на старішу GPT-5.6 Sol після того, як витрати на Astra подвоїлися через недоліки, які, на його думку, не варті грошей. Один автор на форумі описав, що Astra тепер нарівні з Солом у ідентичних завданнях, з тими самими повторами.
Не всі прийняли це читання. Користувач під псевдонімом, який писав як Antikythera, стверджував, що модель завжди була лінивою та любила кульові точки, і що користувачі просто перестали дивуватися. Ця розбіжність показує, наскільки важко врегулювати претензії щодо якості моделі: ідентичні підказки, різні вердикти.
Проблема з ємністю у фоновому режимі
Рядок якості приземлився, тоді як потужність затьмарила розгортання. Згідно зі звітами користувачів, OpenAI зменшив обмеження на використання Astra для інтенсивних користувачів ChatGPT і призупинив нові підписки Pro на суму 200 доларів США — цей крок Соттьо підтвердив 10 вересня, посилаючись на попит. Модель все ще коштує 10 доларів США за мільйон вхідних токенів і 50 доларів США за мільйон вихідних токенів, що в 2,5 рази перевищує вартість Sol, коли вона була запущена.
Є також незручний прецедент: це другий флагман OpenAI за два місяці, який викликав такі ж звинувачення від платних користувачів. У липні користувачі сказали, що основний режим міркувань Сола миттєво став незначним. Соттьо заперечував навмисне послаблення його в той час, підтверджуючи, що компанія експериментувала з міркуваннями. Повторювані цикли «модель погіршилася», а потім «ми знайшли дефекти» стають закономірністю, якою компанії доведеться керувати — прозорість допомагає, але також стабільність.
Власна порада OpenAI: використовуйте менше огорож
Окрім виправлень, OpenAI опублікував рекомендації щодо міграції від інженера Еріка Провенчера, які є суперечливою рекомендацією: більш потужні моделі потрібно менше тримати в руках. Занадто довгі описи навичок, загальні вимоги до читання та жорсткі правила затвердження можуть стати на заваді Astra, йдеться в інструкції. Інструкції, які накопичилися з часом, можуть з’їсти контекст або спричинити надто раннє припинення роботи моделі.
Provencher рекомендує командам переглядати свої навички, файли AGENTS.md і підказки завдань щоразу, коли вони змінюють моделі, тісно прив’язувати інструкції до конкретних завдань і чітко визначати, коли робота виконана — тому що навіть без обмежень Astra може зупинитися раніше, ніж це зробив GPT-5.6 Sol. Команди, які заблокували ситуацію після того, як попередні моделі вийшли з ладу, повинні переглянути ці правила: у дописі стверджується, що Astra має кращий розум, але вона може інтерпретувати старі обмеження настільки буквально, що зупиняється, коли ви хочете, щоб вона продовжувалася.
Що станеться далі
Скидання використання дає передплатникам Codex можливість повторно оцінити модель, і OpenAI спостерігатиме за тими самими паралельними тестами, які виконують його користувачі. Більш глибоке питання полягає в довірі: платні розробники, які бачили погіршення якості флагмана протягом тижня після запуску, тепер мають задокументоване пояснення, три названі дефекти та скидання, а також нову причину порівнювати кожне оновлення моделі з днем його доставки.
Будьте попереду ШІ
Запуски моделей, посмертні дефекти та інструменти, що змінюють програмне забезпечення, відстежуються щодня.
Читати більше новин AI →