OpenAI исправила три дефекта, которые, по ее словам, объясняют неделю жалоб пользователей на то, что GPT-6 Astra, ее новейшая пограничная модель, стала тупее с момента запуска — и в качестве своего рода извинения она сбрасывает ограничения на использование для подписчиков Кодекса. Обновление пришло от руководителя продукта Codex Тибо Соттио, который сказал, что команда работала с пользователями над отслеживанием ошибок, а затем отправила исправления и полный сброс использования до полуночи по местному времени, согласно обновлению, опубликованному в субботу.

Это признание завершает трудный этап развития того, что OpenAI называет своей самой эффективной моделью на сегодняшний день. С тех пор, как Astra стала широко доступной в начале сентября, разработчики X запускали идентичные подсказки для Astra в день запуска и текущей версии, сохраняя все настройки одинаковыми и публикуя параллельные сравнения, которые, казалось, показывали незаметно ослабленную модель. Дополнительную информацию о моделях, вызывающих эту дискуссию, можно найти в нашем репортаже о последних разработках в области искусственного интеллекта.

Три дефекта, названные

По словам Соттио, первым виновником были навыки — файлы подсказок, написанные для более ранних моделей, которые слишком часто запускались под Astra, иногда мешая модели проверить собственную работу. Вторым был дополнительный эксперимент по управлению контекстом, который мог заставить модель завершить работу раньше или ответить на устаревшие сообщения. По словам компании, OpenAI отключила эксперимент после того, как в нем пострадали примерно 4000–5000 пользователей.

Третий дефект касался инфраструктуры, а не самой модели: некоторые механизмы вывода были настроены неправильно, что заметно ухудшало качество хвостового трафика, проходящего через них. OpenAI удалила эти движки и произвела несколько мелких ремонтов. Соттио написал, что модель теперь более точно отслеживает последнее сообщение пользователя — намек на жалобы на то, что Астра отвечала на вопросы, которые пользователь уже прошел.

Разработчики уже пошли дальше

Жалобы накапливались в течение недели. Разработчик Пранджал Паливал, который несколько дней назад хвалил Astra, вернулся и прочитал код, который она написала для него, а затем назвал результат регрессом, а не прогрессом. Дакс Раад, создатель инструмента кодирования Opencode, вернул свою команду на более старую GPT-5.6 Sol после того, как расходы на Astra увеличились вдвое из-за недостатков, которые, по его мнению, не стоили денег. На одном из форумов было описано, что Астра теперь находится на одном уровне с Солом в выполнении идентичных задач и с теми же повторами.

Не все приняли такое прочтение. Пользователь под псевдонимом Antikythera утверждал, что модель всегда была ленивой и любила перечислять пункты, и что пользователи просто перестали удивляться. Это разногласие показывает, насколько сложно урегулировать претензии по качеству модели: одинаковые подсказки, разные вердикты.

Проблемы с емкостью в фоновом режиме

Спор о качестве появился, в то время как мощность отодвинула на второй план развертывание. Согласно отчетам пользователей, OpenAI сократила лимиты на использование Astra для активных пользователей ChatGPT и приостановила новые подписки Pro за 200 долларов — шаг, который Соттио подтвердил 10 сентября, ссылаясь на спрос. Модель по-прежнему стоит 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов, что в 2,5 раза превышает цену, которую Sol взимала при запуске.

Есть также неприятный прецедент: это второй флагман OpenAI за два месяца, вызывающий аналогичные обвинения со стороны платящих пользователей. В июле пользователи заявили, что основной способ рассуждения Сола в одночасье ослаб. Соттио тогда отрицал, что намеренно ослабил его, но подтвердил, что компания экспериментировала с логическими рассуждениями. Повторяющиеся циклы «модель ухудшилась», за которыми следует «мы обнаружили дефекты», становятся шаблоном, которым компании придется управлять — прозрачность помогает, но и стабильность тоже.

Собственный совет OpenAI: используйте меньше ограждений

Помимо исправлений, OpenAI опубликовала руководство по миграции от инженера Эрика Провеншера, которое представляет собой нелогичную рекомендацию: более функциональным моделям требуется меньше ручного управления. В руководстве говорится, что слишком длинные описания навыков, общие требования к чтению и жесткие правила утверждения могут помешать Astra. Инструкции, накопившиеся со временем, могут съесть контекст или привести к тому, что модель слишком рано прекратит работу.

Provencher рекомендует командам проверять свои навыки, файлы AGENTS.md и подсказки задач при каждом переключении моделей, жестко привязывать инструкции к конкретным задачам и четко определять, когда задание выполнено — ведь даже без ограничений Astra может остановиться раньше, чем GPT-5.6 Sol. Командам, которые ввели ограничения после того, как предыдущие модели вышли из строя, следует пересмотреть эти правила: у Astra здравый смысл, утверждается в сообщении, но она может интерпретировать старые ограничения настолько буквально, что останавливается, когда вы хотите, чтобы она продолжала работать.

Что будет дальше

Сброс использования дает подписчикам Кодекса возможность переоценить модель с чистого листа, а OpenAI будет следить за теми же параллельными тестами, которые проводят ее пользователи. Более глубокий вопрос — это доверие: платящие разработчики, которые увидели деградацию флагмана в течение недели после запуска, теперь имеют документированное объяснение, три названных дефекта и сброс, а также новую причину сравнивать каждое обновление модели с днем ​​его выпуска.

Будьте впереди ИИ

Запуск моделей, вскрытие дефектов и инструменты, изменяющие работу программного обеспечения — отслеживаются каждый день.

Читать больше новостей об искусственном интеллекте →