OpenAI выпустила GPT-6.1 Sol 29 сентября, отказавшись от GPT-6 Sol всего через семь дней после дебюта этой модели, по данным независимой фирмы по сравнительному анализу Artificial Analysis. Обмен совпал с конференцией разработчиков DevDay, на которой CNET сообщил, что участники могут начать использовать GPT-6.1 Sol сразу же вместе с недавно запущенными агентами Dots и рядом изменений в подписке.

Семидневная замена флагмана на флагман является необычной даже по ускоренным стандартам 2026 года, и тесты показывают, почему OpenAI продвинулся так быстро. Чтобы постоянно освещать запуски моделей, борьбу за контрольные показатели и стоящую за ними ценовую войну, AI Buzz Wire отслеживает важные события по мере их возникновения.

Измеримый скачок за семь дней

Искусственный анализ сообщает, что GPT-6.1 Sol набирает 4 балла в индексе интеллекта фирмы по сравнению с GPT-6 Sol и на 5 баллов по сравнению с GPT-5.6 Sol, оказываясь всего на 1 балл ниже GPT-6 Astra, самой эффективной модели OpenAI. Оценка фирмы объединяет рассуждения, интеллектуальную работу, математику и агентские задачи в единый сравнительный балл.

Промежуточные оценки показывают, где концентрируются выгоды. GPT-6.1 Sol улучшился на 4 балла в AA-Briefcase v1.1 и на 5 баллов в GDPval-AA v2.1, оба из которых проверяют работу агентских знаний. Скачок на 12 пунктов в Terminal-Bench 4.0 указывает на существенное улучшение производительности в реальных терминальных средах, в то время как «Последний экзамен человечества» поднялся на 5 пунктов, а GDP.pdf — на 6.

Одна цифра выделяется для всех, кто использует модели для исследований: точность АА-Всеведения выросла на 8 пунктов, а уровень галлюцинаций упал с 60 процентов до 54 процентов. Обе цифры остаются высокими в абсолютном выражении, но направление движения имеет значение для рабочих процессов, где уверенный неправильный ответ хуже, чем отсутствие ответа.

Та же цена, но на практике дешевле

Что касается цен, GPT-6.1 Sol сохраняет прейскурант GPT-6 Sol в размере 2 долларов США за миллион входных токенов и 10 долларов США за миллион выходных токенов, но скидка на чтение кэша увеличивается с 90 до 95 процентов. Искусственный анализ отмечает, что смешанная цена GPT-6.1 Sol для агентских рабочих нагрузок поэтому немного ниже, чем у GPT-6 Sol, продолжая серию эффективных снижений цен, которая началась, когда GPT-6 Sol был запущен с 50-процентной скидкой по сравнению с GPT-5.6 Sol.

Траектория ценообразования здесь является реальной историей. За два выпуска OpenAI дважды снизила эффективную стоимость своей линии среднего уровня примерно вдвое, каждый раз повышая качество.

Стоимость за задачу: 0,72 доллара США против 3,26 доллара США.

В цене за задачу разрыв с GPT-6 Astra становится резким. При максимальных усилиях Искусственный анализ оценивает GPT-6.1 Sol в 0,72 доллара за задачу индекса интеллекта, что составляет менее четверти от 3,26 доллара GPT-6 Astra. По сравнению со своим предшественником экономия составляет 31 процент (1,05 доллара за GPT-6 Sol), а по сравнению с GPT-5,6 Sol достигает 64 процентов (1,99 доллара).

По данным компании, каждый уровень усилий GPT-6.1 Sol выходит за границу Парето-экономичности — это означает, что для данного уровня интеллекта среди отслеживаемых моделей не существует более дешевого варианта. Картина эффективности токенов более неоднозначная: GPT-6.1 Sol потребляет примерно на 10–30 процентов больше выходных токенов, чем GPT-6 Sol, на всех уровнях усилий, хотя его настройки низкого и среднего усилия остаются оптимальными по Парето для эффективности токенов, если принять во внимание более высокий интеллект. В кодировании модель получила 3 ​​балла по сравнению с GPT-6 Sol при максимальных усилиях по индексу агента кодирования фирмы.

Почему семидневный срок важен

Более широкий список DevDay подтверждает ту же картину. В отчете CNET конференция была посвящена трем вещам, которые разработчики могли бы использовать сразу: GPT-6.1 Sol, агенты Dots и переработанные планы подписки, а не отдаленному предварительному исследованию. Разработчикам было послано сообщение о доступности сегодня, а не о возможности завтра.

Флагманские ритмы — это короткий сигнал о том, что конкурентные ограничения сместились с тренировочных заездов на посттренировочную доработку и обслуживание инфраструктуры. Обновление на уровне точки, которое будет выпущено через неделю, больше похоже на оптимизированную контрольную точку и новый прайс-лист, чем на базовую модель, созданную с нуля, и конкуренты ведут себя точно так же: 30 сентября Google анонсировала Gemini 4 Argon, передовую модель, которая первоначально достигает доверенных киберзащитников через свою программу Fairwind по той же цене $2/$10 за миллион токенов.

Из проверенных цифр для разработчиков следует три практических вывода. Во-первых, агентские рабочие нагрузки с интенсивным повторным использованием кэша сразу же получают выгоду от 95-процентной скидки на кэш. Во-вторых, бюджеты должны моделировать более высокое потребление токенов на выходе перед миграцией, поскольку цена за токен остается неизменной, даже если модель думает дольше. В-третьих, Astra остается потолком для задач, где последняя точка интеллекта стоит четырехкратной надбавки к затратам — в случае GPT-6.1 Sol для большинства работ это не так.

Предостережение, которое стоит повторить: эти цифры получены от одного независимого оценщика, какой бы строгой ни была его методология, а баллы индекса соответствуют конкретному сочетанию рабочей нагрузки. Командам с высокими рабочими нагрузками следует повторно провести собственные оценки, прежде чем перенаправлять производственный трафик.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →