OpenAI випустив GPT-6.1 Sol 29 вересня, вилучивши GPT-6 Sol лише через сім днів після дебюту цієї моделі, згідно з незалежною компанією з порівняльного аналізу Artificial Analysis. Обмін збігся з конференцією розробників компанії DevDay, на якій CNET повідомила, що учасники можуть негайно почати використовувати GPT-6.1 Sol разом із нещодавно запущеними агентами Dots і набором змін у підписці.
Семиденна заміна флагмана на флагман є незвичною навіть за прискореними стандартами 2026 року, і тести показують, чому OpenAI рухався швидко. Для безперервного висвітлення випусків моделей, змагань за порівняльні показники та цінової війни, що ведеться за ними, AI Buzz Wire відстежує важливі події, коли вони відбуваються.
Вимірний стрибок за сім днів
Artificial Analysis повідомляє, що GPT-6.1 Sol набирає 4 бали за індексом інтелекту компанії над GPT-6 Sol і на 5 балів над GPT-5.6 Sol, лише на 1 бал нижче GPT-6 Astra, найпродуктивнішої моделі OpenAI. Оцінка фірми поєднує міркування, роботу з знаннями, математику та агентські завдання в єдиний порівняльний бал.
Підбали показують, де зосереджені переваги. GPT-6.1 Sol покращив 4 бали в AA-Briefcase v1.1 і 5 балів у GDPval-AA v2.1, обидва з яких перевіряють роботу агентських знань. Стрибок на 12 балів у Terminal-Bench 4.0 вказує на суттєво кращу продуктивність у реальних термінальних середовищах, тоді як Humanity's Last Exam піднявся на 5 балів, а GDP.pdf — на 6.
Одна цифра виділяється для всіх, хто використовує моделі для дослідження: точність AA-Omniscience піднялася на 8 пунктів, а рівень галюцинацій знизився з 60 відсотків до 54 відсотків. Обидва показники залишаються високими в абсолютному вираженні, але напрямок руху має значення для робочих процесів, де впевнена неправильна відповідь гірша, ніж відсутність відповіді.
Та сама ціна наклейки, на практиці дешевше
Що стосується ціноутворення, GPT-6.1 Sol зберігає прейскурант GPT-6 Sol у розмірі 2 доларів США за мільйон вхідних токенів і 10 доларів США за мільйон вихідних токенів, але знижка на читання кешу зростає з 90 до 95 відсотків. Artificial Analysis зазначає, що змішана ціна GPT-6.1 Sol для агентських робочих навантажень, отже, дещо нижча, ніж у GPT-6 Sol, подовжуючи серію ефективних знижень цін, які почалися, коли GPT-6 Sol був запущений із 50-відсотковою знижкою до GPT-5.6 Sol.
Траєкторія ціноутворення – це справжня історія. Протягом двох випусків OpenAI приблизно вдвічі знизив ефективну вартість своєї передової лінії середнього рівня, щоразу підвищуючи якість.
Ціна за завдання: $0,72 проти $3,26
Ціна за завдання – ось де відставання від GPT-6 Astra стає суттєвим. При максимальних зусиллях штучний аналіз прив’язує GPT-6.1 Sol до 0,72 долара за завдання Індексу інтелекту, що становить менше чверті від 3,26 долара GPT-6 Astra. Порівняно з власним попередником економія становить 31 відсоток (1,05 долара за GPT-6 Sol), а порівняно з GPT-5,6 Sol – 64 відсотки (1,99 долара).
За словами фірми, кожен рівень GPT-6.1 Sol розширює межу економічної ефективності за Парето — це означає, що для даного рівня інтелекту серед моделей, які він відстежує, не існує дешевшого варіанту. Картина ефективності токенів більш неоднозначна: GPT-6.1 Sol споживає приблизно на 10-30 відсотків більше вихідних токенів, ніж GPT-6 Sol на всіх рівнях зусиль, хоча його низькі та середні параметри зусиль залишаються оптимальними за Парето для ефективності токенів, якщо врахувати вищий інтелект. У кодуванні модель отримала 3 бали над GPT-6 Sol за максимальних зусиль за індексом Coding Agent Index фірми.
Чому семиденна перевірка має значення
Більш широка таблиця DevDay підсилює ту саму картину. У звіті CNET конференція розглядалася навколо трьох речей, які розробники могли б використовувати відразу — GPT-6.1 Sol, агентів Dots і перероблених планів підписки — а не віддаленого попереднього перегляду. Меседж розробникам був доступний сьогодні, а не можливість завтра.
Флагман подає цей короткий сигнал про те, що конкурентне обмеження перемістилося з тренувальних прогонів на вдосконалення після тренувань та інфраструктуру обслуговування. Оновлення точкового рівня, яке постачається через тиждень, більше схоже на оптимізовану контрольно-пропускну точку та новий прайс-лист, ніж на базову модель із нуля, і конкуренти поводяться так само: Google анонсувала Gemini 4 Argon 30 вересня, передову модель, яка спочатку досягає надійних кіберзахисників через свою програму Fairwind за тією ж ціною 2/10 доларів за мільйон токенів.
Для розробників із перевірених цифр випливають три практичні висновки. По-перше, агентські робочі навантаження з інтенсивним повторним використанням кешу одразу отримують вигоду від 95-відсоткової знижки на кеш. По-друге, бюджети повинні моделювати більш високе споживання вихідних токенів перед міграцією, оскільки ціна за токен залишається незмінною, навіть якщо модель думає довше. По-третє, Astra залишається верхньою межею для завдань, де остання точка інтелекту коштує 4-кратної премії за вартість — випадок GPT-6.1 Sol полягає в тому, що для більшості робіт це не так.
Застереження, яке варто повторити: ці цифри походять від одного незалежного оцінювача, якою б суворою не була його методологія, а оцінки індексу винагороджують конкретні суміші робочого навантаження. Команди з високим навантаженням повинні повторно запустити власні оцінки, перш ніж перенаправляти виробничий трафік.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →