У четвер був встановлений новий стандарт для того, що означає «відкрито» в ШІ. Інститут штучного інтелекту в Абу-Дабі Institute of Foundation Models (IFM) випустив K2 Horizon, підключену групу з шести мовних моделей, яка постачається з усім: від остаточних ваг до навчальних даних, проміжних контрольних точок, навчального коду та детальних журналів — пакет, який Reuters описав як моделі з повністю відкритим вихідним кодом, випущені з навчальними даними та кодом.
Більшість випусків з відкритою вагою все ще зупиняються на вазі, залишаючи стороннім здогадуватися про те, як насправді були побудовані моделі. K2 Horizon використовує протилежний підхід, і його поява є важливим моментом для тих, хто стежить за [відкритими моделями штучного інтелекту] (https://aibuzzwire.news) у всій галузі.
Шість моделей, від годинника до підприємства
Парк охоплює шість типорозмірів: 375B-A23B, 36B-A4B, 32B, 7B, 3,7B і параметри 0,9B. Згідно з повідомленням IFM, моделі розроблені як одна підключена система, а не шість непов’язаних випусків.
Найменша модель призначена для жорстко обмежених умов, таких як годинники та окуляри, а моделі 3.7B і 7B призначені для телефонів та інших додатків на пристрої. Щільна модель 32B і розріджена модель 36B-A4B призначені для локальних робочих станцій і ефективного обслуговування, а флагманська модель 375B-A23B забезпечує найпотужніші можливості парку для розгортання вимогливих підприємств. Усі шість моделей постачаються з підтримкою квантування.
Моделі мають загальну основну архітектуру, лексику, методологію навчання, інтерфейси, інфраструктуру оцінювання та інструменти розгортання, а модель 0.9B використовує менший словниковий запас. IFM стверджує, що узгодженість полегшує перехід між розмірами, динамічну маршрутизацію по всьому парку та вивчення того, як масштабуються можливості.
Що насправді покриває "повністю відкритий".
Ось де K2 Horizon відходить від галузевих норм. Для кожної моделі в парку, IFM каже, що відкриває життєвий цикл навчання від попереднього навчання до міркування та агентського постнавчання.
Реліз містить проміжні контрольні точки, навчальні дані або детальні рецепти побудови даних, відкриту архітектурну документацію, композиції сумішей, навчальний код, конфігурації, детальні журнали навчання, результати оцінювання та кінцеві ваги. Моделі та код випускаються за ліцензією Apache 2.0, однією з найбільш дозволених у комерційному використанні. Набори даних оприлюднюються відповідно до відповідних ліцензій, таких як ODC-BY, і IFM зобов’язується розкривати, як дані були створені та змішані у випадках, коли перерозподіл неможливий.
IFM також розглядає випуск як перше відкрите сімейство моделей, яке розкриває повний процес розробки через агентське постнавчання. На практиці це означає, що дослідники можуть вивчати, як міркування, використання інструментів, планування та агентська поведінка виникають під час навчання, відтворювати методи та адаптувати їх до нових інструментів і областей — робота, яка зазвичай неможлива, коли публікуються лише остаточні ваги.
Претензії щодо продуктивності
IFM каже, що менші моделі парку дають нові сучасні результати у відповідних масштабах. Повідомляється, що моделі 0.9B, 3.7B і 7B лідирують у своїх класах розміру з математики, міркувань, загальних можливостей, кодування та агентських завдань.
Деякі деталі з анонсу: K2 Horizon 0.9B набирає понад 48 балів на AIME 2026, тесті змагань з математики, який залишається жорстоким для таких маленьких моделей. Моделі 3.7B і 7B відзначаються високими результатами SWE-bench і BrowseComp, вказуючи на незвичайну для їх розміру можливість розробки програмного забезпечення та багатоетапного перегляду. Модель 36B-A4B представляє новий механізм змішування цінності (MoVA), який IFM відзначає можливостями, що випереджають те, що може запропонувати підрахунок активних параметрів. Моделі 32B і 375B-A23B вважаються одними з найкращих у своїх класах.
Як і в будь-якій опублікованій лабораторією оцінці, ці цифри наводяться власноруч, а незалежна перевірка займе час. Але якщо цифри витримають, початковий і середній рівні парку можуть змінити те, що розробники очікують від моделей, які працюють на споживчому обладнанні.
Чому Абу-Дабі постійно з’являється у відкритому ШІ
Випуск посилює зростаючий вплив Об’єднаних Арабських Еміратів на розвиток відкритих моделей. Екосистема штучного інтелекту в Абу-Дабі, заснована на інституціях, зокрема MBZUAI, яка запустила систему міркування K2 Think разом з G42 у 2025 році, постійно позиціонує відкриті публікації як стратегічний фактор, який Reuters зафіксував у своєму висвітленні випуску в четвер.
Час також впливає на мінливий ринок відкритих моделей. Угода Nvidia про придбання Hugging Face приблизно за 12,9 мільярда доларів, про яку було оголошено цього тижня, підкреслила, яку комерційну цінність накопичили платформи розповсюдження відкритих моделей. Тим часом гіпермасштабувальники вишикувалися в чергу, щоб отримати ліцензію на моделі з відкритою вагою в китайських лабораторіях, а західні компанії штучного інтелекту опублікували лист із попередженням про передчасне обмеження на відкриті ваги.
На цьому тлі прикордонний флот, який публікує весь свій навчальний курс, дає дослідникам, стартапам та урядам альтернативу залежати від закритих API від кількох постачальників із США.
Що дивитися далі
Три запитання визначатимуть, чи має K2 Horizon значення поза заголовками. По-перше, чи можуть незалежні оцінювачі відтворити результати порівняльного тесту, особливо для крихітних моделей, твердження яких є найбільш вражаючими? По-друге, наскільки дозвільними є ліцензії на набори даних на практиці, враховуючи те, що IFM визнає, що деякі навчальні дані не можна перерозповсюджувати, а натомість вони документуються за рецептом? По-третє, чи справді підприємства розгортатимуть розріджену модель 375B поза великою хмарою, чи практичний вплив зосередиться на рівні 7B і нижче, який працює на телефонах і ноутбуках?
Найвірогідніший негайний ефект – це прозорість досліджень. Завдяки контрольно-пропускним пунктам, журналам і рецептам даних K2 Horizon дає повний робочий приклад того, як будується сучасна сім’я моделей, що базується на міркуваннях і агентах — чого спільнота ніколи не мала в такому масштабі.
Будьте попереду всіх великих розробок ШІ
З кожним місяцем випуск моделей відбувається швидше. Будьте в курсі кожного запуску та тестування, перш ніж це матиме значення.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →