ByteDance тренує модель штучного інтелекту з 10 трильйонами параметрів, систему, яка може наблизитися до масштабу передової моделі Mythos від Anthropic і різко підвищити ставки в глобальній гонці ШІ. Financial Times повідомила про план 7 серпня 2026 року з посиланням на людей, обізнаних у цьому питанні, а Reuters та інші видання згодом підтвердили деталі.
Конструкція є останнім сигналом того, що китайські технологічні фірми відмовляються поступатися передовими моделями своїм американським конкурентам. Щоб постійно отримувати [найновіші новини штучного інтелекту] (https://aibuzzwire.news) і аналізувати, де знаходиться кожна лабораторія, AI Buzz Wire стежить за розвитком цієї історії.
Що означає цифра в 10 трильйонів параметрів
Параметри моделі — це числові ваги, які вона вивчає з даних навчання для розпізнавання шаблонів, генерування тексту та виконання завдань. Вони широко використовуються як приблизний показник масштабу, хоча дослідники попереджають, що лише кількість параметрів не визначає, наскільки спроможна модель. Не менш важливе значення мають методи навчання, якість даних і архітектура.
Незважаючи на це, ціль у 10 трильйонів параметрів є важливою. За такого розміру модель ByteDance була б більш ніж у три рази більша за Kimi K3 від Moonshot AI, яка нараховує 2,8 трильйона параметрів і наразі є однією з найамбітніших китайських зусиль на сьогоднішній день.
До випуску Kimi K3 LongCat-2.0 від Meituan і V4-Pro від DeepSeek лідирували у внутрішньому полі Китаю з приблизно 1,6 трильйонами параметрів кожна, тоді як кілька інших китайських лабораторій перетнули поріг у трильйони параметрів. Запланована система ByteDance залишить їх усіх позаду з великим відривом.
Усунення розриву з Anthropic's Mythos
Пряме порівняння з провідними американськими моделями складно, оскільки такі компанії, як Anthropic і OpenAI, публічно не розголошують кількість параметрів для систем, включаючи Fable, Mythos або GPT-5.5. Однак Financial Times наводить галузеві оцінки, згідно з якими найдосконаліша Mythos 5 від Anthropic має приблизно вісім трильйонів параметрів, а Fable 5 — близько п’яти трильйонів.
Це поставило б майбутню модель ByteDance близько до Mythos, системи, яка вважається однією з найпотужніших передових моделей. Досягнення цього масштабу ознаменувало б віху для китайської лабораторії та загострило б питання про те, чи нарешті розрив параметрів між американською та китайською прикордонними моделями скорочується.
Зазначається, що ByteDance не відразу відповів на запити про коментарі.
Попередня підготовка вже триває
Як повідомляє Financial Times, модель ByteDance зараз проходить попередню підготовку. Попереднє навчання є найбільш інтенсивним етапом розробки великої моделі, і цей процес зазвичай триває від трьох до шести місяців, перш ніж система може бути налаштована та випущена.
Цей графік свідчить про те, що до публічного випуску ще кілька місяців, хоча рішення розпочати попередню підготовку в такому масштабі відображає серйозне зобов’язання, забезпечене ресурсами. Попереднє навчання моделі з 10 трильйонами параметрів вимагає величезних кластерів спеціалізованих чіпів і величезної кількості електроенергії, витрати, які можуть покрити лише кілька компаній у світі.
ByteDance, найбільш відома як материнська компанія TikTok і Douyin, раніше окреслила штучний інтелект як один із своїх чотирьох стратегічних пріоритетів на 2026 рік. Компанія просуває генеративний штучний інтелект за допомогою свого чат-бота Doubao та відеомоделі Seedance, але передова мовна модель представлятиме її найамбітнішу спробу, щоб конкурувати прямо з провідними лабораторіями.
Чому параметрична гонка озброєнь має значення
Поштовх, про який повідомляється, відбувається в той час, як китайські технологічні фірми продовжують прискорювати цикли випуску своїх моделей, борючись із конкурентами з США, щоб створити більш потужні системи, не роблячи їх надмірно дорогими в експлуатації. Ця стратегія призвела до купи релізів протягом 2026 року, від Kimi K3 від Moonshot до лінійки Qwen3 від Alibaba та серії V4 від DeepSeek.
У той же час ширше політичне середовище змінюється. Пекін посилює контроль над експортом своїх найкращих моделей і чіпів штучного інтелекту, що може обмежити доступ за кордон саме до тих передових систем, які зараз будує ByteDance. Модель з 10 трильйонами параметрів, розроблена в рамках цих обмежень, буде потужною системою, яка в основному обслуговується всередині країни.
Для самих лабораторій обчислення все більше пов’язані з економікою. Великі моделі є потужнішими, але набагато дорожчими для навчання та експлуатації, і галузь розділилася щодо того, чи визначить наступного переможця необроблений масштаб чи розумніша архітектура та подальше навчання.
Більша картина
План ByteDance підкреслює ширшу тенденцію: розрив між найбільшими американськими та китайськими передовими моделями, який колись вважався нездоланним, здається, скорочується. Якщо галузеві оцінки розміру Mythos є точними, модель ByteDance на тому ж полі буде означати значуще скорочення цієї відстані.
Це також посилює тиск на OpenAI, Anthropic і Google, щоб зберегти лідерство. Оскільки китайські фірми зараз націлені на трильйони параметричних систем, а західні лабораторії шукають дедалі більших архітектур, гонка параметрів майже не сповільнюється — навіть тоді, коли дослідники сперечаються про те, наскільки необроблені цифри справді важливі.
Залишайтеся попереду гонки AI
Ландшафт передової моделі розвивається швидше, ніж будь-коли. Додайте нашу домашню сторінку в закладки для останніх розробок AI та детального висвітлення кожного основного випуску.
Читати більше новин AI →