ByteDance обучает модель искусственного интеллекта с 10 триллионами параметров — систему, которая может приблизиться к масштабам передовой модели Mythos от Anthropic и резко поднять ставки в глобальной гонке ИИ. Газета Financial Times сообщила об этом плане 7 августа 2026 года со ссылкой на людей, знакомых с этим вопросом, а Reuters и другие издания впоследствии подтвердили детали.
Эта сборка является последним сигналом того, что китайские технологические компании отказываются уступать гонку передовых моделей своим американским конкурентам. Для постоянного последних новостей об искусственном интеллекте и анализа положения каждой лаборатории AI Buzz Wire отслеживает эту историю по мере ее развития.
Что означает цифра в 10 триллионов параметров
Параметры модели — это числовые веса, которые она извлекает из обучающих данных для распознавания шаблонов, генерации текста и выполнения задач. Они широко используются в качестве приблизительного показателя масштаба, хотя исследователи предупреждают, что само по себе количество параметров не определяет, насколько работоспособна модель. Методы обучения, качество данных и архитектура имеют не меньшее значение.
Несмотря на это, цель в 10 триллионов параметров является значительной. При таком размере модель ByteDance будет более чем в три раза больше, чем модель Kimi K3 от Moonshot AI, которая насчитывает 2,8 триллиона параметров и в настоящее время представляет собой одну из самых амбициозных китайских проектов на сегодняшний день.
До выпуска Kimi K3, LongCat-2.0 от Meituan и V4-Pro от DeepSeek лидировали на внутреннем рынке Китая с примерно 1,6 триллиона параметров каждый, в то время как несколько других китайских лабораторий преодолели порог в триллион параметров. Запланированная система ByteDance оставила бы их всех позади с большим отрывом.
Устранение разрыва с помощью мифов Anthropic
Прямое сравнение с ведущими американскими моделями затруднено, поскольку такие компании, как Anthropic и OpenAI, публично не раскрывают количество параметров таких систем, как Fable, Mythos или GPT-5.5. Однако Financial Times привела отраслевые оценки, согласно которым самый продвинутый Mythos 5 от Anthropic имеет примерно восемь триллионов параметров, а Fable 5 — около пяти триллионов.
Это приблизит по размеру будущую модель ByteDance к Mythos, системе, которую многие считают одной из самых мощных доступных моделей. Достижение такого масштаба станет важной вехой для китайской лаборатории и усилит вопросы о том, сужается ли наконец разрыв в параметрах между моделями пограничных стран США и Китая.
В отчетах отмечается, что ByteDance не сразу ответила на запросы о комментариях.
Предварительная подготовка уже ведется
По данным Financial Times, модель ByteDance в настоящее время проходит предварительное обучение. Предварительное обучение — это наиболее трудоемкий этап разработки большой модели, и этот процесс обычно длится от трех до шести месяцев, прежде чем систему можно будет точно настроить и выпустить.
Этот график предполагает, что до публичного релиза еще несколько месяцев, хотя решение начать предварительное обучение в таком масштабе отражает серьезное и хорошо обеспеченное ресурсами обязательство. Предварительное обучение модели с 10 триллионами параметров требует огромных кластеров специализированных чипов и огромного количества электроэнергии — затраты, которые могут покрыть лишь несколько компаний в мире.
ByteDance, наиболее известная как материнская компания TikTok и Douyin, ранее обозначила искусственный интеллект в качестве одного из своих четырех стратегических приоритетов на 2026 год. Компания продвигает генеративный искусственный интеллект с помощью своего чат-бота Doubao и видеомодели Seedance, но языковая модель передового масштаба будет представлять собой ее самую амбициозную попытку конкурировать лицом к лицу с ведущими лабораториями.
Почему важна гонка вооружений по параметрам
Сообщается, что этот толчок происходит на фоне того, что китайские технологические компании продолжают ускорять циклы выпуска своих моделей, сражаясь с американскими конкурентами за создание более мощных систем, не делая их эксплуатацию непомерно дорогими. Эта стратегия привела к появлению множества релизов в течение 2026 года: от Kimi K3 от Moonshot до линейки Qwen3 от Alibaba и серии V4 от DeepSeek.
В то же время, более широкая политическая среда меняется. Пекин рассматривает возможность ужесточения экспортного контроля над своими ведущими моделями и чипами искусственного интеллекта, что может ограничить зарубежный доступ именно к тем передовым системам, которые сейчас строит ByteDance. Модель с 10 триллионами параметров, разработанная с учетом этих ограничений, могла бы стать мощной системой, в основном обслуживаемой внутри страны.
Что касается самих лабораторий, расчеты все больше связаны с экономикой. Более крупные модели более функциональны, но гораздо дороже в обучении и эксплуатации, и в отрасли существуют разногласия по поводу того, будет ли следующий победитель определяться по чистому масштабу или по более разумной архитектуре, а последующее обучение будет определяться.
Общая картина
План ByteDance подчеркивает более широкую тенденцию: разрыв между крупнейшими американскими и китайскими пограничными моделями, который когда-то считался непреодолимым, похоже, сокращается. Если отраслевые оценки размера Mythos точны, модель ByteDance на том же стадионе будет представлять собой значимое сокращение этого расстояния.
Это также усиливает давление на OpenAI, Anthropic и Google, чтобы они сохранили свое лидерство. Поскольку китайские фирмы сейчас нацелены на системы с более чем триллионами параметров, а западные лаборатории разрабатывают все более крупные архитектуры, гонка параметров не имеет никаких признаков замедления — даже несмотря на то, что исследователи спорят о том, насколько действительно важны необработанные цифры.
Будьте впереди гонки ИИ
Ландшафт передовой модели развивается быстрее, чем когда-либо. Добавьте нашу домашнюю страницу в закладки, чтобы получать последние разработки в области искусственного интеллекта и подробное освещение всех основных выпусков.
Подробнее новости AI →