Китайская лаборатория искусственного интеллекта Moonshot AI представила Kimi K3 16 июля 2026 года, выпустив то, что она называет «первой в мире открытой моделью 3T-класса» — систему с 2,8 триллионами параметров, которая сокращает разрыв с самыми мощными запатентованными моделями от Anthropic и OpenAI. Запуск сразу стал одним из самых обсуждаемых релизов года, посвященных искусственному интеллекту, достигнув вершины Hacker News и получив освещение в Reuters, Bloomberg и The New York Times.

Для более широкого освещения отрасли искусственного интеллекта Kimi K3 имеет значение, поскольку он резко расширяет границы моделей с открытым весом, одновременно вызывая новые дебаты о том, могут ли свободно загружаемые системы соответствовать закрытым. Moonshot сообщает, что полный вес модели будет опубликован к 27 июля 2026 года.

Открытая модель с 2,8 триллионами параметров

Согласно техническому объявлению Moonshot, Kimi K3 представляет собой модель с 2,8 триллионами параметров, построенную на двух архитектурных обновлениях, которые компания называет Kimi Delta Attention (KDA) и Attention Residuals (AttnRes). Он использует структуру Mixture-of-Experts (MoE), которая активирует только 16 из 896 экспертов для каждого данного токена, в сочетании с тем, что Moonshot описывает как стабильную структуру LatentMoE. Компания утверждает, что эти изменения приводят примерно к 2,5-кратному повышению общей эффективности масштабирования по сравнению с предыдущей моделью Kimi K2.

Модель также поставляется со встроенными возможностями видения и контекстным окном на один миллион токенов. Аналитик Саймон Уиллисон в своем блоге отметил, что Kimi K3 берет корону открытого размера у DeepSeek v4 Pro с 1,6 триллиона параметров — «более чем в два раза больше» предшественника Kimi K2.6 с 1 триллионом параметров.

Moonshot называет этот релиз последним шагом в устойчивом стремлении к масштабированию, заявляя, что в течение девяти из последних двенадцати месяцев ее модели устанавливали верхнюю границу размеров открытых моделей.

Сравнительные показатели

Собственный оценочный пакет Moonshot ставит Kimi K3 по общей производительности позади только двух проприетарных систем — Claude Fable 5 от Anthropic и GPT-5.6 Sol от OpenAI — при этом он постоянно превосходит другие протестированные модели, включая Claude Opus 4.8 и GPT-5.5. Сторонний анализ в целом отслеживает эти утверждения.

Независимая служба оценки Artificial Analysis сообщила, что в своем частном долгосрочном тесте интеллектуального труда Kimi K3 достиг общего балла Elo 1547 — скачок на 732 пункта по сравнению с Kimi K2.6 и уступая только Claude Fable 5. На арене Frontend Code Arena.ai Kimi K3 поднялся на первое место, превзойдя даже Claude Fable 5, согласно сообщению в таблице лидеров, которое широко распространилось после запуска.

Ценообразование является заметной частью истории. Искусственный анализ оценил среднюю стоимость задачи на уровне 0,94 доллара, что сопоставимо с 1,04 доллара США у GPT-5.6 Sol и примерно вдвое меньше 1,80 доллара США у Claude Opus 4.8, отметив при этом, что Kimi K3 использовал на 21% меньше выходных токенов, чем его предшественник. В расчете на один токен модель оценивается в 3 доллара за миллион входных токенов и 15 долларов за миллион выходных токенов — тот же уровень, что и серия Anthropic Claude Sonnet, и, как заметил Уиллисон, это самая дорогая модель, выпущенная китайской лабораторией искусственного интеллекта на сегодняшний день, по сравнению с Kimi K2.6, цена которой составляет 0,95 доллара за 4 доллара.

Агентское кодирование и компилятор, который он построил сам

Большая часть заявления Moonshot была сосредоточена не на тестах чат-ботов, а на долгосрочных агентских задачах. Компания заявляет, что Kimi K3 может выдерживать расширенные сеансы проектирования, перемещаться по большим репозиториям кода и управлять инструментами терминала с минимальным контролем со стороны человека.

В ходе одной из демонстраций Moonshot рассказал, что ранняя версия Kimi K3 взяла на себя большую часть собственной работы команды по оптимизации ядра графического процессора на поздней стадии разработки. В другом случае модель создала «MiniTriton», компактный компилятор графического процессора, подобный Triton, с собственным промежуточным представлением на уровне фрагментов, проходами оптимизации и конвейером генерации кода PTX. Moonshot утверждает, что MiniTriton соответствовал или превосходил устоявшиеся стеки Triton и torch.compile по поддерживаемым тестам линии крыши и устойчивому сквозному обучению nanoGPT со стабильной конвергенцией.

Компания также продемонстрировала поразительное подтверждение концепции дизайна чипов. Сообщается, что за один 48-часовой автономный запуск Кими К3 спроектировал, оптимизировал и проверил чип, созданный для обслуживания нано-модели на собственной архитектуре, используя инструменты EDA с открытым исходным кодом на базе 45-нм библиотеки Nangate. В Moonshot заявили, что конструкция обеспечивает максимальную синхронизацию на частоте 100 МГц в пределах 4 мм² и поддерживает пропускную способность декодирования более 8700 токенов в секунду при моделировании.

Что касается исследований, Муншот сообщил, что Кими K3 воспроизвел универсальные отношения I-Love-Q из вычислительной астрофизики примерно за два часа — работа, по оценкам компании, обычно занимает у исследователя от одной до двух недель — путем перекрестной проверки более 20 статей, реализации полного численного конвейера для более чем 300 уравнений состояния и написания более 3000 строк Python.

Дебаты в открытом весе возвращаются

Прибытие Кими K3 вновь разжигает дебаты, которые продолжались до 2026 года, поскольку китайские лаборатории неоднократно сокращали — или, казалось, сокращали — дистанцию с передовыми моделями США. Схема теперь знакома: китайский релиз публикует цифры, о которых сообщают сами пользователи, в верхней части списка лидеров, западные лаборатории подчеркивают свое все еще растущее преимущество, а предприятия сопоставляют стоимость и открытость с необработанными возможностями.

Это напряжение заметно в ценах. Модель, которая уступает Claude Opus 4.8 по цене за задачу, приближаясь к ее возможностям, но в то же время взимает больше, чем любая предыдущая китайская версия, отражает уверенность Moonshot в том, что она может устанавливать более высокие цены даже в открытой экосистеме. Уиллисон предостерег от слишком большого внимания к какому-либо отдельному тесту — его длительный тест «пеликан на велосипеде», как он написал, больше не коррелирует надежно с реальным качеством — но сказал, что релиз по-прежнему вознаграждает практическое тестирование.

Kimi K3 теперь доступен через Kimi.com, настольный агент Kimi Work, инструмент разработчика Kimi Code и Kimi API. Moonshot заявила, что работает с партнерами по инференсу и сопровождающими с открытым исходным кодом, чтобы обеспечить надежное развертывание перед выпуском полной версии.

Будьте впереди ИИ

Для постоянного освещения выпусков моделей, сражений в тестах и границ открытого веса следите за [AI Buzz Wire] (https://aibuzzwire.news), чтобы узнать о разработках, формирующих глобальную гонку искусственного интеллекта.

Подробнее о моделях искусственного интеллекта →