Что дает H3
По данным агентства Reuters, модель MiniMax H3 может генерировать видеоклипы с разрешением 2K — заметный шаг вперед по сравнению с выходом 1080p, который был фактическим стандартом для большинства потребительских инструментов искусственного интеллекта для обработки видео. Модель также воспроизводит стереозвук, синхронизированный с сгенерированным отснятым материалом, — возможность, которая остается редкой в области создания видео, где большинство моделей выводят немые клипы, требующие отдельного аудиоконвейера.
Возможно, наиболее стратегически важным решением является стремление MiniMax к открытым весам. Газета South China Morning Post сообщила, что MiniMax выпускает H3 с весами моделей с открытым исходным кодом и по цене, намеренно уступающей конкурентам — сочетание, которое издание рассматривает как прямой вызов закрытому коммерческому подходу ByteDance. Открытые веса позволяют разработчикам и исследователям загружать, проверять, настраивать и развертывать модель в своей собственной инфраструктуре, а не полагаться исключительно на размещенный API.
По данным AIBase, MiniMax описал H3 как «всемодальную» модель, предположив, что она предназначена для обработки нескольких типов ввода и вывода — текста, изображения, аудио и видео — в рамках единой архитектуры, а не требует объединения отдельных специализированных моделей.
Реакция рынка
Инвесторы отреагировали незамедлительно. Finance.biggo.com сообщил, что акции MiniMax выросли почти на 13% после объявления в третьем полугодии, что отражает уверенность рынка в том, что агрессивное ценообразование и стратегия открытого веса компании могут привлечь внимание разработчиков в категории, где экосистема ByteDance Doubao удерживает лидерство.
Ценовая война реальна. SCMP отметил, что MiniMax предлагает видео, созданное в формате H3, по цене, существенно ниже существующих ставок, делая ставку на то, что более низкие цены за поколение привлекут большое количество пользователей — от создателей социальных сетей до маркетинговых агентств и независимых кинематографистов — которые очень чувствительны к стоимости каждого клипа.
ByteDance наносит ответный удар Seedance 2.5
ByteDance не оставил момент без ответа. В то же время компания выпустила Seedance 2.5, последнюю версию своей модели создания видео. По данным Pandaily и CineD, Seedance 2.5 может создавать 30-секундные видеоролики за одно поколение — значительное улучшение по сравнению с более ранними моделями, которые обычно требовали объединения более коротких клипов для получения более длинных последовательностей.
CineD сообщил, что Seedance 2.5 принимает до 50 эталонных входных данных, что позволяет пользователям управлять созданием с помощью нескольких изображений, текстовых подсказок и визуальных ссылок одновременно. В модели также реализованы блокировки 3D-камеры, которые дают создателям возможность на уровне режиссера контролировать движение виртуальной камеры (панорамирование, тележки и траектории движения) в созданных сценах. TechNode и Tech в Азии подтвердили возможности мультивхода и редактирования модели, позиционируя ее как инструмент для более сложного, повествовательного видеопроизводства.
CNET ранее сообщал, что Seedance 2.5, как ожидается, будет запущен «уже на этой неделе», а одновременный выпуск с MiniMax H3 подчеркивает, насколько сжатым стал конкурентный цикл в китайском видео с искусственным интеллектом.
Почему гонка видеоИИ имеет значение
Соперничество MiniMax и ByteDance — это больше, чем просто региональная стычка. Создание видео с помощью ИИ стало одним из наиболее капиталоемких и технически сложных направлений в области искусственного интеллекта, требующих огромных вычислительных ресурсов для обучения и вывода. Глобальные конкуренты, в том числе Sora от OpenAI, Veo от Google и растущее число стартапов, стремятся создавать более длинное видео с более высоким разрешением и более управляемым видео из текстовых и графических подсказок.
Видеоэкосистема искусственного интеллекта в Китае развивалась с особой скоростью. Решение MiniMax открыть весы H3 с открытым исходным кодом следует более широкой модели китайских лабораторий искусственного интеллекта, включая DeepSeek, производителя Qwen Alibaba и других, по выпуску мощных моделей с открытым исходным кодом для создания экосистем разработчиков и установления технического доверия, даже за счет краткосрочной коммерческой эксклюзивности.
Особенно примечательно включение стереозвука в H3. Большинство моделей генерации видео сегодня производят только визуальный вывод, оставляя звук как отдельный шаг, часто выполняемый вручную. Если MiniMax действительно решит проблему синхронизированной генерации звука с разрешением 2K, это станет значимой вехой в интеграции, хотя для оценки фактического качества и надежности вывода потребуются независимые тесты и практические оценки.
Вопрос открытого веса
Выпуск MiniMax в открытом весе также вновь разжигает дебаты, которые раскололи индустрию искусственного интеллекта. Сторонники утверждают, что открытые веса ускоряют исследования, обеспечивают контроль безопасности и снижают барьеры для мелких разработчиков. Критики, в том числе некоторые пограничные западные лаборатории, утверждают, что выпуск мощных генеративных моделей открыто увеличивает риск неправильного использования, от дипфейков до дезинформации.
На данный момент MiniMax делает ставку на то, что добрая воля разработчиков и привязанность экосистемы к открытым весам перевесят любые конкурентные недостатки. Оправдается ли эта ставка, будет зависеть от принятия: если H3 станет инструментом по умолчанию для создателей видео в Китае и за его пределами, стратегия открытого веса может оказаться столь же важной для видеоИИ, как релизы Meta Llama для текста.
Однако непосредственная конкуренция очевидна. Две крупнейшие китайские компании, занимающиеся искусственным интеллектом, в один и тот же день сделали свои последние выстрелы в войнах за поколение видео, и темпы этого процесса только ускоряются.
---
Будьте впереди ИИПолучайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

