MiniMax, пекінський стартап штучного інтелекту, представив свою останню модель покоління відео, H3, 31 липня 2026 року, посиливши і без того запеклу боротьбу за домінування у створеному ШІ відео. Цей випуск позиціонує MiniMax безпосередньо проти ByteDance, яка того ж тижня випустила власну оновлену модель Seedance 2.5 у тому, що Bloomberg описав як «дуельне» зіткнення між двома найамбітнішими китайськими компаніями ШІ. Щоб постійно стежити за [останніми розробками штучного інтелекту] (https://aibuzzwire.news), слідкуйте за нашими прямими репортажами.

Що пропонує H3

За даними Reuters, модель MiniMax H3 може генерувати відеоролики з роздільною здатністю 2K — помітний крок у порівнянні з виводом 1080p, який був стандартом де-факто для більшості інструментів штучного інтелекту для відео. Модель також створює стереозвук, синхронізований зі згенерованим відеоматеріалом, можливість, яка залишається рідкісною у сфері створення відео, де більшість моделей виводять беззвучні кліпи, для яких потрібен окремий аудіоконвеєр.

Мабуть, найбільш стратегічно важливим рішенням є прихильність MiniMax відкритим вагам. South China Morning Post повідомила, що MiniMax випускає H3 з вагою моделі з відкритим вихідним кодом і за ціною, навмисно нижчою від конкурентів — поєднання, яке публікація представила як прямий виклик закритому комерційному підходу ByteDance. Відкриті ваги дозволяють розробникам і дослідникам завантажувати, перевіряти, налаштовувати та розгортати модель на власній інфраструктурі, а не покладатися виключно на розміщений API.

MiniMax описав H3 як «всемодальну» модель, згідно з AIBase, припускаючи, що вона розроблена для обробки кількох типів введення та виведення — тексту, зображень, аудіо та відео — в рамках однієї архітектури, а не потребує окремих спеціалізованих моделей, об’єднаних разом.

Реакція ринку

Інвестори відреагували швидко. Finance.biggo.com повідомив, що акції MiniMax зросли майже на 13% після оголошення H3, відображаючи впевненість ринку в тому, що агресивне ціноутворення та стратегія відкритої ваги компанії можуть захопити розум розробників у категорії, де екосистема Doubao ByteDance утримує переважне лідерство.

Цінова війна реальна. SCMP зазначив, що MiniMax пропонує відео, згенероване за допомогою H3, за ціною, значно нижчою за поширені тарифи, роблячи ставку на те, що нижчі ціни за покоління привернуть велику кількість користувачів — від творців соціальних медіа до маркетингових агентств і незалежних режисерів — які дуже чутливі до вартості кліпу.

ByteDance дає відповідь Seedance 2.5

ByteDance не залишив момент без відповіді. У цей же час він випустив Seedance 2.5, останню ітерацію своєї моделі створення відео. За даними Pandaily і CineD, Seedance 2.5 може створювати 30-секундні відео в одному поколінні — це суттєве покращення в порівнянні з попередніми моделями, які зазвичай вимагали зшивання коротших кліпів для отримання більшої послідовності.

CineD повідомляє, що Seedance 2.5 приймає до 50 посилань, дозволяючи користувачам керувати створенням кількох зображень, текстових підказок і візуальних посилань одночасно. У моделі також представлено блокування 3D-камери, що дає авторам можливість режисерського контролю над рухом віртуальної камери — панорамуванням, візком і траєкторією орбіти — у згенерованих сценах. TechNode і Tech в Азії підтвердили можливості моделі з кількома входами та редагуванням, позиціонуючи її як інструмент для більш складного створення відео, орієнтованого на розповідь.

Раніше CNET повідомляв, що Seedance 2.5, як очікується, буде запущено «вже цього тижня», і одночасний випуск із MiniMax H3 підкреслює, наскільки стислим став конкурентний цикл у китайському відео ШІ.

Чому змагання зі штучним інтелектом мають значення

Суперництво MiniMax проти ByteDance — це більше, ніж регіональна сутичка. Створення відео зі штучним інтелектом стало одним із найбільш капіталомістких і технічно вимогливих напрямків штучного інтелекту, що потребує величезних обчислювальних ресурсів для навчання та висновків. Глобальні конкуренти, включаючи Sora від OpenAI, Veo від Google і все більше стартапів, змагаються, щоб створювати довші відео з вищою роздільною здатністю та більш керованими з тексту та зображень.

Китайська відеоекосистема штучного інтелекту розвивалася з особливою швидкістю. Рішення MiniMax про відкриті ваги H3 слідує ширшій моделі китайських лабораторій штучного інтелекту, включаючи DeepSeek, виробника Qwen Alibaba та інших, щодо випуску потужних відкритих моделей для створення екосистем розробників і встановлення технічної надійності, навіть ціною короткострокової комерційної ексклюзивності.

Включення стереозвуку в H3 особливо помітно. Більшість моделей генерації відео сьогодні створюють лише візуальний вихід, залишаючи аудіо як окремий, часто ручний крок. Якщо MiniMax справді вирішила синхронізовану генерацію аудіо з роздільною здатністю 2K, це стане важливою віхою інтеграції, хоча для оцінки фактичної якості та надійності виходу знадобляться незалежні тести та практичні оцінки.

Відкрите питання

Відкритий випуск MiniMax також знову розпалює дебати, які розкололи галузь ШІ. Прихильники стверджують, що відкриті ваги прискорюють дослідження, дозволяють перевіряти безпеку та знижують бар’єри для менших розробників. Критики — включно з деякими західними передовими лабораторіями — стверджують, що відкрите оприлюднення потужних генеративних моделей підвищує ризик неправомірного використання, від глибоких фейків до дезінформації.

Наразі MiniMax робить ставку на те, що добра воля розробників і прив’язаність до екосистеми через відкриті ваги переважать будь-який конкурентний недолік. Чи окупиться ця ставка, залежатиме від впровадження: якщо H3 стане інструментом за замовчуванням для творців відео в Китаї та за його межами, стратегія відкритої ваги може виявитися настільки ж важливою для відео ШІ, як релізи Meta Llama для тексту.

Проте безпосередня конкуренція очевидна. Дві найбільші китайські компанії зі штучного інтелекту зробили останні спроби у війнах за покоління відео в один день — і темпи тільки прискорюються.

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

**Читати більше новин AI →