Моделі ШІ
53 articles
OpenAI починає розгортання GPT-6 Astra для вибраних клієнтів, оголошуючи, що ера AGI настала
OpenAI розпочала розгортання GPT-6 Astra для окремих клієнтів із кібербезпеки, а Грег Брокман оголосив еру AGI. Ось хто отримає доступ і що буде далі.
IFM Абу-Дабі випускає K2 Horizon: шість відкритих моделей із повними навчальними даними та кодом
IFM запустила K2 Horizon: шість відкритих моделей (від 0,9B до 375B-A23B) з повними навчальними даними, контрольними точками, журналами та кодом під Apache 2.0. Що в нього входить.
Meta запускає Muse Spark 1.3 з оновленнями Agentic для Muse Code та Meta Model API
Meta's Muse Spark 1.3 розгортається в Muse Code та Meta Model API з агентськими оновленнями робочого процесу, кращою багатозадачністю та максимальним обґрунтуванням, що підтримується для тестування безпеки.
Google запускає Gemini 3.8 Flash і Flash Cyber, третю модель за шість тижнів
Google постачає Gemini 3.8 Flash і варіант Flash Cyber, орієнтований на кібербезпеку, стверджуючи, що продуктивність кодування майже Opus за незначну ціну.
Multiverse Computing запускає Quasar 438B, модель штучного інтелекту найвищого рейтингу в Європі
Multiverse Computing запустила Quasar 438B, модель міркування класу 400B, яка отримала 43 бали за Індексом штучного аналізу інтелекту, що є найкращим результатом серед усіх європейських моделей.
Google готує запуск Gemini 3.8 Flash вже в середу, щоб закрити прогалину в кодуванні AI
Google DeepMind планує запустити Gemini 3.8 Flash уже в середу, повідомляє WSJ, внутрішні тести показують прогрес у кодуванні, де Gemini поступається конкурентам.
OpenAI Confirms Astra Is Its First 'Critical' Cybersecurity Model, Sets Restricted Release
OpenAI підтвердив, що майбутня модель Astra перетнула «критичний» поріг кібербезпеки та незабаром буде поставлятися з обмеженим доступом до своїх найпотужніших кіберінструментів.
Anthropic запускає Claude Fable 5.1 і Mythos 5.1: на 25% дешевше, сильніше в кодуванні Agentic
Claude Fable 5.1 від Anthropic скорочує звичайні витрати на 25% і показує значні переваги в тестах агентського кодування, тоді як Mythos 5.1 призначений для користувачів із надійним доступом.
Cohere випускає Parse 5, штучний інтелект для аналізу документів із параметрами 2,3 B, створений для первинного введення витрат
Parse 5 від Cohere перетворює PDF-файли, слайди та скановані файли на структурований Markdown із моделлю параметрів 2,3 B. Заковика: його перевага в еталонному тесті базується на частковому рахунку.
Z.ai відкриває GLM-5.3 Weights на Hugging Face з ліцензією, спрямованою на Hyperscalers
Z.ai випустив ваги GLM-5.3 на Hugging Face з контекстом 1 млн токенів і спеціальну ліцензію, яка вимагає перевірки безпеки для постачальників MaaS вартістю понад 10 мільярдів доларів США.
Tencent Open-Sources Hy4 Preview: 770B-Parameter MoE з контекстом 1M-Token
Команда Tencent Hunyuan випустила попередній перегляд Hy4 під Apache 2.0 — модель MoE із 770 B-параметрами з 49 B активними параметрами, контекстом 1 M-токена та підтримкою vLLM першого дня.
Google поставляє Gemini 3.5 Transcribe і Omni 1.1 Flash: два оновлення для розробників AI
Новий Gemini 3.5 Transcribe від Google досягає 2,6% помилок у словах, тоді як Omni 1.1 Flash додає 40-секундні відеосцени, масштабування до 4K і контроль на рівні кадру.
Gemini Omni 1.1 Flash від Google додає елементи керування студійного рівня та вихід 4K до відео AI
Google випустив Gemini Omni 1.1 Flash із розширенням сцени до 40 секунд, переходами на початку та в кінці кадру та масштабуванням до 4K через Gemini API.
Google запускає Gemini 3.5 Transcribe: розпізнавання мовлення в реальному часі 85 мовами
Google запустив Gemini 3.5 Transcribe із розпізнаванням 85 мов, 4% частотою помилок потокового передавання та на 70% швидшими відповідями, ніж Chirp 3, який поширюється в своїх програмах.
Qwen3.8-Flash-Next від Alibaba демонструє архітектуру Qwen4 із 6B активними параметрами
Alibaba's Qwen3.8-Flash-Next previews Qwen4: 125B parameters with 6B active, open weights, and Qwen3.7-Plus-beating results at one-ninth the training cost.
Z.ai запускає GLM-5.3-Flash за ліцензією MIT: Ox Alpha Revealed, Weights Live
GLM-5.3-Flash від Z.ai — це мультимодальна модель 320B-A18B, ліцензована Массачусетським технологічним інститутом, яка обслуговується на китайських мікросхемах штучного інтелекту, які зараз очолюють рейтинги штучного аналізу за низькою ціною.
Z.ai підтверджує, що Ox Alpha є моделлю серії GLM і оприлюднить її ваги
Z.ai сказав Bloomberg, що вірусна стелс-модель Ox Alpha є новим випуском серії GLM, і відкриті ваги з’являться сьогодні ввечері, завершуючи тиждень гарячкових здогадок.
Творця Ox Alpha, можливо, було розкрито: аналіз вказує на GLM Zhipu
Трюк швидкого впровадження та аналіз стиснення gzip свідчать про те, що таємнича модель OpenRouter Ox Alpha є GLM Zhipu, але скептики відмовляються.
DeepSeek додає бачення до V4-Flash за допомогою експериментальної моделі, що підтримує зображення
DeepSeek постачає deepseek-v4-flash-vision-exp із введенням зображення, контекстом токена 1 млн і ціною на рівні Flash, виправляючи найвідомішу сліпу пляму своєї моделі.
OpenAI знижує ціни GPT-5.6 Sol API більш ніж на 20%, оскільки цінова війна досягає свого флагмана
OpenAI знизив ціни GPT-5.6 Sol для розробників більш ніж на 20%, знизивши вихідні токени до 20 доларів США за мільйон. Цей крок завершує місяці утримання флагманської ціни.
Ox Alpha: безкоштовна модель AI Stealth від OpenRouter із контекстом 1 млн токенів відкриває Whodunit
Безкоштовна стелс-модель під назвою Ox Alpha з’явилася на OpenRouter з контекстом 1 млн токенів і відеовведенням, і спільнота штучного інтелекту намагається викрити її виробника.
Відкриті моделі Gemma від Google перевищили 1 мільярд завантажень як 100 000 найкращих варіантів спільноти
Google каже, що його відкриті моделі Gemma перевищили 1 мільярд завантажень, із понад 100 000 варіантами спільноти, орбітальними розгортаннями з NASA та новим центром Awesome Gemma.
Ornith-1.5 збігається з Claude Opus 4.8 за тестами кодування Agentic із повністю відкритими моделями, що самовдосконалюються
Сімейство Ornith-1.5 з ліцензією Массачусетського технологічного інституту генерує власні навчальні завдання та каркаси, а його флагман 397B пов’язує Claude Opus 4.8 із кодуванням Terminal-Bench 2.1.
Qwen 3.8 27B від Alibaba працює на ноутбуці та випереджає власні більші моделі
Qwen 3.8 27B від Alibaba — це модель бачення Apache-2.0, яка працює на ноутбуках і перевершує закритий Qwen 3.7-Plus, але її налаштування міркувань за замовчуванням переосмислюють усе.
Моделі Qwen AI від Alibaba — 3 мільярди завантажень, обігнавши Meta та Google
Моделі Qwen від Alibaba подолали 3 мільярди завантажень, щоб випередити Meta та Google у прийнятті штучного інтелекту з відкритим кодом через кілька тижнів після випуску Qwen 3.8.
GLM-5.3 від Z.ai подвоює кодування та отримує вражаючі навички кібербезпеки
Новий GLM-5.3 від Z.ai забезпечує значне покращення кодування та найсучасніше виявлення вразливостей, скорочуючи розрив між Anthropic і OpenAI у порівнянні з відкритими технологіями.
Google постачає Gemini 3.7 Flash: найрозумнішу робочу конячку для програмування та агентів за півціни
Gemini 3.7 Flash від Google виходить лише через три тижні після 3.6 Flash із суттєвими перевагами кодування та агентів, а також початковою ціною вдвічі нижчою від вартості попередника.
DeepSeek запускає V4 Pro для загальної доступності, агента Harness з відкритим кодом і підвищує ціни на API
Китайська лабораторія штучного інтелекту DeepSeek випускає V4 Pro поза межами попереднього перегляду, поставляє Harness v0.1 як конкурента Claude Code з відкритим кодом і різко підвищує ціни на API перед IPO.
xAI запускає Grok 4.6, що відповідає GPT-5.6 Sol на Frontier Intelligence Index
Grok 4.6 від xAI отримав 61 бал за індексом штучного аналізу інтелекту, порівнюючи GPT-5.6 Sol із видатною продуктивністю агентів за 60% нижчої вартості. Зараз доступний у Cursor і Grok Build.
SL2T від Google DeepMind забезпечує переклад мовою жестів на телефонах Pixel 11
Google DeepMind представив SL2T, модель перекладу жестової мови, яка перетворює мову жестів на текст у лінійці Pixel 11, починаючи з Pixel 11 Pro Fold.
Nvidia створює Nemotron 4 із 1 трильйоном параметрів, щоб кинути виклик найкращим моделям ШІ з відкритим кодом
Nvidia розробляє Nemotron 4, модель штучного інтелекту з відкритим вихідним кодом із принаймні одним трильйоном параметрів, щоб конкурувати з провідними відкритими системами. Модель може з'явитися цієї осені.
NVIDIA запускає Nemotron 3.5 Lightning і NeMo Switchyard для Smarter Agentic AI
Нова відкрита модель NVIDIA з 30 мільярдами параметрів і бібліотека маршрутизації з відкритим вихідним кодом обіцяють до 4 разів швидший вихід і на 30% швидше виконання завдань агента на периферійних пристроях, ПК та хмарі.
Марк Цукерберг оголошує війну закритим суперникам AI у Superintelligence Manifesto як Meta Open Sources як його найпотужніша модель
Марк Цукерберг з Meta опублікував масштабний маніфест із закликом до надрозумного штучного інтелекту для всіх, атакуючи закритих суперників ШІ та випускаючи відкриту версію найпотужнішої моделі Meta.
Meta випускає Muse Glimmer, відкриту модель 30B, яка запускає агентів ШІ на споживчих графічних процесорах
Meta опублікувала Muse Glimmer, відкриту модель із 30 мільярдами параметрів під Apache 2.0, яка перевершує Gemma4-31B і Qwen3.6-27B за агентськими тестами під час локальної роботи.
OpenAI призупиняє роботу моделі Astra після оцінки позначки «Критичні» можливості кібербезпеки
OpenAI призупинив розробку своєї майбутньої моделі Astra після того, як тести показали, що вона може досягти «критичного» порогу кібербезпеки — першої моделі, яка запускає найвищий рівень ризику.
Повідомляється, що ByteDance навчає модель ШІ з 10 трильйонами параметрів, щоб конкурувати з Mythos від Anthropic
The Financial Times повідомляє, що ByteDance створює величезну модель із 10 трильйонами параметрів, розроблену відповідно до масштабу Mythos від Anthropic, посилюючи гонку ШІ між США та Китаєм.
OpenAI призупиняє роботу над новою моделлю Astra через серйозні проблеми з кібербезпекою
OpenAI уповільнив розробку своєї майбутньої моделі Astra після того, як внутрішнє тестування виявило кібер-можливості критичного рівня, посиливши контроль перед випуском.
Imagine Image 2.0 від xAI поступається GPT-Image-2 від OpenAI у тестах Arena
Компанія xAI випустила Imagine Image 2.0 для Grok, яка посіла друге місце у світовому рейтингу тестів Arena після GPT-Image-2 від OpenAI, з новими інструментами редагування, підтримкою кількох посилань і попередньо налаштованими шаблонами.
OpenAI призупиняє розробку моделі Astra після досягнення «критичного» порогу ризику кібербезпеки
OpenAI призупинив частину розробки Astra після того, як внутрішні тести показали, що вона може досягти найвищого рівня ризику кібербезпеки в рамках Preparedness Framework — першої з її моделей, яка досягла цього.
ByteDance навчає модель ШІ з 10 трильйонами параметрів, щоб конкурувати з Mythos Anthropic
ByteDance тренує мегамодель штучного інтелекту з до 10 трильйонів параметрів, наближаючись до передбачуваного розміру Mythos 5 від Anthropic і перевершуючи нинішніх лідерів Китаю.
Mistral's Shieldstral: модель безпеки 3B Open Weights, яка зчитує правила, а не запам'ятовує їх
Mistral AI випустила Shieldstral, класифікатор безпеки з відкритими ваговими параметрами 3B, який оцінює текст і зображення на відповідність політикам модерування простою мовою під час висновку.
Alibaba запускає Qwen3.8-Max: модель із 2,4 трильйонами параметрів, яка конкурує з Claude від Anthropic
Alibaba випустила Qwen3.8-Max, модель із 2,4 трильйонами параметрів, яка відстає лише від Claude з Anthropic за тестами, з відкритими вагами, обіцяними протягом декількох днів.
Модель Astra від OpenAI вирішує 10 давно невирішених математичних задач за допомогою машинно-перевірених доказів
Неопублікована модель Astra від OpenAI зламала 10 відкритих проблем з математики та інформатики за допомогою перевірених Lean доказів, дражнивши свою наступну основну модель перед перевіркою уряду США.
Gemini 3.5 Pro з’являється в сліпих тестах LM Arena, коли Google наближається до випуску
Відкладену Google Gemini 3.5 Pro неодноразово помічали під час сліпих тестів LMSYS Chatbot Arena, що свідчить про те, що публічний запуск нарешті може бути неминучим.
Thinking Machines випускає відкриту модель Inkling-Small: 276B у чверть розміру свого флагмана
Thinking Machines Lab випустила Inkling-Small, модель відкритої ваги з 276 мільярдами параметрів і активним 12B, яка відповідає своєму флагману за чвертю розміру — учасника США в гонці відкритої ваги.
DeepSeek запускає публічну бета-версію V4-Flash, оскільки китайська війна цін на ШІ загострюється
DeepSeek випустив офіційну бета-версію API V4-Flash із оновленою моделлю, яка перевершує її власний флагман V4 Pro за дев’ятьма тестами агентів, водночас знижуючи конкурентів у США за ціною.
OpenAI знижує ціни на моделі GPT-5.6 до 80 відсотків, оскільки підприємства стають чутливішими до витрат на штучний інтелект
OpenAI знизив ціни на дві моделі GPT-5.6, включаючи Luna, зменшивши витрати на менші моделі до 80 відсотків, оскільки компанії ретельно перевіряють витрати на штучний інтелект.
Нова модель V4-Flash від DeepSeek відповідає GPT-5.6 Luna за 60% нижчою ціною
DeepSeek випустив V4-Flash '0731', відкриту модель, яка майже порівнює GPT-5.6 Luna від OpenAI за тестами, але коштує приблизно на 60 відсотків менше.
Китайський MiniMax випускає відеомодель H3 AI з кліпами 2K, стереозвуком і відкритими вагами
Китайський стартап зі штучним інтелектом MiniMax 31 липня 2026 року запустив свою модель відеогенерації H3, пропонуючи роздільну здатність 2K, стереоаудіо та відкриті ваги за незначну частку цін конкурентів — прямо кинувши виклик Seedance 2.5 ByteDance.
Google DeepMind представляє Gemini Robotics 2 із керуванням усім тілом гуманоїда та співпрацею кількох роботів
Google DeepMind запустив Gemini Robotics 2, модель бачення, мови і дії, яка дозволяє роботам-гуманоїдам рухатися, хапати та координувати завдання всім своїм тілом.
OpenAI знижує ціни на GPT-5.6 API до 80%, оскільки компанії переглядають витрати на AI
30 липня 2026 року OpenAI знизив ціни на GPT-5.6 Luna та Terra API до 80%, знизивши ціни на Anthropic, оскільки підприємства ретельно перевіряють витрати на обґрунтування.
OpenAI каже, що GPT-5.6 Sol перевершує Claude Opus 5 на ARC-AGI-3 — але лише з власними налаштуваннями
OpenAI повідомляє, що GPT-5.6 Sol набрав 38,3% на ARC-AGI-3, використовуючи збережене міркування та ущільнення, перевершивши Claude Opus 5. Але офіційний джгут розповідає іншу історію, викликаючи дебати щодо справедливості порівняння.
Black Forest Labs представляє FLUX 3: єдину модель AI для зображень, відео, аудіо та робототехніки
Black Forest Labs запустили FLUX 3, мультимодальну модель, яка спільно генерує зображення, відео з рідним аудіо та прогнозує дії роботів — перевага над Runway Gen-4.5 у 77% порівнянь.
