Модели искусственного интеллекта
53 articles
OpenAI начинает внедрение GPT-6 Astra для избранных клиентов, заявляя, что эра AGI наступила
OpenAI начала развертывание GPT-6 Astra для избранных клиентов в области кибербезопасности, а Грег Брокман объявил об эпохе AGI. Вот кто получит доступ и что дальше.
IFM Абу-Даби выпускает K2 Horizon: шесть открытых моделей с полными обучающими данными и кодом
IFM выпустила K2 Horizon: шесть открытых моделей (от 0,9B до 375B-A23B) с полными данными обучения, контрольными точками, журналами и кодом под Apache 2.0. Что оно включает.
Meta запускает Muse Spark 1.3 с агентными обновлениями для кода Muse и API метамодели
Muse Spark 1.3 от Meta выпускается для Muse Code и Meta Model API с обновлениями агентных рабочих процессов, улучшенной многозадачностью и максимальным количеством аргументов, предназначенных для тестирования безопасности.
Google выпускает Gemini 3.8 Flash и Flash Cyber, третью модель за шесть недель
Google поставляет Gemini 3.8 Flash и вариант Flash Cyber, ориентированный на кибербезопасность, заявляя о производительности кодирования, близкой к Opus, за небольшую цену.
Multiverse Computing запускает Quasar 438B, самую высокорейтинговую модель искусственного интеллекта в Европе
Multiverse Computing выпустила Quasar 438B, модель рассуждения класса 400B, получившую 43 балла по индексу искусственного интеллекта, что является лучшим результатом среди всех европейских моделей.
Google готовит запуск Flash Gemini 3.8 уже в среду, чтобы закрыть пробел в кодировании искусственного интеллекта
Google DeepMind планирует запустить Gemini 3.8 Flash уже в среду, сообщает WSJ, при этом внутренние тесты показывают прогресс в кодировании, где Gemini отстает от конкурентов.
OpenAI подтверждает, что Astra — это ее первая «критическая» модель кибербезопасности, и устанавливает ограниченный выпуск
OpenAI подтвердила, что ее будущая модель Astra преодолела «критический» порог кибербезопасности и скоро поступит в продажу с ограниченным доступом к самым мощным киберинструментам.
Anthropic выпускает Claude Fable 5.1 и Mythos 5.1: на 25 % дешевле, эффективнее в агентном кодировании
Claude Fable 5.1 от Anthropic сокращает типичные затраты на 25% и демонстрирует большие преимущества в тестах агентного кодирования, а Mythos 5.1 доступен для пользователей с доверенным доступом.
Cohere выпускает Parse 5, ИИ для анализа документов с параметрами 2,3B, созданный для экономичного приема данных
Parse 5 от Cohere превращает PDF-файлы, слайды и сканы в структурированный Markdown с помощью модели с 2,3B параметрами. Подвох: его преимущество в тестах основано на частичном балле.
Z.ai открывает гири GLM-5.3 на обнимающем лице с лицензией, предназначенной для гиперскейлеров
Z.ai выпустила весы GLM-5.3 для Hugging Face с контекстом в 1 млн токенов и специальной лицензией, которая требует проверки безопасности для поставщиков MaaS стоимостью более 10 миллиардов долларов.
Предварительный обзор Tencent Hy4 с открытым исходным кодом: 770B-параметр MoE с контекстом 1M-токена
Команда Tencent Hunyuan выпустила предварительную версию Hy4 под Apache 2.0 — модель MoE с 770B параметрами, 49B активных параметров, контекстом 1M токенов и поддержкой vLLM с первого дня.
Google выпускает Gemini 3.5 Transcribe и Omni 1.1 Flash: два обновления для разработчиков искусственного интеллекта
Новый Gemini 3.5 Transcribe от Google достигает 2,6% ошибок в словах, а Omni 1.1 Flash добавляет 40-секундные видеосцены, масштабирование до 4K и управление на уровне кадров.
Gemini Omni 1.1 Flash от Google добавляет элементы управления студийного уровня и вывод 4K в AI-видео
Google выпустила Gemini Omni 1.1 Flash с расширением сцены до 40 секунд, переходами между начальными и конечными кадрами и масштабированием до 4K через Gemini API.
Google запускает Gemini 3.5 Transcribe: распознавание речи в реальном времени на 85 языках
Google запустил Gemini 3.5 Transcribe с распознаванием 85 языков, частотой ошибок потоковой передачи на 4 % и на 70 % более быстрым откликом, чем Chirp 3, и распространил ее на все свои приложения.
Qwen3.8-Flash-Next от Alibaba представляет архитектуру Qwen4 с активными параметрами 6B
Qwen3.8-Flash-Next от Alibaba демонстрирует Qwen4: 125B параметров с 6B активными открытыми весами и результаты, превосходящие Qwen3.7-Plus, за одну девятую стоимость обучения.
Z.ai запускает GLM-5.3-Flash под лицензией MIT: раскрыта Ox Alpha, весы в реальном времени
GLM-5.3-Flash от Z.ai — это мультимодальная модель 320B-A18B, лицензированная MIT, обслуживаемая китайскими чипами искусственного интеллекта, которая теперь возглавляет рейтинги искусственного анализа при низкой цене.
Z.ai подтверждает, что Ox Alpha — это модель серии GLM, и сообщит о ее весе
Z.ai сообщил Bloomberg, что вирусная стелс-модель Ox Alpha — это новая версия серии GLM, и сегодня вечером прибудут открытые веса, положив конец неделе лихорадочных предположений.
Создатель Ox Alpha, возможно, был разоблачен: анализ указывает на GLM Zhipu
Трюк с быстрым внедрением и анализ сжатия gzip позволяют предположить, что загадочная модель Ox Alpha от OpenRouter — это GLM от Zhipu, но скептики сопротивляются.
DeepSeek расширяет возможности V4-Flash с помощью экспериментальной модели с поддержкой изображений
DeepSeek поставляет deepseek-v4-flash-vision-exp с вводом изображений, контекстом токена 1M и ценами на уровне Flash, исправляя самое известное «слепое пятно» своей модели.
OpenAI снижает цены на GPT-5.6 Sol API более чем на 20%, поскольку ценовая война достигает своего флагмана
OpenAI снизила цены для разработчиков GPT-5.6 Sol более чем на 20%, снизив выходные токены до 20 долларов за миллион. Этот шаг завершает месяцы удержания флагманской цены.
Ox Alpha: бесплатная скрытая модель искусственного интеллекта OpenRouter с контекстом 1M-токена запускает детективный блок
Бесплатная передовая стелс-модель под названием Ox Alpha появилась на OpenRouter с контекстом в 1 миллион токенов и видеовходом, и сообщество ИИ спешит разоблачить ее создателя.
Открытые модели Gemma от Google превысили 1 миллиард загрузок, а варианты сообщества вошли в число 100 000 лучших
Google сообщает, что ее открытые модели Gemma были скачаны более 1 миллиарда раз, а их варианты для сообщества — более 100 000, орбитальное развертывание совместно с НАСА и новый центр Awesome Gemma.
Ornith-1.5 соответствует Claude Opus 4.8 по тестам агентного кодирования с полностью открытыми самоусовершенствующимися моделями
Семейство Ornith-1.5, лицензированное MIT, генерирует свои собственные обучающие задачи и шаблоны, а его флагманский процессор 397B связан с Claude Opus 4.8 в кодировании Terminal-Bench 2.1.
Qwen 3.8 27B от Alibaba работает на ноутбуке и превосходит собственные более крупные модели
Qwen 3.8 27B от Alibaba — это модель видения Apache-2.0, которая работает на ноутбуках и превосходит закрытый Qwen 3.7-Plus, но ее настройки рассуждения по умолчанию переосмысливают все.
Qwen AI от Alibaba моделирует 3 миллиарда загрузок, обогнав Meta и Google
Модели Qwen от Alibaba превысили 3 миллиарда загрузок, обогнав Meta и Google по внедрению искусственного интеллекта с открытым исходным кодом, спустя несколько недель после выпуска Qwen 3.8 с открытым исходным кодом.
GLM-5.3 от Z.ai удваивает возможности кодирования и демонстрирует потрясающие навыки кибербезопасности
Новый GLM-5.3 от Z.ai демонстрирует резкие улучшения в кодировании и современное обнаружение уязвимостей, сокращая разрыв между Anthropic и OpenAI по сравнению с границами открытого веса.
Google выпускает Gemini 3.7 Flash: самую умную рабочую лошадку для кодирования и агентов за полцены
Gemini 3.7 Flash от Google выходит всего через три недели после версии 3.6 Flash и имеет значительные преимущества в области кодирования и агентов, а также начальную цену, вдвое меньшую, чем у его предшественника.
DeepSeek выпускает общедоступную версию V4 Pro, агент Harness с открытым исходным кодом и повышает цены на API
Китайская лаборатория искусственного интеллекта DeepSeek выпускает предварительную версию V4 Pro, поставляет Harness v0.1 в качестве конкурента Claude Code с открытым исходным кодом и резко повышает цены на API перед IPO.
xAI запускает Grok 4.6, соответствующий GPT-5.6 Sol по индексу Frontier Intelligence
Grok 4.6 от xAI набрал 61 балл в индексе искусственного анализа интеллекта, что соответствует GPT-5.6 Sol с выдающейся производительностью агента при снижении затрат на 60%. Доступно уже в Cursor и Grok Build.
SL2T от Google DeepMind обеспечивает перевод языка жестов на телефоны Pixel 11
Google DeepMind представила SL2T, модель перевода на язык жестов, которая превращает язык жестов в текст в линейке Pixel 11, начиная с Pixel 11 Pro Fold.
Nvidia создает Nemotron 4 с 1 триллионом параметров, чтобы бросить вызов лучшим моделям искусственного интеллекта с открытым исходным кодом
Nvidia разрабатывает Nemotron 4, модель искусственного интеллекта с открытым исходным кодом, по меньшей мере, с одним триллионом параметров, чтобы конкурировать с ведущими системами с открытым весом. Модель может появиться этой осенью.
NVIDIA запускает Nemotron 3.5 Lightning и NeMo Switchyard для более умного агентного ИИ
Новая открытая модель NVIDIA с 30 миллиардами параметров и библиотека маршрутизации с открытым исходным кодом обещают до 4 раз более быстрый результат и на 30 % более быстрые задачи агента на периферийных устройствах, ПК и в облаке.
Марк Цукерберг объявляет войну закрытым конкурентам искусственного интеллекта в «Манифесте суперинтеллекта», поскольку мета-открытые исходные коды являются его самой мощной моделью
Марк Цукерберг из Meta опубликовал масштабный манифест, призывающий к созданию сверхразумного ИИ для всех, атакуя закрытых конкурентов ИИ и выпуская открытую версию самой мощной модели Meta.
Meta выпускает Muse Glimmer, модель открытого веса 30B, которая запускает агенты искусственного интеллекта на потребительских графических процессорах
Meta опубликовала Muse Glimmer, открытую модель с 30 миллиардами параметров под управлением Apache 2.0, которая превосходит Gemma4-31B и Qwen3.6-27B в агентных тестах при локальном запуске.
OpenAI приостанавливает работу над моделью Astra после того, как оценки отмечают «критические» возможности кибербезопасности
OpenAI приостановила разработку своей будущей модели Astra после того, как тесты показали, что она может достичь «критического» порога кибербезопасности — первой модели, вызывающей самый высокий уровень риска.
ByteDance, как сообщается, обучает модель искусственного интеллекта с 10 триллионами параметров, чтобы конкурировать с мифами Anthropic
Financial Times сообщает, что ByteDance создает огромную модель с 10 триллионами параметров, которая будет соответствовать масштабу Mythos Anthropic, что активизирует гонку ИИ между США и Китаем.
OpenAI приостанавливает работу над новой моделью Astra из-за критических проблем кибербезопасности
OpenAI замедлила разработку своей будущей модели Astra после того, как внутреннее тестирование выявило кибервозможности критического уровня, ужесточив контроль перед выпуском.
Imagine Image 2.0 от xAI уступает GPT-Image-2 от OpenAI в тестах Arena
Компания xAI выпустила Imagine Image 2.0 для Grok, заняв второе место в мире в тестах Arena после GPT-Image-2 от OpenAI, с новыми инструментами редактирования, поддержкой нескольких ссылок и предварительно настроенными шаблонами.
OpenAI приостанавливает разработку модели Astra после того, как она достигла «критического» порога риска кибербезопасности
OpenAI приостановила часть разработки Astra после того, как внутренние тесты показали, что она может достичь самого высокого уровня риска кибербезопасности в своей системе готовности — первой из своих моделей, которая достигла этого.
ByteDance обучает модель искусственного интеллекта с 10 триллионами параметров, чтобы конкурировать с мифами Anthropic
ByteDance обучает мега-модель искусственного интеллекта с 10 триллионами параметров, что приближается к предполагаемому размеру Mythos 5 от Anthropic и затмевает нынешних лидеров Китая.
Shieldstral от Mistral: модель безопасности с открытым весом 3B, которая считывает правила, а не запоминает их
Mistral AI выпустила Shieldstral, 3B-параметрический классификатор безопасности с открытыми весами, который во время вывода оценивает текст и изображения на соответствие политикам модерации, сформулированным простым языком.
Alibaba запускает Qwen3.8-Max: модель с 2,4 триллионами параметров, которая может конкурировать с Claude от Anthropic
Alibaba выпустила Qwen3.8-Max, модель с 2,4 триллиона параметров, которая уступает только Claude от Anthropic по тестам, а открытые веса обещают в течение нескольких дней.
Модель Astra от OpenAI решает 10 давно нерешённых математических задач с помощью машинной проверки доказательств
Неизданная модель Astra от OpenAI решила 10 открытых задач по математике и информатике с помощью подтвержденных Lean доказательств, намекая на следующую крупную модель в преддверии рассмотрения правительством США.
Gemini 3.5 Pro появился на слепых тестах LM Arena в рамках релиза Google Nears
Отложенный выпуск Gemini 3.5 Pro от Google неоднократно был замечен в слепых тестах LMSYS Chatbot Arena, что сигнализирует о том, что публичный запуск, наконец, может быть неизбежен.
Thinking Machines представляет Inkling-Small: модель открытого веса 276B, размер которой в четыре раза меньше флагманского
Лаборатория Thinking Machines Lab выпустила Inkling-Small, модель открытого веса с 276 миллиардами параметров и активным 12B, которая соответствует его флагману, но имеет в четыре раза меньший размер — американский участник гонки открытого веса.
DeepSeek запускает публичную бета-версию V4-Flash на фоне обострения ценовой войны в сфере искусственного интеллекта в Китае
DeepSeek выпустила официальную бета-версию API V4-Flash с переработанной моделью, которая превосходит собственный флагманский V4 Pro по девяти агентским тестам, уступая при этом конкурентам из США по цене.
OpenAI снижает цены на модели GPT-5.6 до 80 процентов, поскольку предприятия становятся чувствительными к затратам на ИИ
OpenAI снизила цены на две модели GPT-5.6, включая Luna, снизив затраты на модели меньшего размера почти на 80 процентов, поскольку компании внимательно изучают расходы на ИИ.
Новая модель V4-Flash от DeepSeek соответствует GPT-5.6 Luna, но стоит на 60 % дешевле
DeepSeek выпустила V4-Flash «0731», модель открытого веса, которая почти равна OpenAI GPT-5.6 Luna по тестам, но стоит примерно на 60 процентов дешевле.
Китайская компания MiniMax выпускает видеомодель H3 AI с клипами 2K, стереозвуком и открытым весом
Китайский стартап в области искусственного интеллекта MiniMax 31 июля 2026 года запустил свою модель генерации видео H3, предлагающую разрешение 2K, стереозвук и открытый вес по гораздо более низким ценам, чем у конкурентов, что напрямую бросает вызов Seedance 2.5 от ByteDance.
Google DeepMind представляет Gemini Robotics 2 с управлением всем телом гуманоида и совместной работой нескольких роботов
Google DeepMind запустила Gemini Robotics 2, модель видения-языка-действия, позволяющую роботам-гуманоидам перемещаться, хватать и координировать задачи всем своим телом.
OpenAI снижает цены на API GPT-5.6 до 80%, поскольку компании переосмысливают затраты на ИИ
30 июля 2026 года OpenAI снизила цены на GPT-5.6 Luna и Terra API почти на 80%, что обогнало Anthropic, поскольку предприятия тщательно изучают расходы на логические выводы.
OpenAI утверждает, что GPT-5.6 Sol превосходит Claude Opus 5 на ARC-AGI-3 — но только со своими собственными настройками
OpenAI сообщает, что GPT-5.6 Sol набрал 38,3% по ARC-AGI-3 с использованием сохраненных рассуждений и сжатия, превзойдя Claude Opus 5. Но официальная версия рассказывает другую историю, вызывая дебаты о справедливости тестов.
Black Forest Labs представляет FLUX 3: единую модель искусственного интеллекта для изображений, видео, аудио и робототехники
Black Forest Labs запустила FLUX 3, мультимодальную модель, которая совместно генерирует изображения, видео с собственным звуком и прогнозирует действия роботов — в 77% сравнений она предпочтительнее Runway Gen-4.5.
