Исследования искусственного интеллекта
25 articles

Китайские исследователи сократили производство 3D-оптических чипов с часов до секунд
Китайская исследовательская группа сократила время производства 3D-оптических чипов с часов до секунд, что является производственным прорывом, имеющим серьезные последствия для аппаратного обеспечения искусственного интеллекта.
Исследователь безопасности закрывает модель искусственного интеллекта с открытым весом менее чем за 100 долларов, подвергая риску цепочку поставок искусственного интеллекта
Исследователь Semgrep установил скрытый бэкдор в модели искусственного интеллекта с открытым весом менее чем за 100 долларов за час, показав, как легко можно использовать концентраторы моделей в стиле Hugging Face в качестве оружия.
Исследование PNAS показало, что модели искусственного интеллекта гораздо более восприимчивы к вводящим в заблуждение подсказкам, чем люди
Исследование MIT Media Lab, опубликованное в PNAS, показывает, что языковые модели искусственного интеллекта воспринимают вводящие в заблуждение подсказки в 100% случаев, что намного превышает показатели человеческого соответствия.
«Неограниченное распознавание текста» Baidu обрабатывает десятки страниц документов за один проход, используя человеческое забывание
Исследователи Baidu создали модель оптического распознавания символов, которая обрабатывает десятки страниц за один проход, сохраняя память постоянной благодаря новому механизму внимания со скользящим окном, вдохновленному человеческой памятью.
OpenAI повышает награду за био-ошибки до 50 000 долларов за универсальные джейлбрейки, поскольку британское агентство предупреждает о росте киберугроз искусственного интеллекта
OpenAI удвоила награду за биологические ошибки до 50 000 долларов для всех, кто обнаружит универсальные джейлбрейки в ее моделях, поскольку Британский институт безопасности ИИ предупреждает, что передовые кибервозможности ИИ ускоряются.
OpenAI повышает награду за био-ошибки до 50 000 долларов за универсальные джейлбрейки, поскольку британское агентство предупреждает о росте киберугроз искусственного интеллекта
OpenAI удвоила награду за биологические ошибки до 50 000 долларов для всех, кто обнаружит универсальные джейлбрейки в ее моделях, поскольку Британский институт безопасности ИИ предупреждает, что передовые кибервозможности ИИ ускоряются.
J-Lens от Anthropic раскрывает скрытое пространство мыслей Клода, улавливая обман до того, как он выйдет на поверхность
Исследователи-антропологи обнаружили у Клода возникающее «J-пространство», которое отражает теорию глобального рабочего пространства мозга, позволяя обнаруживать скрытый обман и манипуляции в выходных данных ИИ.
GPT-5.6 Sol Ultra от OpenAI представляет доказательство гипотезы о двойном покрытии 50-летнего цикла
GPT-5.6 Sol Ultra от OpenAI использовал 64 сотрудничающих субагента, чтобы предоставить доказательство гипотезы двойного покрытия цикла, существовавшей несколько десятилетий назад, менее чем за час.
Модель COMPASS AI прогнозирует результаты иммунотерапии рака в зависимости от типа опухоли, результаты исследования
Исследование Nature Medicine показывает, что COMPASS, модель борьбы с раком, предсказывает ответ иммунотерапии более точно, чем стандартные биомаркеры для семи типов рака.
Лаборатория AMI Янна Лекуна создает мировую модель JEPA, чтобы вывести ИИ за рамки больших языковых моделей
AMI Labs Янна Лекуна разрабатывает модель мира на основе JEPA, которая рассуждает о физической реальности, утверждая, что LLM никогда не достигнет интеллекта человеческого уровня для робототехники.

Агент искусственного интеллекта Elements Claw Академии Alibaba DAMO обнаружил 4 новых сверхпроводящих материала
Академия DAMO компании Alibaba сообщает, что ее агент Elements Claw AI автономно обнаружил четыре новых сверхпроводящих материала за 28 часов работы графического процессора, и все они позже были подтверждены физическим экспериментом.

Подделка цепочки мыслей: исследователи обманывают рассуждения моделей ИИ, имитируя их внутренний голос
Новая атака под названием CoT Forgery использует то, как LLM отдает приоритет стилю письма над тегами метаданных, позволяя злоумышленникам подделать частное обоснование модели, чтобы обойти ее инструкции.
Агенты искусственного интеллекта теперь выполняют 16 процентов внештатных работ с профессиональным качеством, согласно данным Benchmark
Индекс удаленной работы показывает, что за восемь месяцев автоматизация реальной внештатной работы агентов ИИ выросла с 2,5% до 16,1%, при этом лидирует Anthropic Fable 5.
Агенты искусственного интеллекта теперь выполняют 16 процентов внештатных работ с профессиональным качеством, согласно данным Benchmark
Индекс удаленной работы показывает, что за восемь месяцев автоматизация реальной внештатной работы агентов ИИ выросла с 2,5% до 16,1%, при этом лидирует Anthropic Fable 5.
По данным Semgrep, GLM 5.2 с открытым весом превосходит Claude в тесте кибербезопасности
Semgrep обнаружил, что открытая версия GLM 5.2 от Zhipu превзошла Claude Code при обнаружении уязвимостей IDOR, набрав 39% F1 за примерно 0,17 доллара за каждую найденную ошибку.
GPT-5.6 Sol мошенничает при тестировании программного обеспечения больше, чем любая другая модель искусственного интеллекта до него, как выяснили METR
Независимый оценщик METR сообщает, что OpenAI GPT-5.6 Sol использовал ошибки и скрывал свои следы во время тестирования, установив рекорд по игровому поведению.

DSpark от DeepSeek ускоряет вывод ИИ до 85% за счет более умного спекулятивного декодирования
Платформа DSpark с открытым исходным кодом DeepSeek использует полуавторегрессионное черчение и проверку с учетом нагрузки для ускорения обслуживания LLM до 85 % без потери качества.

Когда ИИ занимается математикой: что становится с математиками, когда модели опровергают гипотезы и зарабатывают золото на олимпиаде
От Aletheia компании DeepMind, дающей результаты на уровне докторской степени, до OpenAI, опровергающего геометрическую гипотезу, ИИ меняет математику и заставляет эту область задаваться вопросом, для чего на самом деле нужны исследователи.
ИИ обнаруживает скрытый риск внезапной сердечной смерти по ЭКГ, исследование Калифорнийского университета в Беркли, опубликованное в Nature Finds
Команда под руководством Калифорнийского университета в Беркли обучила ИИ на основе 440 000 ЭКГ, чтобы предсказывать внезапную сердечную смерть гораздо лучше, чем стандартные тесты, выявляя тысячи пациентов из группы риска, пропущенных нынешними методами.
Krea 2: Модель преобразования текста в изображение Open-Weights 12B попала в десятку лучших по креативному поколению
Стартап Krea выпустил Krea 2, семейство моделей преобразования текста в изображение с открытым весом, созданных для творческих исследований и вошедших в десятку лучших в таблице лидеров искусственного анализа.
Великобритания инвестирует 60 миллионов фунтов стерлингов в две новые исследовательские лаборатории искусственного интеллекта, чтобы сделать искусственный интеллект более дешевым и открытым исходным кодом
Оксфорд и UCL возглавят две новые финансируемые государством лаборатории искусственного интеллекта, ориентированные на модели с открытым исходным кодом, которые работают на широко доступном оборудовании, бросая вызов доминированию США.
Набор инструментов NVIDIA BioNeMo Agent Toolkit предоставляет агентам ИИ инструменты для ускорения научных открытий
Набор инструментов NVIDIA BioNeMo Agent Toolkit объединяет десятилетние библиотеки биологических наук в навыки, вызываемые агентами для проектирования белков, геномики и открытия лекарств.

Void-X: генеративная модель искусственного интеллекта предсказывает белок-белковые взаимодействия на атомном уровне, отчеты об исследовании PNAS
Исследователи из Шанхая создали Void-X, модель со 172 миллионами параметров, которая проектирует белковые интерфейсы атом за атомом, достигая точности 78% на внутрицепочечных кластерах.

Инженер по искусственному интеллекту использует код Клода, чтобы расшифровать линейное письмо А древнего минойского письма
Инженер-самоучка по искусственному интеллекту создал инструменты Python с помощью Claude Code для расшифровки линейного письма А, нерасшифрованного минойского письма. Лингвисты из Рутгерса и Кембриджа сейчас рассматривают это заявление.

Метод OpenAI «Моделирование развертывания» прогнозирует сбои модели еще до запуска
Исследователи OpenAI предлагают метод прогнозирования того, как часто модели ИИ будут вести себя неправильно после выпуска, используя реальные разговоры. Он правильно предсказывал изменения риска в 92% случаев.
