Дослідження ШІ
25 articles

Китайські дослідники скоротили виробництво оптичних 3D-чіпів з годин до секунд
Китайська дослідницька група скоротила час виробництва 3D-оптичних чіпів з годин до секунд, що стало виробничим стрибком із серйозними наслідками для обладнання ШІ.
Дослідник безпеки створює бекдори для відкритої моделі штучного інтелекту менш ніж за 100 доларів США, піддаючи ризику ланцюг постачання штучного інтелекту
Дослідник Semgrep встановив прихований бекдор у відкритій моделі штучного інтелекту за годину менш ніж за 100 доларів, показавши, як легко можна використати центри моделей у стилі Hugging Face як зброю.
Дослідження PNAS виявило, що моделі штучного інтелекту набагато більш сприйнятливі до оманливих спонукань, ніж люди
Дослідження медіалабораторії Массачусетського технологічного інституту, опубліковане в PNAS, показує, що мовні моделі штучного інтелекту сприймають оманливі спонукання до 100% часу, що значно перевищує показники дотримання стандартів людьми.
«Необмежене оптичне розпізнавання символів» Baidu обробляє десятки сторінок документів за один прохід, використовуючи людське забування
Дослідники Baidu створили модель оптичного розпізнавання символів, яка обробляє десятки сторінок за один прохід логічного висновку, зберігаючи постійність пам’яті за допомогою нового механізму уваги ковзного вікна, натхненного людською пам’яттю.
OpenAI підвищує винагороду за біопомилку до 50 000 доларів США за універсальні джейлбрейки, оскільки британське агентство попереджає про ескалацію кіберзагроз ШІ
OpenAI подвоїв винагороду за біопомилку до 50 000 доларів США для тих, хто знайде універсальні джейлбрейки в своїх моделях, оскільки Інститут безпеки штучного інтелекту Великобританії попереджає, що передові кіберможливості ШІ прискорюються.
OpenAI підвищує винагороду за біопомилку до 50 000 доларів США за універсальні джейлбрейки, оскільки британське агентство попереджає про ескалацію кіберзагроз ШІ
OpenAI подвоїв винагороду за біопомилку до 50 000 доларів США для тих, хто знайде універсальні джейлбрейки в своїх моделях, оскільки Інститут безпеки штучного інтелекту Великобританії попереджає, що передові кіберможливості ШІ прискорюються.
J-Lens від Anthropic розкриває робочий простір прихованих думок Клода, вловлюючи обман до того, як він випливе на поверхню
Антропічні дослідники виявили в Клоді новий «J-простір», який відображає теорію глобального робочого простору мозку, дозволяючи виявляти прихований обман і маніпуляції в результатах ШІ.
GPT-5.6 Sol Ultra від OpenAI підтверджує гіпотезу подвійного покриття циклу 50-річної давності
GPT-5.6 Sol Ultra від OpenAI використовував 64 субагенти, які співпрацювали, щоб отримати доказ гіпотези подвійного покриття циклу, яка існує десятиліттями, менш ніж за годину.
Модель COMPASS AI прогнозує результати імунотерапії раку для різних типів пухлин, результати дослідження
Дослідження Nature Medicine показує, що COMPASS, базова модель раку, прогнозує імунотерапевтичну відповідь точніше, ніж стандартні біомаркери для семи типів раку.
Лабораторії AMI Янна Лекуна створюють світову модель JEPA, щоб вивести ШІ за межі великих мовних моделей
Лабораторія AMI Labs Янна Лекуна розробляє модель світу на основі JEPA, яка міркує про фізичну реальність, стверджуючи, що магістри ніколи не досягнуть людського рівня інтелекту для робототехніки.

Агент Alibaba DAMO Academy Elements Claw AI Agent відкриває 4 нові надпровідні матеріали
Академія DAMO Alibaba каже, що її агент Elements Claw AI автономно відкрив чотири нові надпровідні матеріали за 28 GPU-годин, усі згодом перевірені фізичним експериментом.

Підробка ланцюга думок: дослідники обманюють моделі ШІ, імітуючи їхній внутрішній голос
Нова атака під назвою CoT Forgery використовує те, як LLM віддають перевагу стилю написання над тегами метаданих, дозволяючи зловмисникам підробити приватні міркування моделі, щоб перевизначити її інструкції.
Агенти зі штучного інтелекту тепер виконують 16 відсотків позаштатних робіт із професійною якістю, результати порівняльного аналізу
Індекс віддаленої праці показує, що за вісім місяців рівень автоматизації реальної роботи фрілансерів серед агентів штучного інтелекту зріс з 2,5% до 16,1%, при цьому Fable 5 від Anthropic лідирує.
Агенти зі штучного інтелекту тепер виконують 16 відсотків позаштатних робіт із професійною якістю, результати порівняльного аналізу
Індекс віддаленої праці показує, що за вісім місяців рівень автоматизації реальної роботи фрілансерів серед агентів штучного інтелекту зріс з 2,5% до 16,1%, при цьому Fable 5 від Anthropic лідирує.
Semgrep виявив, що Open-Weight GLM 5.2 перевершує Клода в тесті кібербезпеки
Semgrep виявив, що відкритий GLM 5.2 від Zhipu перевершив Claude Code у виявленні вразливостей IDOR, набравши 39% F1 за приблизно 0,17 долара за знайдену помилку.
GPT-5.6 Sol обманює тести програмного забезпечення більше, ніж будь-яка модель штучного інтелекту раніше, виявлено METR
Незалежний оцінювач METR повідомляє, що OpenAI GPT-5.6 Sol використовував помилки та приховував свої сліди під час тестування, встановивши рекорд поведінки в еталонних іграх.

DSpark від DeepSeek прискорює штучний інтелект до 85% завдяки розумнішому спекулятивному декодуванню
Фреймворк DSpark з відкритим вихідним кодом DeepSeek використовує напівавторегресійне складання та перевірку з урахуванням навантаження для прискорення обслуговування LLM на 85% без втрати якості.

Коли штучний інтелект робить математику: що стає з математиками як моделями, що спростовують припущення та заробляють золото на олімпіаді
Від Aletheia від DeepMind, що дає результати на рівні доктора філософії, до OpenAI, що спростовує геометричну гіпотезу, штучний інтелект змінює форму математики та змушує поле запитувати, для чого насправді дослідники.
AI виявляє прихований ризик раптової серцевої смерті на ЕКГ, дослідження Каліфорнійського університету в Берклі, опубліковане в Nature Finds
Команда під керівництвом Каліфорнійського університету в Берклі навчила штучний інтелект на 440 000 ЕКГ прогнозувати раптову серцеву смерть набагато краще, ніж стандартні тести, визначаючи тисячі пацієнтів групи ризику, яких не враховують сучасні методи.
Krea 2: модель Open-Weights 12B Text-to-Image увійшла до 10 найкращих для Creative Generation
Стартап Krea випустив Krea 2, сімейство відкритих моделей перетворення тексту в зображення, створених для творчого дослідження, які входять до 10 найкращих у таблиці лідерів штучного аналізу.
Великобританія інвестує 60 мільйонів фунтів стерлінгів у дві нові дослідницькі лабораторії ШІ, щоб зробити штучний інтелект дешевшим і відкритим кодом
Оксфорд і UCL очолить дві нові фінансовані державою лабораторії штучного інтелекту, які зосереджені на моделях з відкритим кодом, які працюють на широкодоступному апаратному забезпеченні, кидаючи виклик домінуванню США.
NVIDIA BioNeMo Agent Toolkit надає агентам ШІ інструменти для прискорення наукових відкриттів
BioNeMo Agent Toolkit від NVIDIA об’єднує десятирічні бібліотеки наук про життя в навички, що викликаються агентами, для розробки білків, геноміки та відкриття ліків.

Void-X: генеративна модель штучного інтелекту передбачає взаємодію між білками в атомному масштабі, звіти про дослідження PNAS
Дослідники в Шанхаї створили Void-X, модель зі 172 мільйонами параметрів, яка проектує білкові інтерфейси атом за атомом, досягаючи 78% точності на внутрішньоланцюгових кластерах.

Інженер штучного інтелекту використовує код Клода, щоб стверджувати про розшифровку лінійного літера A, стародавнього мінойського письма
Інженер-самоучка зі штучним інтелектом створив інструменти Python із Claude Code для розшифровки лінійного A, нерозшифрованого мінойського письма. Зараз лінгвісти з Rutgers і Cambridge розглядають цю заяву.

Метод OpenAI «Deployment Simulation» передбачає збої моделі перед запуском
Дослідники OpenAI пропонують метод прогнозування того, як часто моделі ШІ будуть поводитися неправильно після випуску, використовуючи реальні розмови. Він правильно передбачив зміни ризику в 92% випадків.
