OpenAI відкликав три з 722 препринтів досліджень, опублікованих на GitHub 6 жовтня, повідомляє Retraction Watch 8 жовтня, після того, як помилка знака скасувала центральний аргумент, а разом з ним і два результати, які залежали від цієї конструкції. Відкликання відбулося менш ніж через 24 години після масового випуску, який OpenAI назвав спробою «розсунути межі людських знань і забезпечити подальший прогрес у математиці».

Препринти описували передбачуваний прогрес внутрішньої моделі штучного інтелекту щодо 372 невирішених проблем з геометрії, інформатики, алгебри та інших галузей. Цей крок викликав негайну ретельну увагу дослідницьких спільнот — і, як ми писали на початку цього тижня в нашому звіті про [первинний випуск 722 математичних рукописів] (https://aibuzzwire.news), компанія представила це падіння як безпрецедентну демонстрацію того, що може дати її неопублікована гранична модель. Слідкуйте за останніми новинами в нашому звіті про останні розробки ШІ.

Знакова помилка каскадує через залежні докази

7 жовтня OpenAI оголосив про відкликання трьох рукописів через помилку підпису. Згідно з оголошенням, помилка зробила недійсним аргумент в одному рукописі та конструкцію, використану в двох залежних статтях. Кожен відкликаний документ тепер містить повідомлення, що пояснює «розрив».

Компанія також повідомила, що переглянула 14 інших рукописів із виправленнями доказів, виправленими твердженнями, чіткішими гіпотезами та залежностями та одним виправленням застарілої цитати. Ден Робертс, дослідник OpenAI, оголосив про відкликання на X і написав, що компанія «продовжить оновлювати репо за допомогою нових формалізацій і будь-яких помилок, які ми помітимо».

Представник OpenAI повідомив Retraction Watch, що компанія виявила помилки під час аудиту, описавши процес як повторюваний, «як і в інших рукописах досліджень». Прес-секретар додав, що OpenAI вітає ретельну перевірку та «працюватиме над виправленням [помилок] негайно та відкликатиме документи, якщо не вдасться знайти виправлення».

Примітно, що представник OpenAI сказав, що співробітники компанії з Консультативної групи з математики та штучного інтелекту (AGMAI) рекомендували оприлюднити результати, не чекаючи «повної формалізації» — і що приблизно 50% результатів були оприлюднені непідтвердженими.

Математики: швидкі рішення, втрачена довіра

Реакція математиків-дослідників була зваженою, але однозначною. Алекс Таунсенд, ад’юнкт-професор математики Корнельського університету, сказав Retraction Watch, що каскадна помилка в трьох рукописах не є дивною, і він підозрює, що буде знайдено більше помилок. «Враховуючи скептицизм щодо штучного інтелекту в математичному співтоваристві, я вважаю, що OpenAI повинен був оголосити про рукописи, які спочатку були перевірені Lean», — сказав він, маючи на увазі мову програмування з відкритим кодом, яка механічно перевіряє математичні докази. Окреме оголошення могло б запросити допомогу спільноти для перевірки решти, стверджував він.

Ендрю Сазерленд, старший науковий співробітник математичного факультету Массачусетського технологічного інституту, сказав, що він цінує швидкі дії OpenAI після виявлення помилок, назвавши це «відповідальною справою». Але він підкреслив, що багато математиків залишаються «незадоволеними тим, як OpenAI поводився до цього моменту», вказавши, зокрема, на заяву компанії 8 вересня про те, що система штучного інтелекту вирішила проблему Нав’є-Стокса — твердження, яке група провідних дослідників розкритикувала як поспішне, «не залишивши часу для належного опису, виділення нових методів та ідей і цитування відповідної попередньої роботи інших». Понад 8000 дослідників підтримали ці побоювання.

Асоціація людської математики пішла далі в заяві, опублікованій 7 жовтня: «Математики не вимагали виконання цієї роботи. Оприлюднення понад 700 файлів одночасно є не демонстрацією вченості, а демонстрацією сили. Ми закликаємо математиків припинити роботу з OpenAI і повернутися до бачення науки, яка зосереджує людське розуміння».

Що це означає для науки, створеної ШІ

Цей епізод виглядає як ранній тестовий приклад того, як лабораторії штучного інтелекту мають проводити масштабні дослідження, створені машиною. Підхід OpenAI — швидкий випуск, публічний аудит, вилучення того, що не вдається — контрастує з підходом, який надає перевагу формальній перевірці багатьом математикам, коли результати перевіряються в помічнику з доказів, як-от Lean, перед будь-яким оголошенням.

Є розумні аргументи з обох сторін. Очікування повної формалізації може затримати корисні результати на місяці, і OpenAI каже, що він був випущений з благословення AGMAI. Але ефект каскаду — помилка одного знака видаляє дві залежні статті — ілюструє, чому перевірка перед публікацією є нормою в математиці, і чому, ймовірно, з’явиться більше помилок, коли спільнота працює над рештою приблизно 700 рукописів.

Наразі OpenAI каже, що хоче вчитися на відгуках і буде слідувати протоколу AGMAI «наскільки зможе» надалі. Інше питання, чи достатньо цього, щоб відновити довіру математичної спільноти. Як зазначив Сазерленд: «Я думаю, що математичне співтовариство позитивно сприйме вилучення та виправлення, але знадобиться набагато більше, ніж це, щоб повернути втрачену довіру».

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

Читати більше новин AI →