GPT-6 Astra от OpenAI добавила к своему рекорду необычный трофей: полное прохождение культовой головоломки от первого лица Portal, завершенное автономно менее чем за 24 часа, при общей стоимости вычислений в 571,18 доллара. The Verge сообщила об этой важной вехе 6 сентября 2026 года, указав на пользователя, известного как Cosyblaze, который подключил модель Frontier к игре и позволил ей разобраться со всем остальным.

Портал — серьезное испытание для ИИ-агента, несмотря на его возраст. Игра, выпущенная Valve в 2007 году, требует от игроков решать пространственные головоломки, используя портальную пушку — создавая связанные отверстия в стенах, полу и потолках для перемещения через испытательные камеры, которые обычно не поддаются интуиции. Здесь нет боевой сложности, на которую можно было бы опереться, и нет маркера квеста, которому нужно следовать; каждая камера, по сути, представляет собой физическую загадку. Для читателей, следящих за тем, как передовые модели проходят стресс-тестирование, этот запуск станет яркой записью в нашем [освещении о разработках в области искусственного интеллекта] (https://aibuzzwire.news).

От демо-видео до полного завершения

Бег не возник из ниоткуда. Ранее, 6 сентября, на Hacker News было распространено видео на YouTube, показывающее, как GPT-6 Astra играет в Portal, а последующий пост, в котором отмечалось, что модель «автономно завершила» игру, привлек внимание в течение дня. В отчете The Verge подтверждены подробности: полная игра, пройденная менее чем за 24 часа, с вычислительными затратами менее 600 долларов, а для скептиков опубликовано сокращенное видео прохождения.

The Verge не смогла удержаться от количественной оценки экологической стороны законопроекта, отметив, что на охлаждение центра обработки данных, вероятно, будет потрачено примерно столько же воды, сколько в небольшом бассейне. Это лукавое напоминание о том, что агентные игровые запуски дешевы для пользователя, но не бесплатны для всей планеты.

Почему Puzzler 2007 года является серьёзным эталоном

Beating Portal не является запланированным тестом, таким как ARC-AGI или SWE-bench, и отчасти именно поэтому он находит отклик. Игра требует именно тех навыков, которые исторически отделяли людей от систем ИИ:

  • Пространственное мышление. Решения требуют предсказания того, куда выход из портала приведет к запуску тела игрока — рассуждения, основанные на трехмерной физике, которые годами сбивали агентов с толку.
  • Долгосрочное планирование. Палаты состоят из нескольких этапов; провал на последнем этапе обычно означает повторение последовательности с самого начала.
  • Учимся на неудачах, не держась за руки. Никаких подсказок. Агент должен путем проб и ошибок определить правила игры, а затем распространить их на новые камеры.

Ранее в этом году GPT-6 Astra от OpenAI превзошла тесты ARC-AGI-3, ориентированные на агентное мышление, и модель привлекла внимание к возможностям использования компьютера — способности управлять программными интерфейсами так, как это делает человек. Запуск портала — это игровая, но подлинная демонстрация того же набора навыков: восприятия, планирования и контроля, разворачивающаяся часами без вмешательства человека.

Часть более широкой волны

Этот успех также является признаком того, куда приземлятся игры с искусственным интеллектом в 2026 году. Результаты тестов теперь делят пространство с культурными вехами: модели, сочиняющие хоралы Баха, преодолевающие тесты на распознавание рукописной коррекции и завершающие игры, которые когда-то заменяли фразу «компьютеры никогда не будут этого делать». Каждый проход освобождает от старой уверенности и поднимает вопрос о том, каким будет следующий.

Есть и практические последствия. Тот же цикл, который позволил настройке Cosyblaze управлять Portal — скриншоты, принятие решений, стоимостью в несколько сотен долларов, — это цикл, который создается для тестирования программного обеспечения, робототехники и помощников по использованию компьютера. Модель, которая может учитывать физику игры для полного прохождения, в принципе может справиться с длинными и запутанными программными задачами, которые побеждают системы с более коротким контекстом.

Однако на данный момент вывод проще. ИИ разгадал одну из самых любимых игровых головоломок от начала до конца примерно по цене депозита за новый графический процессор — и опубликовал видео. Испытательные камеры Aperture Science были спроектированы так, чтобы люди чувствовали себя умнее. В эти выходные они заставили модель выглядеть бегло.

Как был получен запуск

Ответ отражал основные этапы развития игр с искусственным интеллектом в целом: сначала неверие, затем видео, затем принятие. На Hacker News этот запуск привлек постоянный поток комментаторов, разбирающих, как работает эта установка и что она означает для агентного ИИ. Некоторые из них отметили, что общий счет оказался ниже, чем многие предполагали. Сжатое видео завершения дало скептикам возможность самим проверить это утверждение, а это больше, чем предлагают большинство результатов тестов.

Это также позволило провести сравнение с предыдущими этапами. Игры на протяжении десятилетий служили публичным испытательным полигоном: от настольных игр до стратегий в реальном времени и открытых песочниц. Каждый раз, когда игра терпит неудачу, аргументы меняются: сегодняшние скептики утверждают, что подвиг был узким, специализированным или каким-то образом специализированным, не поддающимся обобщению. Что делает работу Портала примечательной в этой истории, так это то, насколько обычной была установка — коммерчески доступная модель Frontier, потребительская игра и несколько сотен долларов вычислительных ресурсов, а не сделанная на заказ исследовательская система, подготовленная специально для игры.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →