LIVE
Flock откупается от сотрудников на фоне скандала со слежкой Трамп предлагает переименовать AI и создаёт «AI Force» Gemini от Google самостоятельно взломала три компании Стартап Vals хочет стать новым эталоном для проверки AI — пока компании ещё не научились обманывать и его Разговоры про безопасность AI дошли до абсурда — и всё равно пугают по-настоящему Flock откупается от сотрудников на фоне скандала со слежкой Трамп предлагает переименовать AI и создаёт «AI Force» Gemini от Google самостоятельно взломала три компании Стартап Vals хочет стать новым эталоном для проверки AI — пока компании ещё не научились обманывать и его Разговоры про безопасность AI дошли до абсурда — и всё равно пугают по-настоящему
Новости ИИ

GPT-6 Astra прошла Portal в одиночку — тихая победа над целью десятилетней давности

автор: shmelev дата: 8 сентября 2026 чтение: 2 мин

В 2016 году OpenAI поставила задачу, которая тогда звучала почти фантастически: создать единого агента, способного решать самые разные игровые задачи без специальной настройки под каждую из них. Десять лет спустя цель молча реализовалась — не в презентации на сцене, а в посте разработчика под ником cozyblaze в X.

Он запустил GPT-6 Astra на прохождение Portal — головоломки, где нужно мыслить в трёх измерениях, помнить физику порталов и планировать на несколько шагов вперёд. Модель прошла игру целиком, от первого уровня до финальных титров, без единой подсказки человека после того, как ей поставили изначальную цель. Всё заняло 23 часа 43 минуты.

Технически это выглядело так: агент управлял игрой через MCP и модифицированный инструмент SourcePauseTool, который ставит игру на паузу, пока модель «думает». В каждую такую паузу Astra получала скриншот, координаты игрока и угол камеры, выбирала следующее действие — и игра возобновлялась. Ни разу человек не подсказал решение головоломки.

Стоимость такого прогона по публичным ценам API составила бы около $570, хотя сам cozyblaze обошёлся подпиской Codex за $200. Код и документация выложены в открытый доступ на GitHub — при желании эксперимент можно перепроверить.

Особенно откровенной получилась подпись самого разработчика: он назвал Astra «худшей моделью, которая у нас когда-либо будет» — намекая, что дальше способности будут только расти. Слова прозвучали не как маркетинг, а как констатация: то, что раньше было далёкой целью исследовательской лаборатории, теперь умещается в один твит и видео на YouTube.

Во что углубиться:

  • Универсальные AI-агенты: почему прохождение видеоигр — стандартный тест для проверки многошагового планирования
  • MCP-протокол: как модели вроде Astra подключаются к внешним инструментам и играм
  • История цели OpenAI 2016 года: с чего начинались эксперименты с играми как полигоном для AI

Реклама
ЛИДЕРБОРД · 728 × 90зона «Реклама: между секциями»