Loading prices...
Все новости
Два матовых кольца, янтарное и синее, стоят друг напротив друга на тёмном полу, между ними застыл светлый куб, сверху бледный граф из узлов

GPT-6 Astra прошёл Portal сам, и большую часть времени игра стояла

Разработчик, пишущий под ником cozyblaze, поставил GPT-6 Astra одну цель и отпустил его играть в Portal. Модель дошла до титров без дальнейшего участия человека, а прохождение, как пишет The Decoder, заняло около 23 часов 43 минут.

Большую часть этого времени игра стояла на паузе.

GPT-6 Astra — худшая модель, которая у нас когда-либо будет.

Разработчик cozyblaze, The Decoder, 8 сентября 2026 года

Источник цитаты: разработчик cozyblaze, в изложении The Decoder

Игра стояла на паузе, пока модель думала

Astra управляет игрой через Model Context Protocol и переделанную версию SourcePauseTool. Цикл состоит из четырёх шагов:

  1. Инструмент ставит Portal на паузу.
  2. Модель получает скриншот, позицию игрока и угол камеры.
  3. Она выбирает, что нажать.
  4. Инструмент снимает паузу.

Получается, что часы модели шли почти сутки, а часы игры почти стояли. В опубликованном видео паузы вырезаны — поэтому запись выглядит игрой, а не перепиской.

Вот честная рамка. Astra не реагировал на игру в реальном времени. Он играл в её пошаговую версию, которую сам себе и сделал, а достижение здесь — планирование на тысячи ходов без вмешательства человека.

Из этого цикла следует ещё одно: модель никогда не видит движения. Ей достаются неподвижные кадры, координата и угол, а нажатия она назначает, не имея возможности посмотреть, как они исполняются. Portal — головоломка про инерцию, которую вы проносите через портал, поэтому решать её по фотографиям труднее, чем глядя на экран.

Сколько стоят сутки работы агента

Токенов ушло минимум на $570 по прайсу Astra. Cozyblaze запускал всё это на подписке Codex за $200, так что эксперимент обошёлся владельцу модели дороже, чем самому экспериментатору.

Прохождения Portal никто не продаёт, поэтому цифра важна только как единица измерения. Сутки непрерывной работы агента над задачей с ясным условием победы и бесплатными попытками стоят несколько сотен долларов в токенах. У большинства полезных задач нет ни ясного условия победы, ни бесплатных попыток.

Цель, поставленная в 2016 году

Цель решать множество разных игр одним агентом OpenAI поставила себе ещё в 2016 году, когда выпустила платформу Universe. Десять лет спустя любитель сделал это для одной игры на потребительской подписке, взяв общую модель, которую этому не учили.

Код и документация лежат на GitHub, так что прохождение может повторить любой, кто готов потратить токены. Это важнее самого результата. Демонстрация, которую нельзя повторить, — это заявление, а здесь не тот случай.

На прошлой неделе мы разбирали отчёт по безопасности Astra, где OpenAI сообщала о безупречных результатах на тестах по эксплуатации уязвимостей, а днём позже — извинения за его запуск. Модель, которой можно дать цель и оставить на сутки, — это одна и та же способность, прочитанная двумя способами.

Материал носит информационный характер и не является инвестиционной рекомендацией.

Опубликовано: 11:20 · 08.09.2026
Maks

Автор

Maks

Трейдер

Долгое время интересуюсь рынком криптовалют, являюсь трейдером, пишу статьи и новости о своем опыте простыми словами.

Комментарии (0)

Пока нет комментариев — будь первым!

Крипторынок производит шум. Мы присылаем сигнал

Письмо, ради которого стоит открыть почту