Кратко

  • Claude Opus 5 «с одного раза» создал шутер от первого лица с таким простым запросом и настолько впечатляющими результатами, что люди с трудом в это верят.
  • Другие повторили запрос, и результаты подтвердились.
  • Мэтт Шумер, создатель игры на основе Claude, называет этот метод «Петля Gauntlet»: дайте агенту реальную планку для преодоления, разделите работу между свежими критиками и никогда не позволяйте разработчику оценивать свою собственную работу.

Всего через два дня после выхода Claude Opus 5 AI-инвестор и бывший CEO HyperWrite Мэтт Шумер опубликовал видео полностью играбельного шутера от первого лица, который модель создала полностью самостоятельно.

«Claude Opus 5 с одного раза создал эту игру», — написал он, добавив, что в сборке не использовалось ни одного внешнего актива.

Теперь вы можете подумать, что такой качественный результат потребовал длинного, подробного и тщательного запроса, чтобы направлять AI-модели через сложности создания качественного шутера от первого лица.

Подумайте ещё раз.

Запрос, стоящий за этим, состоял из трёх коротких абзацев, опубликованных полностью на GitHub. Он предписывал Opus 5 создать шутер на уровне последних игр Call of Duty, распределить подзадачи между субагентами — работниками, каждый из которых получает свою собственную отдельную память и узкую задачу — для решения частей по отдельности, и продолжать циклически обрабатывать каждую часть с отдельным строгим критиком, пока она не выдержит сравнения с реальными кадрами Call of Duty в слепом параллельном сравнении. Результат, согласно запросу, должен быть «абсолютно совершенным».


Это разворот того, как инженеры подсказок учили людей работать. Совет во время бума вайб-кодинга заключался в том, чтобы указывать критерии вместо прилагательных: говорить, что означает «хорошо», а не просто просить об этом. Что код должен учитывать, вместо того чтобы говорить «AAA».

Версия Шумера делает почти противоположное: просит свои собственные подагенты быть «абсолютно поражёнными» и оставляет фактическое определение критику Opus 5, созданному для себя.

Это было почти всё задание. Позже Шумер написал, что он никогда не указывал рендерер, не перечислял системы игры и не определял, что должно включать «качество AAA». Он начал называть этот подход Gauntlet Loop: передать агенту реальную, проверяемую планку вместо расплывчатой инструкции, позволить ему разбить задачу на мелкие части и направить каждую часть через критика, который никогда не видит собственных обоснований строителя для своих решений.

Две функции Claude Code реализуют этот цикл. Подагенты запускаются в изолированных контекстных окнах со своими собственными инструкциями и доступом к инструментам, поэтому критик, оценивающий модель оружия, не наследует оправдания строителя, почему она выглядит так, как выглядит. Ultracode — это настройка Claude Code, которая подталкивает модель к максимальным усилиям по рассуждению и позволяет ей писать собственный план оркестрации, распределяя работу между до 16 агентов одновременно, с ограничением в 1000 на запуск.

Встроенный навык /loop от Anthropic, созданный для повторяющихся циклов исправления-тестирования-настройки, не позволил процессу остановиться, как только игра стала выглядеть прилично. Шумер не указал количество раундов. Он позволял критику называть новый пробел и заставлял строителя гоняться за ним часами, прежде чем сам закрыл сессию.

Готовая сборка работает на Three.js и обычном WebGL2, с примерно 55 000 строк кода, распределенных по 11 подсистемам. Каждая текстура, сетка, анимация и звук генерируются в браузере во время загрузки — никаких загруженных моделей, HDRIs, файлов изображений или аудиофайлов. Опубликованный журнал критика Шумера показывает, что оценка поднялась с 3,59 из 10 до чуть выше 5, все еще отставая от реальной игры в каждом раунде.

Скептики предполагали часы скрытого ручного кодирования, поэтому Шумер опубликовал весь промпт и кодовую базу. Вот тогда и начались подражатели.

Тот же трюк, три разных строителя

Джеймс Алтучер, бывший менеджер хедж-фонда и подкастер, запустил идентичный промпт и сообщил, что потратил «чуть больше десяти часов» и примерно 1,3 миллиона токенов на Opus 5, чтобы добиться результата. Его сборка, Operation Blackout, бесплатно работает в браузере и выглядит потрясающе.

Вы можете поиграть в эту игру здесь.

Разработчик Prompt Silo направил тот же запрос флагманскому конкуренту OpenAI, написав «Sol 5.6 Ultra с тем же промптом» — Sol является высшим уровнем семейства из трех моделей GPT-5.6, которое OpenAI сделала общедоступным 9 июля вместе с более дешевыми версиями Terra и Luna.

Разработчик Leon Lin попробовал противоположный ход, используя обычный подробный промпт. Вместо того чтобы копировать короткую версию Шумера, он решил «восстановить промпт для этой игры», создав документ глубиной около 20 разделов, в котором расписано всё: от физики тряпичных кукол до каскадных карт теней. Он загрузил это в Cursor, используя обычный Opus 5 с высокими усилиями, без субагентов и без ультракода, и результат — шутер на рыночной улице под названием Dust Corridor — также работает в браузере и выглядит отлично.

Ни одна из последующих сборок не прошла слепой тест, который Шумер провел на своем собственном проекте. Его журнал критика все еще показывает, что настоящий Call of Duty выигрывает каждый раунд, который он записал — планка, за которой гонятся Альтушер и Atom Tan Studio с его точным трехпараграфным промптом, и та, за которой гонится Леон Лин с примерно 20 разделами своего собственного.

Сколько из этого на самом деле нового?

Агентные инструменты кодирования, такие как Claude Code, пишут программное обеспечение так, как это мог бы делать контролируемый младший инженер: они читают файлы, запускают код, смотрят на сгенерированные скриншоты и передают части работы субагентам и критикам, которые проверяют результат на соответствие поставленной цели. Этот цикл реален, и Gauntlet Loop Шумера — это настоящий способ его структурировать. Ничто из этого само по себе не доказывает, что модель разработала игру из воображения, а не перекомбинировала уже усвоенные шаблоны кода.

Three.js поставляет свои собственные управления камерой с блокировкой указателя в качестве официального примера, и этот базовый шаблон — управление мышью, движение WASD, рейкастинг для стрельбы — форкался и использовался в учебниках на GitHub, gist'ах и форумах разработчиков более десяти лет. Модель кодирования, обученная на публичных репозиториях, почти наверняка видела сотни, если не тысячи почти идентичных шутеров до того, как прочитала промпт Шумера.

Это не делает Claude of Duty подделкой, но делает утверждение "создано с нуля" более сложным для полного признания, так что относитесь к этим результатам с долей скептицизма.

Исследователи, изучающие модели генерации кода, имеют название для более широкой проблемы: загрязнение данных, когда модель хорошо справляется с задачей в основном потому, что почти идентичные примеры уже были в её обучающих данных, а не потому, что она вывела что-то новое.

Ни одна из сборок шутера от первого лица не опубликовала проверку на такой вид загрязнения. Собственный репозиторий Шумера действительно содержит творчество Клода, если это можно так назвать. Это причина читать «создал AAA-игру с одного раза» как способного агента, работающего в одном из самых задокументированных жанров программирования, а не как доказательство того, что ИИ спроектировал шутер без опоры на предшествующие работы.