Інвестор у ШІ та колишній CEO HyperWrite Метт Шумер опублікував відео з повністю ігрового шутера від першої особи, повністю створеного Claude Opus 5, через два дні після виходу моделі, використовуючи трьохабзацний промпт, опублікований на GitHub. Гра, яку Шумер назвав «зробленою за один підхід» без зовнішніх активів, одразу викликала скепсис через якість і простоту промпта. Шумер опублікував повний промпт і кодову базу після того, як критики припустили приховане ручне програмування, спонукавши багатьох розробників відтворити результати тим самим методом, який він називає Gauntlet Loop.
Claude Opus 5 будує шутер від першої особи з трьохабзацним промптом
25 липня Метт Шумер повідомив, що Claude Opus 5 створив гру-шутер від першої особи з промптом, який працює трьома короткими абзацами. Промпт, повністю опублікований на GitHub, наказував Opus 5 зібрати шутер на рівні нещодавніх ігор серії Call of Duty, розгорнути субагентів для окремих завдань і робити цикл для кожної частини через окремого критика, доки вона не відповідатиме реальним кадрам Call of Duty в сліпих порівняннях пліч-о-пліч. Готова збірка працює на Three.js і WebGL2, із приблизно 55 000 рядків коду в 11 підсистемах. Кожна текстура, меш, анімація та звук генеруються всередині браузера під час завантаження — без завантажених моделей чи зовнішніх файлів.
Шумер ніколи не вказував рендерер, перелічував системи гри або визначав вимоги рівня AAA. Промпт наказував субагентам бути «враженими до сліз» і лишив реальні визначення критикові, якого Opus 5 створив для себе. Опублікований Шумером лог критика показує, що оцінки зростали від 3,59 з 10 до трохи вище 5, причому справжній Call of Duty вигравав кожен раунд, який було логовано.
Розробники відтворюють результати з ідентичними та зміненими промптами
Джеймс Альтучер, колишній керівник хедж-фонду та подкастер, запустив ідентичний промпт і повідомив, що витратив понад 10 годин і приблизно 1,3 мільйона токенів на Opus 5. Його збірка Operation Blackout грає безкоштовно прямо в браузері. Розробник Prompt Silo спрямував ту саму вимогу на Sol 5.6 Ultra від OpenAI — верхній рівень тримодельного сімейства GPT-5.6, який OpenAI зробила доступним загалом 9 липня. Розробник Леон Лін реверс-інжинірив детальний промпт, що йде в глиб 20 розділів, вказуючи елементи від фізики ragdoll до каскадних картин тіней, і передав його в Cursor, використавши звичайний Opus 5 на високому зусиллі без субагентів і без ultracode. Його результат, Dust Corridor, також працює в браузері.
Жодна з подальших збірок не проходила сліпий тест, який Шумер провів для свого проєкту. Лог критика Шумера показує, що реальний Call of Duty вигравав кожен раунд, який він логував.
Метод Gauntlet Loop перевертає традиційний підхід до інженерії промптів
Шумер називає свій підхід Gauntlet Loop: дати агенту реальний, придатний для перевірки «поріг», а не туманні інструкції, розбити роботу на дрібні частини й пропускати кожну частину через критика, який ніколи не бачить міркувань будівельника. Дві функції Claude Code підтримують цей цикл. Субагенти розгортаються в ізольованих контекстних вікнах зі своїми інструкціями та доступом до інструментів, тож критик, який оцінює модель зброї, не переймає «виправдання» будівельника. Ultracode — це налаштування в Claude Code, яке підштовхує модель до максимальної глибини міркувань і дозволяє їй написати власний план оркестрації, розсилаючи роботу аж на 16 агентів одночасно, з лімітом до 1 000 за один запуск.
Вбудована навичка Anthropic /loop, створена для повторюваних циклів «виправити—перевірити—адаптувати», не дала запуску зупинитися, щойно гра виглядала пристойно. Шумер ніколи не вказував кількість раундів і дозволяв критику годинами називати нові прогалини, перш ніж закрити сесію.
Дослідники піднімають занепокоєння щодо забруднення даних
Three.js постачає власні елементи керування камерою з pointer-lock як офіційний приклад, а базовий патерн — керування мишею, переміщення WASD, raycasting для стрільби — зазнав форків і навчальних адаптацій на GitHub, gists та на форумах розробників уже понад десятиліття. Модель кодування, натренована на публічних репозиторіях, імовірно бачила сотні або навіть тисячі майже ідентичних шутерів до того, як прочитала промпт Шумера. Дослідники, які вивчають моделі, що генерують код, називають це забрудненням даних: модель добре виконує завдання головним чином тому, що близько ідентичні приклади вже були в її тренувальних даних, а не тому, що вона придумала щось нове.
Жодна з перших збірок шутера від першої особи не містила перевірки на забруднення даних. Репозиторій Шумера, втім, містить код, який згенерувала модель, але це робить фразу «зробив AAA-раннер за один підхід» не доказом того, що ШІ, який створює шутер, не має на що спертися, а натомість доказом спроможного агента, який працює в одному з найдетальніше задокументованих жанрів у програмуванні.
Поширені запитання
Що саме містив промпт Matt Shumer для Claude Opus 5?
Промпт містив три короткі абзаци, опубліковані на GitHub. Він наказував Opus 5 збудувати шутер на рівні нещодавніх ігор Call of Duty, розгорнути субагентів для окремих завдань і робити цикл для кожної частини через окремого критика, доки вона не відповідатиме реальним кадрам Call of Duty в сліпих порівняннях пліч-о-пліч. Шумер ніколи не вказував рендерер, не перелічував системи гри та не визначав вимоги AAA якості.
Як інші розробники відтворили результати створення гри Claude Opus 5?
Джеймс Альтучер запустив ідентичний промпт і витратив понад 10 годин та приблизно 1,3 мільйона токенів на Opus 5, щоб зібрати Operation Blackout. Розробник Prompt Silo використав Sol 5.6 Ultra від OpenAI з тим самим промптом. Розробник Леон Лін провів реверс-інжиніринг детального промпта з 20 розділів і передав його в Cursor, використавши звичайний Opus 5 без субагентів і без ultracode, щоб отримати Dust Corridor.