Обзор техники Guntlet Loop для промптинга Claude Code и Codex, позволяющей создавать сложные проекты с помощью агентов и критиков.
Key Takeaways
- Guntlet Loop позволяет создавать сложные проекты с помощью многократной проверки и разделения задач между сабагентами.
- Отделение строительного агента и критика с чистым контекстом повышает объективность оценки результата.
- Техника эффективна для сложных задач, где требуется высокая точность и качество результата с одного промта.
- Использование Guntlet Loop требует больше ресурсов и токенов, что увеличивает стоимость работы.
- Рекомендуется комбинировать Guntlet Loop с другими методами для создания MVP и последующего улучшения продукта.
What the video covers
- Представлена новая техника промптинга Guntlet Loop, которая позволяет одним промтом создавать полноценные 3D-игры и кастомные миры.
- Техника основана на работе флотом сабагентов, каждый из которых выполняет свою часть задачи и проверяется отдельным критиком.
- Объяснено, почему обычные агенты часто выдают посредственные результаты из-за необъективной самооценки в одном контекстном окне.
- Разбор промта на три части: задача, метод сборки с сабагентами и целевая планка для оценки результата.
- Показано, как Guntlet Loop превосходит базовые методы работы с агентами, обеспечивая многократную проверку и доработку.
- Приведен пример использования техники на реальной продуктовой задаче — создании помощника для сайта Focus Forge.
- Обсуждаются технические детали интеграции с API, управление ключами и выбор моделей для работы агентов.
- Отмечены преимущества и недостатки метода, включая высокую стоимость из-за большого количества запросов и токенов.
- Дана рекомендация сначала создавать MVP с помощью других техник, а затем улучшать продукт с помощью Guntlet Loop.
- Видео содержит практическую демонстрацию и советы по применению техники в реальных проектах.
Chapters
- 00:00Введение в технику Guntlet Loop
- 01:02Пример создания игры Call of Duty с помощью Claude Code
- 02:02Проблемы обычных агентов и необъективность оценки
- 02:56Структура промта: задача, метод, целевая планка
- 04:00Уровни работы с агентами и преимущества Guntlet Loop
- 06:10Применение Guntlet Loop на примере Focus Forge
- 07:19Техническая реализация и интеграция с API
- 09:05Практическая демонстрация и обсуждение результатов
- 11:09Заключение и рекомендации по использованию
Full Transcript — Download SRT & Markdown
Speaker A
Есть новая техника промтинга, которая сейчас взрывает людям мозг, потому что одним промтом она может собрать полностью рабочие 3D-игры и гиперкастомные миры. И агент сам разгоняет об агентов-строителей, каждому представляет отдельного критика и не останавливается, пока результат не пройдёт жёсткую проверку. Такой подход
Speaker A
называется Guntlet Loop. И название тут говорящее. Guntlet в переводе — это проходить сквозь строй. Результаты и агента прогоняют через критиков круг за кругом, пока он не выдержит проверку. В этом ролике я покажу, как собрать такой же цикл под свои задачи. Разберём, из
Speaker A
каких трёх частей состоит данный промт. Разберём, почему обычные агенты халтурят, как работает связка строитель плюс критик, а потом проверим всё на реальной продуктовой задаче. Поехали.
Speaker A
Эту технику подробно описал и, можно сказать, придумал такой челик под именем Мэт Шумер. И как мы видим, его посты разлетелись на миллионы просмотров. При помощи Guntlet Loop Мэт одним промтом собрал вот такой шутанчик в стиле Call of Duty. Он не использовал
Speaker A
ни одного внешнего файла, то есть все вот эти текстурки, коробки, звуки выстрелов, в целом звуки в игре, а модельки, всё это было собрано при помощи клод-кода до полноценного Call of Duty. Эта демка, конечно, не дотягивает, и Мэт Шумер сам это признаёт, но тем не
Speaker A
менее, вдумайтесь только, до чего техника дошла. С одного промта полноценную демку со спецэффектами, с пострелушками. И всё это за один шот.
Speaker A
Вот такие гоночки в стиле Mario Kart, кстати, тоже собирал. Открытый исходный код и промт выложен на гитхабе, поэтому давайте мы его разберём. Хорошо делать, чтобы на своих проектах подобную технику применить и с одного шота делать красоту. Но сперва давайте разберёмся,
Speaker A
почему агент так часто выдаёт нам средние результаты. Мы уже не один раз это обсуждали, но, как говорится, повторение — мать учения. Посредственное качество получается, потому что агент и строит, и проверяет свой результат в одном контекстном окне. Он видел каждый свой шаг, он видел свои
Speaker A
рассуждения, и поэтому он сам себя уже будет убеждать, что это решение правильное и вот надо делать только так и никак иначе. Короче, можно сказать, что взгляд у нейронки замыливается, и она оценивает свою работу необъективно.
Speaker A
И сейчас мы разберём с вами промт, который решает эту проблему. Вот как раз промт по Call of Duty, и его можно разбить на три части. Первая часть — это задача, что конкретно мы должны сделать и как это должно выглядеть в финале.
Speaker A
Вторая часть этого промта — метод сборки, то есть как мы будем билдить наш продукт. В данном случае у нас есть главный агент, который раздаёт свои задачки сабагентам, то есть помощникам.
Speaker A
У каждого такого помощника свой участок задач. И как раз на чём Шумер делает акцент. Он говорит, что нужно дать агенту цель, а не дать план подробной реализации. И третья часть промта — это целевая планка. То есть до какого
Speaker A
результата мы должны довести нашу задачу, чтобы её можно было полноценно принять. В оригинальном запросе, как мы видим, планка — это конкретный эталон, который мы можем посмотреть и сравнить с ним. Скриншоты какие-то по визуалу, по графике, по геймплею, какие-то,
Speaker A
возможно, части геймплея. И что у нас в итоге получается? Строит один субагент, а проверяет его другой субагент. Можно сказать, что это критик с чистым контекстом. Он не видел процесс сборки.
Speaker A
Он не наследует оптимизм предыдущего сабагента, который всё это дело строил. Смотрит только на результат. Каких-то дополнительных плагинов, расширений, скилов устанавливать не нужно. Сабагенты есть и в клод-коде, и в кодексе прямо из коробки. Единственное, что в клод-коде есть отдельная задачка/loops, а в
Speaker A
кодексе нужно просто текстом писать, что вы хотите. Далее я как раз это покажу, но сперва давайте посмотрим, где эта техника находится среди разных подходов при работе с ИИ. Первый уровень самый базовый. Я думаю, 90% людей, которые работают с ИИ, работают в таком
Speaker A
сценарии. То есть вы дали задачу агенту, он её выполнил, вы смотрите на результат, оцениваете и даёте обратную связь. Прикольно. И большой контроль над происходящим. Но проблема в том, что количество задач ограничено вашим личным временем и вашей личной внимательностью.
Speaker A
Как мы знаем, время — самый дорогой ресурс, плюс фокус у нас тоже ограничен. Мы не можем 250 задач одновременно выполнять. Что, кстати, может делать агент, в отличие от человека? Следующий уровень — это у нас обычный цикл. Вы даёте задачку агенту, он её делает,
Speaker A
отдаёт на проверку критику. Критик с чистым контекстным окном всё это дело проверяет, и если результат критика устраивает, он отдаёт финальный результат вам на проверку. Если результат критика не устраивает, он отдаёт его обратно агенту на доработку.
Speaker A
И вот так вот циклами мы ходим. Кстати, прошлый ролик у меня был про подборку скилов от МТА Покака. Там один из способов довести задачу до конца устроен по похожему принципу. Код пишется одним агентом, проверяется уже двумя параллельными агентами с чистым
Speaker A
контекстным окном. Рекомендую посмотреть, подсказочка будет где-то здесь. Для общего развития самое то. И третий уровень работы с агентами — это как раз Guntlet Loop. Вы запускаете флот сабагентов. У каждого свой участок работы и у каждого свой критик. После
Speaker A
кучи сожжённых токенов и выполненных задач, оценки всего этого дела критиками, финальный результат уже выдаётся вам. Из-за такого большого количества проверок сожжённых токенов обычно и получается хороший результат с одного шота. Если пока всё звучит абстрактно и вы такие: "Блин, Альберт,
Speaker A
ну покажи практику", не переживайте, практика как раз сейчас будет. Мы применим вот эту технику на обычные продуктовые задачи и посмотрим, что из этого выйдет. А вы пока лайкните этот ролик, подпишитесь и нажмите на колокольчик. Мне будет очень приятно.
Speaker A
Теперь переносим GL loop из теории в практическую нормальную рабочую задачу. Встречайте мой сайт apps Focus Forge. Я его в своих роликах уже подсвечивал. Это бесплатный помидора таймер, которым вы можете пользоваться. Вот ссылочка. Кто любит работать с промтами, повышать свою
Speaker A
продуктивность, записывать тут всякие задачки, welcome. Пользуйтесь, пожалуйста. Всё бесплатно, по крайней мере. Пока. Я хочу накидывать сюда дополнительные обвесы, возможно, для платных подписчиков какой-нибудь и помощник. И я хочу, чтобы этот и помощник делал две вещи. Первое, например, вы пишите какую-то большую
Speaker A
задачу по типу: "Хочу выпустить ролик про Guntlet Loop." И помощник должен разбить эту масштабную задачку на задач поменьше, раздробить всё: например, поиск референсов, поиск исходных материалов, генерация сценария, потом генерация обложек, съёмка, подготовка к съёмке, описание ролика на Ютубе. Ну и
Speaker A
вот это вот всё. Вы подтверждаете эти задачки, они появляются у вас вот тут в списке помидора таймера. И вторая штука, которую я хочу добавить, — это чтобы и помощник оценивал результаты вашей сессии. То есть в конце дня он смотрел,
Speaker A
какие задачи вы выполнили, какие задачи вы не выполнили, и писал свои рекомендации, возможно, выставлял приоритеты по вашим задачам на следующий день. Короче, ваш типа персональный ассистент. И как раз вот этого и помощника мы будем с вами собирать через
Speaker A
Guntlet Loop. Интерфейс, локальный безопасный слой для API, промты для моделей и проверку, что всё работает.
Speaker A
Для пользователя это всего лишь и помощник по подписке, ключи, выбор модели, системный промт — это уже на моей стороне. Мне нужен доступ к различным моделям, контроль расходов и понятный кабинет, где все процессы можно обследить. Для этих задач я возьму и
Speaker A
роутер от Selectel. Я уже создал аккаунт, запилил тестовый проект, и давайте создадим и роутер. Нажимаю создать. Мне выдаётся единый API-ключ, и через него я могу работать с кучей моделей. Как мы видим, тут все возможные модельки имеются. Их 363 штуки. И они,
Speaker A
естественно, постоянно пополняются. В панели я могу выбрать модель, с которой мне предстоит работать, ограничить бюджет по каким-то лимитам для моего API-ключа, создать несколько ключей под различные задачи. Один ключ под Focus Forge, другой.
Speaker A
нам нужно сделать инфраструктуру внутри Focus Forge, чтобы тут был какой-то и помощник, которому мы отдаём запрос. Он этот запрос отправляет по опишке вот сюда, в наш Select, например, чтобы запрос шёл только через модельку Квен.
Speaker A
Запросы и ответы здесь проходят транзитом, не логируются и не используются для обучения модели. Для задач внутри Focus Forge. Ну, чтобы была какая-то конфиденциальность. Мне это подходит. Если хотите собрать нечто подобное в своём сервисе, то ссылочка на eу от Selecttel будет в описании.
Speaker A
Регистрируйтесь и запускайте популярные модельки из одного окна с оплатой в рублях. Так, ну, ключ я уже выпустил.
Speaker A
Давайте открывать проект и давать агенту задачки. Задача нашего цикла в данном случае добавить и помощника. В интерфейсе нужна отдельная панель с двумя действиями: разбить большую задачу на подзадачки и подвести итоги сзади.
Speaker A
После выполнения задачи агент ещё должен всё проверить, что сайт работает, что всё открывается, что ничего мы там не поломали и что всё у нас чётенько. Я запускаю цикл пронтом из трёх частей.
Speaker A
Если что, вот он. Можете поставить на паузу и почитать более подробно, что там написано. Но если вкратце первая часть - это задача, что мы трогаем и что мы не трогаем. Вторая часть - это метод выполнения. То есть то, что мы работаем
Speaker A
с субагентами, субагентом прикрепляем критиков с чистым контекстом, которые нас проверяют. И третья планка - чек-лист, который пока мы не выполним.
Speaker A
Цикл, ну, не должен заканчиваться. И это постоянная проверка, об которую будет спотыкаться наш агент. Выполнен весь чек-лист. Всё, о'кей. Тогда мы отдаём задачу в продакшн. Ну что ж, я запускаю своего боевого товарища кодекс и посмотрим, что у нас получится.
Speaker A
Агент проработал какое-то количество времени. Тут у меня, конечно, возникли, как всегда, с ключами вопросики, потому что GPT достаточно щепетилиен. по теме безопасности и не разрешает вставлять ключи прямо в чатик. Ну и пришлось немножко попотеть. Но основную работу агент делал на протяжении часа
Speaker A
практически гонял там всё перегонял. Как мы видим, запускались билдеры, также запускались критики параллельно. Вот всё это работало с субагентами. Security у нас прошлось тут Security Builder, Security Critic и потом UI Critic. Всё это проверялось. Финальный результат у нас получился. Давайте его посмотрим,
Speaker A
выполнилась ли задача. А, как вы видите, появился новый интерфейс. Да, и помощник. Бетаверсия помогает задачами и итогами дня. Давайте я нажму на итоги дня, разобрать день. Что он напишет? Он анализирует мои итоги дня, какие задачи у меня были, какие задачи сделаны, и
Speaker A
отправляет этот запрос, ну, через прокси, получается, в Select. Я сейчас работаю через Gini Flash, чтобы быстро вам всё показать. Можно потом модельку выбрать по поумнее, какой-нибудь клод, но это дорого. Ну, короче, он пишет: "Типa челик, что ты нам тут пустые итоги
Speaker A
дня скармливаешь? На завтра запланируете хотя бы одну небольшую задачу, чтобы начать движение и не терять продуктивность". Ну отлично, спасибо. И давайте с вами большие задачи разбивать на шаги. Допустим, я хочу подтягиваться, и я хочу достичь двадцати подтягиваний.
Speaker A
И давайте разобьём на шаги. Он нам предлагает шесть шагов быстро. Google Дмини, конечно, отвечает. Начать делать подтягивание, увеличить количество повторений, тренироваться регулярно, совершенствовать технику, улучшить силу хватать силовые тренировки. Ну, в целом задачи понятные, мы можем их выбрать, добавить. Они у нас тут появились. Итак,
Speaker A
давайте ещё какую-нибудь задачу придумаем. Минифлш, конечно, нам такую базу базовую даёт. Давайте пост про безопасность при работе с и вот так вот. И разбиваем на шаги. Посмотрим, что он нам предложит. Базовые дефолтные задачки.
Speaker A
Он, конечно, слишком подробно дробит нашу задачу, но это всё системным пронтом уже делает. Наш функционал работает. Вот я выбираю вот эти задачи, добавляю выбранное. Всё, они добавились в мой Focus Forge. И теперь я с ними могу работать. И давайте переходить к
Speaker A
завершающей части ролика. Всё круто, классно, молодёжно всё получилось достаточно качественно. Но есть несколько нюансов, которые нужно обсудить. Первое, подобные циклы достаточно дорогие, потому что у нас несколько сабагентов сразу работают, потом ещё и проверки идут, и вот эти вот
Speaker A
сами петли тоже много времени и токенов потребляют. Поэтому есть важное правило. Если вы уже видите, что результат достаточно рабочий, циклы продолжают крутиться, вы имеете право их остановить, чтобы не растягивать разработку и не увеличивать бюджет на токены. И ещё один нюанс: циклы подобные
Speaker A
не стоит запускать прямо с нуля. Если проекты ещё не существуют и агент начнёт делать его с нуля, то он может пойти не в ту сторону и начать полировать как раз не те вещи, которые нужны. В идеале использовать подобные циклы уже на
Speaker A
какую-топишку. То есть у вас есть сайт и вы хотите докрутить какую-то большую фичу, и вы для этого запускаете loop, как было и в моём случае. Потому что если с нуля вы что-то начнёте делать, то тут могут возникнуть вопросики, агент
Speaker A
вообще уйдёт не в ту сторону, потому что вы ему предоставили большое поле для действа и выбора. Вначале мы делаем сами какой-то MVP при помощи других техник, да, какой-то минимальный продукт, а уже дополнительные штуки накидываем при помощи подобного Gedop. Напишите в
Speaker A
комментариях, пробовали ли вы подобные циклы, либо сейчас попробуете. Обязательно делитесь результатом, что у вас там получится. Ну и не забывайте жмякнуть подписку, оформить лайк и колокольчик. А на этом будем прощаться.
Speaker A
Увидимся совсем скоро. Будьте классными. Пока-пока.
Topics:промптингGuntlet LoopClaude CodeCodexагенты ИИсабагентыкритики3D-игрыавтоматизация задачFocus Forge











