Skip to content

Эта НОВАЯ техника промптинга для Claude Code и Codex взрывает людям мозг (gauntlet-loop)

Обзор техники Guntlet Loop для промптинга Claude Code и Codex, позволяющей создавать сложные проекты с помощью агентов и критиков.

Key Takeaways

  • Guntlet Loop позволяет создавать сложные проекты с помощью многократной проверки и разделения задач между сабагентами.
  • Отделение строительного агента и критика с чистым контекстом повышает объективность оценки результата.
  • Техника эффективна для сложных задач, где требуется высокая точность и качество результата с одного промта.
  • Использование Guntlet Loop требует больше ресурсов и токенов, что увеличивает стоимость работы.
  • Рекомендуется комбинировать Guntlet Loop с другими методами для создания MVP и последующего улучшения продукта.

What the video covers

  • Представлена новая техника промптинга Guntlet Loop, которая позволяет одним промтом создавать полноценные 3D-игры и кастомные миры.
  • Техника основана на работе флотом сабагентов, каждый из которых выполняет свою часть задачи и проверяется отдельным критиком.
  • Объяснено, почему обычные агенты часто выдают посредственные результаты из-за необъективной самооценки в одном контекстном окне.
  • Разбор промта на три части: задача, метод сборки с сабагентами и целевая планка для оценки результата.
  • Показано, как Guntlet Loop превосходит базовые методы работы с агентами, обеспечивая многократную проверку и доработку.
  • Приведен пример использования техники на реальной продуктовой задаче — создании помощника для сайта Focus Forge.
  • Обсуждаются технические детали интеграции с API, управление ключами и выбор моделей для работы агентов.
  • Отмечены преимущества и недостатки метода, включая высокую стоимость из-за большого количества запросов и токенов.
  • Дана рекомендация сначала создавать MVP с помощью других техник, а затем улучшать продукт с помощью Guntlet Loop.
  • Видео содержит практическую демонстрацию и советы по применению техники в реальных проектах.

Answers

Questions about this video

Что такое техника Guntlet Loop?

Guntlet Loop — это метод промптинга, при котором флот сабагентов выполняет разные части задачи, а отдельные критики проверяют результаты, обеспечивая высокое качество и многократную доработку.

Почему обычные агенты часто выдают посредственные результаты?

Обычные агенты строят и проверяют результат в одном контекстном окне, что приводит к необъективной самооценке и замыливанию взгляда, из-за чего качество работы снижается.

Как можно применить Guntlet Loop на практике?

Технику можно использовать для автоматизации сложных проектов, например, создания помощника для управления задачами на сайте Focus Forge, разбивая большие задачи на подзадачи и проверяя их отдельными критиками.

Full Transcript — Download SRT & Markdown

00:00
Speaker A
Есть новая техника промтинга, которая сейчас взрывает людям мозг, потому что одним промтом она может собрать полностью рабочие 3D-игры и гиперкастомные миры. И агент сам разгоняет об агентов-строителей, каждому представляет отдельного критика и не останавливается, пока результат не пройдёт жёсткую проверку. Такой подход
00:19
Speaker A
называется Guntlet Loop. И название тут говорящее. Guntlet в переводе — это проходить сквозь строй. Результаты и агента прогоняют через критиков круг за кругом, пока он не выдержит проверку. В этом ролике я покажу, как собрать такой же цикл под свои задачи. Разберём, из
00:34
Speaker A
каких трёх частей состоит данный промт. Разберём, почему обычные агенты халтурят, как работает связка строитель плюс критик, а потом проверим всё на реальной продуктовой задаче. Поехали.
00:45
Speaker A
Эту технику подробно описал и, можно сказать, придумал такой челик под именем Мэт Шумер. И как мы видим, его посты разлетелись на миллионы просмотров. При помощи Guntlet Loop Мэт одним промтом собрал вот такой шутанчик в стиле Call of Duty. Он не использовал
01:02
Speaker A
ни одного внешнего файла, то есть все вот эти текстурки, коробки, звуки выстрелов, в целом звуки в игре, а модельки, всё это было собрано при помощи клод-кода до полноценного Call of Duty. Эта демка, конечно, не дотягивает, и Мэт Шумер сам это признаёт, но тем не
01:17
Speaker A
менее, вдумайтесь только, до чего техника дошла. С одного промта полноценную демку со спецэффектами, с пострелушками. И всё это за один шот.
01:28
Speaker A
Вот такие гоночки в стиле Mario Kart, кстати, тоже собирал. Открытый исходный код и промт выложен на гитхабе, поэтому давайте мы его разберём. Хорошо делать, чтобы на своих проектах подобную технику применить и с одного шота делать красоту. Но сперва давайте разберёмся,
01:45
Speaker A
почему агент так часто выдаёт нам средние результаты. Мы уже не один раз это обсуждали, но, как говорится, повторение — мать учения. Посредственное качество получается, потому что агент и строит, и проверяет свой результат в одном контекстном окне. Он видел каждый свой шаг, он видел свои
02:02
Speaker A
рассуждения, и поэтому он сам себя уже будет убеждать, что это решение правильное и вот надо делать только так и никак иначе. Короче, можно сказать, что взгляд у нейронки замыливается, и она оценивает свою работу необъективно.
02:17
Speaker A
И сейчас мы разберём с вами промт, который решает эту проблему. Вот как раз промт по Call of Duty, и его можно разбить на три части. Первая часть — это задача, что конкретно мы должны сделать и как это должно выглядеть в финале.
02:30
Speaker A
Вторая часть этого промта — метод сборки, то есть как мы будем билдить наш продукт. В данном случае у нас есть главный агент, который раздаёт свои задачки сабагентам, то есть помощникам.
02:41
Speaker A
У каждого такого помощника свой участок задач. И как раз на чём Шумер делает акцент. Он говорит, что нужно дать агенту цель, а не дать план подробной реализации. И третья часть промта — это целевая планка. То есть до какого
02:56
Speaker A
результата мы должны довести нашу задачу, чтобы её можно было полноценно принять. В оригинальном запросе, как мы видим, планка — это конкретный эталон, который мы можем посмотреть и сравнить с ним. Скриншоты какие-то по визуалу, по графике, по геймплею, какие-то,
03:12
Speaker A
возможно, части геймплея. И что у нас в итоге получается? Строит один субагент, а проверяет его другой субагент. Можно сказать, что это критик с чистым контекстом. Он не видел процесс сборки.
03:24
Speaker A
Он не наследует оптимизм предыдущего сабагента, который всё это дело строил. Смотрит только на результат. Каких-то дополнительных плагинов, расширений, скилов устанавливать не нужно. Сабагенты есть и в клод-коде, и в кодексе прямо из коробки. Единственное, что в клод-коде есть отдельная задачка/loops, а в
03:43
Speaker A
кодексе нужно просто текстом писать, что вы хотите. Далее я как раз это покажу, но сперва давайте посмотрим, где эта техника находится среди разных подходов при работе с ИИ. Первый уровень самый базовый. Я думаю, 90% людей, которые работают с ИИ, работают в таком
04:00
Speaker A
сценарии. То есть вы дали задачу агенту, он её выполнил, вы смотрите на результат, оцениваете и даёте обратную связь. Прикольно. И большой контроль над происходящим. Но проблема в том, что количество задач ограничено вашим личным временем и вашей личной внимательностью.
04:18
Speaker A
Как мы знаем, время — самый дорогой ресурс, плюс фокус у нас тоже ограничен. Мы не можем 250 задач одновременно выполнять. Что, кстати, может делать агент, в отличие от человека? Следующий уровень — это у нас обычный цикл. Вы даёте задачку агенту, он её делает,
04:35
Speaker A
отдаёт на проверку критику. Критик с чистым контекстным окном всё это дело проверяет, и если результат критика устраивает, он отдаёт финальный результат вам на проверку. Если результат критика не устраивает, он отдаёт его обратно агенту на доработку.
04:51
Speaker A
И вот так вот циклами мы ходим. Кстати, прошлый ролик у меня был про подборку скилов от МТА Покака. Там один из способов довести задачу до конца устроен по похожему принципу. Код пишется одним агентом, проверяется уже двумя параллельными агентами с чистым
05:07
Speaker A
контекстным окном. Рекомендую посмотреть, подсказочка будет где-то здесь. Для общего развития самое то. И третий уровень работы с агентами — это как раз Guntlet Loop. Вы запускаете флот сабагентов. У каждого свой участок работы и у каждого свой критик. После
05:22
Speaker A
кучи сожжённых токенов и выполненных задач, оценки всего этого дела критиками, финальный результат уже выдаётся вам. Из-за такого большого количества проверок сожжённых токенов обычно и получается хороший результат с одного шота. Если пока всё звучит абстрактно и вы такие: "Блин, Альберт,
05:39
Speaker A
ну покажи практику", не переживайте, практика как раз сейчас будет. Мы применим вот эту технику на обычные продуктовые задачи и посмотрим, что из этого выйдет. А вы пока лайкните этот ролик, подпишитесь и нажмите на колокольчик. Мне будет очень приятно.
05:53
Speaker A
Теперь переносим GL loop из теории в практическую нормальную рабочую задачу. Встречайте мой сайт apps Focus Forge. Я его в своих роликах уже подсвечивал. Это бесплатный помидора таймер, которым вы можете пользоваться. Вот ссылочка. Кто любит работать с промтами, повышать свою
06:10
Speaker A
продуктивность, записывать тут всякие задачки, welcome. Пользуйтесь, пожалуйста. Всё бесплатно, по крайней мере. Пока. Я хочу накидывать сюда дополнительные обвесы, возможно, для платных подписчиков какой-нибудь и помощник. И я хочу, чтобы этот и помощник делал две вещи. Первое, например, вы пишите какую-то большую
06:28
Speaker A
задачу по типу: "Хочу выпустить ролик про Guntlet Loop." И помощник должен разбить эту масштабную задачку на задач поменьше, раздробить всё: например, поиск референсов, поиск исходных материалов, генерация сценария, потом генерация обложек, съёмка, подготовка к съёмке, описание ролика на Ютубе. Ну и
06:50
Speaker A
вот это вот всё. Вы подтверждаете эти задачки, они появляются у вас вот тут в списке помидора таймера. И вторая штука, которую я хочу добавить, — это чтобы и помощник оценивал результаты вашей сессии. То есть в конце дня он смотрел,
07:03
Speaker A
какие задачи вы выполнили, какие задачи вы не выполнили, и писал свои рекомендации, возможно, выставлял приоритеты по вашим задачам на следующий день. Короче, ваш типа персональный ассистент. И как раз вот этого и помощника мы будем с вами собирать через
07:19
Speaker A
Guntlet Loop. Интерфейс, локальный безопасный слой для API, промты для моделей и проверку, что всё работает.
07:25
Speaker A
Для пользователя это всего лишь и помощник по подписке, ключи, выбор модели, системный промт — это уже на моей стороне. Мне нужен доступ к различным моделям, контроль расходов и понятный кабинет, где все процессы можно обследить. Для этих задач я возьму и
07:41
Speaker A
роутер от Selectel. Я уже создал аккаунт, запилил тестовый проект, и давайте создадим и роутер. Нажимаю создать. Мне выдаётся единый API-ключ, и через него я могу работать с кучей моделей. Как мы видим, тут все возможные модельки имеются. Их 363 штуки. И они,
07:57
Speaker A
естественно, постоянно пополняются. В панели я могу выбрать модель, с которой мне предстоит работать, ограничить бюджет по каким-то лимитам для моего API-ключа, создать несколько ключей под различные задачи. Один ключ под Focus Forge, другой.
08:14
Speaker A
нам нужно сделать инфраструктуру внутри Focus Forge, чтобы тут был какой-то и помощник, которому мы отдаём запрос. Он этот запрос отправляет по опишке вот сюда, в наш Select, например, чтобы запрос шёл только через модельку Квен.
08:28
Speaker A
Запросы и ответы здесь проходят транзитом, не логируются и не используются для обучения модели. Для задач внутри Focus Forge. Ну, чтобы была какая-то конфиденциальность. Мне это подходит. Если хотите собрать нечто подобное в своём сервисе, то ссылочка на eу от Selecttel будет в описании.
08:45
Speaker A
Регистрируйтесь и запускайте популярные модельки из одного окна с оплатой в рублях. Так, ну, ключ я уже выпустил.
08:51
Speaker A
Давайте открывать проект и давать агенту задачки. Задача нашего цикла в данном случае добавить и помощника. В интерфейсе нужна отдельная панель с двумя действиями: разбить большую задачу на подзадачки и подвести итоги сзади.
09:05
Speaker A
После выполнения задачи агент ещё должен всё проверить, что сайт работает, что всё открывается, что ничего мы там не поломали и что всё у нас чётенько. Я запускаю цикл пронтом из трёх частей.
09:15
Speaker A
Если что, вот он. Можете поставить на паузу и почитать более подробно, что там написано. Но если вкратце первая часть - это задача, что мы трогаем и что мы не трогаем. Вторая часть - это метод выполнения. То есть то, что мы работаем
09:27
Speaker A
с субагентами, субагентом прикрепляем критиков с чистым контекстом, которые нас проверяют. И третья планка - чек-лист, который пока мы не выполним.
09:36
Speaker A
Цикл, ну, не должен заканчиваться. И это постоянная проверка, об которую будет спотыкаться наш агент. Выполнен весь чек-лист. Всё, о'кей. Тогда мы отдаём задачу в продакшн. Ну что ж, я запускаю своего боевого товарища кодекс и посмотрим, что у нас получится.
09:54
Speaker A
Агент проработал какое-то количество времени. Тут у меня, конечно, возникли, как всегда, с ключами вопросики, потому что GPT достаточно щепетилиен. по теме безопасности и не разрешает вставлять ключи прямо в чатик. Ну и пришлось немножко попотеть. Но основную работу агент делал на протяжении часа
10:13
Speaker A
практически гонял там всё перегонял. Как мы видим, запускались билдеры, также запускались критики параллельно. Вот всё это работало с субагентами. Security у нас прошлось тут Security Builder, Security Critic и потом UI Critic. Всё это проверялось. Финальный результат у нас получился. Давайте его посмотрим,
10:34
Speaker A
выполнилась ли задача. А, как вы видите, появился новый интерфейс. Да, и помощник. Бетаверсия помогает задачами и итогами дня. Давайте я нажму на итоги дня, разобрать день. Что он напишет? Он анализирует мои итоги дня, какие задачи у меня были, какие задачи сделаны, и
10:52
Speaker A
отправляет этот запрос, ну, через прокси, получается, в Select. Я сейчас работаю через Gini Flash, чтобы быстро вам всё показать. Можно потом модельку выбрать по поумнее, какой-нибудь клод, но это дорого. Ну, короче, он пишет: "Типa челик, что ты нам тут пустые итоги
11:09
Speaker A
дня скармливаешь? На завтра запланируете хотя бы одну небольшую задачу, чтобы начать движение и не терять продуктивность". Ну отлично, спасибо. И давайте с вами большие задачи разбивать на шаги. Допустим, я хочу подтягиваться, и я хочу достичь двадцати подтягиваний.
11:27
Speaker A
И давайте разобьём на шаги. Он нам предлагает шесть шагов быстро. Google Дмини, конечно, отвечает. Начать делать подтягивание, увеличить количество повторений, тренироваться регулярно, совершенствовать технику, улучшить силу хватать силовые тренировки. Ну, в целом задачи понятные, мы можем их выбрать, добавить. Они у нас тут появились. Итак,
11:45
Speaker A
давайте ещё какую-нибудь задачу придумаем. Минифлш, конечно, нам такую базу базовую даёт. Давайте пост про безопасность при работе с и вот так вот. И разбиваем на шаги. Посмотрим, что он нам предложит. Базовые дефолтные задачки.
12:01
Speaker A
Он, конечно, слишком подробно дробит нашу задачу, но это всё системным пронтом уже делает. Наш функционал работает. Вот я выбираю вот эти задачи, добавляю выбранное. Всё, они добавились в мой Focus Forge. И теперь я с ними могу работать. И давайте переходить к
12:18
Speaker A
завершающей части ролика. Всё круто, классно, молодёжно всё получилось достаточно качественно. Но есть несколько нюансов, которые нужно обсудить. Первое, подобные циклы достаточно дорогие, потому что у нас несколько сабагентов сразу работают, потом ещё и проверки идут, и вот эти вот
12:35
Speaker A
сами петли тоже много времени и токенов потребляют. Поэтому есть важное правило. Если вы уже видите, что результат достаточно рабочий, циклы продолжают крутиться, вы имеете право их остановить, чтобы не растягивать разработку и не увеличивать бюджет на токены. И ещё один нюанс: циклы подобные
12:55
Speaker A
не стоит запускать прямо с нуля. Если проекты ещё не существуют и агент начнёт делать его с нуля, то он может пойти не в ту сторону и начать полировать как раз не те вещи, которые нужны. В идеале использовать подобные циклы уже на
13:09
Speaker A
какую-топишку. То есть у вас есть сайт и вы хотите докрутить какую-то большую фичу, и вы для этого запускаете loop, как было и в моём случае. Потому что если с нуля вы что-то начнёте делать, то тут могут возникнуть вопросики, агент
13:23
Speaker A
вообще уйдёт не в ту сторону, потому что вы ему предоставили большое поле для действа и выбора. Вначале мы делаем сами какой-то MVP при помощи других техник, да, какой-то минимальный продукт, а уже дополнительные штуки накидываем при помощи подобного Gedop. Напишите в
13:41
Speaker A
комментариях, пробовали ли вы подобные циклы, либо сейчас попробуете. Обязательно делитесь результатом, что у вас там получится. Ну и не забывайте жмякнуть подписку, оформить лайк и колокольчик. А на этом будем прощаться.
13:53
Speaker A
Увидимся совсем скоро. Будьте классными. Пока-пока.
Topics:промптингGuntlet LoopClaude CodeCodexагенты ИИсабагентыкритики3D-игрыавтоматизация задачFocus Forge

Get More with the SozAI App

Transcribe recordings, audio files, and YouTube videos — with AI summaries, speaker detection, and unlimited transcriptions.

Or transcribe another YouTube video here →