Skip to content

Latest commit

 

History

2 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Gauntlet Loop — Montador de Prompt

English version of this README →

Uma página só, sem dependências, sem build. Você preenche o objetivo e o bar; ela monta o prompt e confere as regras que a técnica trata como fatais.

▶ Abrir a ferramenta · English interface


O que é o Gauntlet Loop

Um padrão de prompt em que o agente quebra o objetivo em peças, e para cada peça roda um builder e um crítico separado, com contexto novo. O crítico põe o resultado lado a lado com uma referência real, com os rótulos removidos, e diz qual é melhor. Se o nosso não vencer, volta para o builder. O loop só termina quando vencer a comparação cega — nunca por contagem de rodadas.

A técnica é do Matt Shumer, que escreveu o prompt original construindo o Claude of Duty.

Por que uma ferramenta

Cinco blocos do prompt são texto canônico e nunca mudam. Só dois campos são seus: o objetivo e o bar. Montar isso à mão toda vez convida a erro — e os erros dessa técnica são específicos e repetitivos.

Então a página faz duas coisas:

Monta. Concatenação pura, sem modelo no meio. Mesma entrada, mesma saída, byte a byte.

Confere. Um linter roda a cada tecla contra as falhas que a documentação lista como fatais:

Checagem Por quê
Bar nomeado, não categoria Bar vago é a falha mais comum. O crítico inventa a comparação e aprova tudo.
Bar alcançável Se o agente não consegue abrir a referência, ele alucina o lado B.
Sem contagem de rodadas A saída é vencer a comparação. "Pare em 3 rodadas" entrega trabalho pela metade.
Extensão em torno de 120–180 palavras Instrução demais é decisão a menos tomada pelo agente.
Sem listas com marcadores O prompt é frase corrida.
Sem stack imposta Arquitetura é decisão do agente, salvo requisito real.

A lista de termos vagos é bilíngue: pega award-winning e premiado, best-in-class e líder de mercado.

Idioma

A interface existe em português e inglês. Ela escolhe pelo idioma do navegador, e o link no topo alterna. Para forçar, use ?lang=pt ou ?lang=en — dá para compartilhar o link já no idioma certo.

O prompt gerado sai sempre em inglês, nos dois casos. Não é descuido: são as frases exatas de que a técnica depende, e traduzi-las é sair do texto canônico. O que muda é só a interface ao redor.

Os seus campos, esses podem ser em qualquer idioma. A única situação em que isso importa é quando a entrega é texto — aí diga explicitamente em que idioma ela deve sair, senão o agente segue o inglês do próprio prompt.

Como usar

Abra o index.html. Não tem instalação, servidor, nem build.

  1. Escolha o tipo de entrega — isso ajusta como o crítico inspeciona (abrir no navegador, rodar o benchmark, ler ponta a ponta).
  2. Escreva o objetivo.
  3. Defina o bar. Precisa ser nomeado, alcançável e comparável. Há sugestões clicáveis por tipo de entrega.
  4. Copie e cole numa sessão nova do agente.

Campos opcionais (peças, metade mensurável, ferramentas, teto de custo) ficam fora do prompt quando em branco — de propósito.

O botão Copiar trava enquanto houver bloqueio.

Sobre a faixa de 120–180 palavras

A documentação diz "em torno de 120 a 180 palavras", e o exemplo dela mesma tem 183. Por isso o linter trata a faixa como alvo, não como corte: dentro passa, 100–200 é aviso leve, fora disso é aviso forte. Nunca bloqueio.

Sobre a checagem "bar alcançável"

É heurística. A página procura URL ou nome próprio; ela não abre a referência para confirmar que existe. Um bar com nome próprio mas sem link gera aviso, não aprovação. Trate como lembrete.

Créditos e licença

A técnica do Gauntlet Loop é de Matt Shumer.

O texto do template de prompt embutido nesta página deriva do SKILL.md de robonuggets/gauntlet-loop, de Jay E (RoboNuggets), licenciado sob CC BY 4.0. Alterações feitas: as frases do crítico foram encurtadas e variantes por tipo de entrega foram acrescentadas; o restante do texto canônico está preservado.

O código desta página (HTML, CSS e JavaScript) é original e está sob MIT.

Leitura relacionada: Anthropic — Building Effective Agents, que descreve o padrão avaliador-otimizador em que o loop se apoia.

About

Deterministic single-file builder for Gauntlet Loop prompts, with a linter for the technique's documented failure modes. Bilingual UI (EN/PT-BR).

Topics

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages