Resumo
O ponytail (DietrichGebert/ponytail) é uma skill/plugin que faz o agente de código seguir uma "escada" antes de escrever qualquer coisa:
- Isso precisa existir?
- Já existe no código?
- A stdlib resolve?
- Um recurso nativo da plataforma resolve?
- Uma dependência já instalada resolve?
- Cabe em uma linha?
- Só então: o mínimo que funciona.
O lema é "preguiçoso, não negligente": ele nunca corta validação em fronteira de confiança, tratamento de erro que evita perda de dados, segurança nem acessibilidade.
Exemplo do README: você pede um date picker. Sem a skill, o agente instala flatpickr, escreve um wrapper e CSS. Com a skill, ele escreve <input type="date">.
- 149.785 estrelas (≈149,8k), licença MIT, criado em 12/06/2026, último release v4.10.0 em 14/09/2026.
- #1 no GitHub Trending em 01/10/2026 (+1.179 estrelas no dia).
- Funciona em ~20 agentes; o README lista Claude Code, Codex, Cursor, Copilot CLI, Gemini, OpenCode, entre outros.
Fonte: README do repo e API do GitHub, consultados em 01/10/2026.
Pré-requisitos
nodeno PATH: os hooks de ativação automática rodam com Node.- Pelo menos um destes instalados: Claude Code, Codex ou Cursor.
- Para o Cursor: git, para clonar o repo.
Instalação
Claude Code
São dois prompts separados. Mande o primeiro, espere terminar, e só então mande o segundo:
/plugin marketplace add DietrichGebert/ponytail
/plugin install ponytail@ponytail
Codex
codex plugin marketplace add DietrichGebert/ponytail
codex plugin add ponytail@ponytail
Depois:
- Abra
/hooksdentro do Codex. - Revise e confie nos 2 hooks do ponytail.
- Inicie uma thread nova.
Cursor
git clone https://github.com/DietrichGebert/ponytail
node ponytail/scripts/cursor-hooks.js install
O script acrescenta 2 hooks em ~/.cursor/hooks.json. Para gravar só no projeto atual (em .cursor/hooks.json), use --project:
node ponytail/scripts/cursor-hooks.js install --project
Depois, abra um chat novo.
Alternativa só com regra: copie o arquivo .cursor/rules/ponytail.mdc do repo para o .cursor/rules/ do seu projeto. Escolha um caminho só (veja "Problemas comuns").
Como usar
O ponytail fica ativo em toda sessão, no nível padrão full. Não precisa chamar nada.
| Comando | O que faz |
|---|---|
/ponytail lite\|full\|ultra\|off |
Troca o nível (ou desliga) |
/ponytail-review |
Revisa o diff atual e devolve uma lista do que deletar |
/ponytail-audit |
Faz o mesmo no repo inteiro |
/ponytail-debt |
Junta os atalhos marcados com comentário ponytail: |
/ponytail-gain |
Mostra o placar do benchmark |
/ponytail-help |
Ajuda |
Diferenças por ferramenta:
- Codex: os comandos são skills, então use
@ponytail-review,@ponytail-auditetc. - Cursor com hooks: só dá para trocar o nível, digitando
/ponytail ultracomo mensagem comum. - Nível padrão fixo: defina a variável de ambiente
PONYTAIL_DEFAULT_MODE(por exemplo,lite). - Subagentes recebem as regras no Claude Code e no Codex; no Cursor, não.
Verificar se está ativo
- Ao abrir uma sessão, a mensagem de startup mostra o modo do ponytail.
- Digite
/ponytailsem argumento: ele informa o nível atual. - Rode
/ponytail-gainpara ver o placar do benchmark. - Teste rápido: peça "adiciona um seletor de data no formulário" e veja se a resposta usa
<input type="date">em vez de instalar uma biblioteca.
Os números
Benchmark do próprio autor: sessões reais do Claude Code editando o repo fastapi/full-stack-fastapi-template, 12 tickets de feature, n=4, modelo Haiku 4.5, comparado com o mesmo agente sem a skill.
| Métrica | Resultado com ponytail |
|---|---|
| Linhas de código (média) | −54% |
| Date picker | 404 → 23 linhas (−94%) |
| Color picker | 287 → 23 linhas |
| Backend CRUD | ~0% |
| Tokens | −22% |
| Custo | −20% |
| Tempo | −27% |
| Segurança (testes adversariais) | 100% (20/20) |
Detalhes que importam:
- Um prompt simples do tipo "YAGNI + one-liner" caiu para 95% em segurança; o ponytail manteve 20/20.
- Em tarefas que já são mínimas, quase nada muda (queries de busca: 44 → 44 linhas).
- Numa tarefa "cirúrgica" de segurança: tokens −18%, custo −7%.
Fonte: benchmarks/results/2026-06-18-agentic.md, lido em 01/10/2026.
Problemas comuns
- Ativação automática não acontece (nvm, Nix etc.): se o
nodenão está no PATH que o agente enxerga, as skills funcionam quando chamadas, mas a ativação automática fica muda. Garanta onodeno PATH global. - Claude Code não instalou: os dois comandos precisam ir em dois prompts separados. Colar os dois juntos não funciona.
- Codex não aplica as regras: você precisa abrir
/hooks, confiar nos 2 hooks e iniciar uma thread nova. - Cursor, regra vs. hooks: a regra
.mdce os hooks são alternativas. Com a regra no workspace, os hooks não injetam nada. - Cursor, subagentes e nuvem: subagentes rodam sem as regras, e agentes na nuvem nunca disparam o
sessionStart. - Desinstalar: rode
node scripts/uninstall.jsantes do comando de remoção. Depois: - Claude Code:
/plugin remove ponytail - Codex:
codex plugin remove ponytail - Cursor:
node scripts/cursor-hooks.js uninstall
Limites
- Benchmark do próprio autor, só com Haiku 4.5 e n=4. Meça no seu projeto.
- O README admite que, em modelo de raciocínio terso (GPT-5.5), o custo pode subir.
- O ganho depende de haver excesso a cortar. Em código que já é enxuto (CRUD, queries), a diferença é perto de zero.
- Ponto de credibilidade: o primeiro benchmark (80–94%) foi corrigido pelo próprio autor depois de crítica pública (issue #126).
Fontes
- Repositório e README: https://github.com/DietrichGebert/ponytail (lido em 01/10/2026)
- Benchmark: https://github.com/DietrichGebert/ponytail/blob/main/benchmarks/results/2026-06-18-agentic.md (lido em 01/10/2026)
- Issue #126: https://github.com/DietrichGebert/ponytail/issues/126
- Estrelas, licença e datas: API do GitHub, 01/10/2026
Quer testar o Ponytail no seu agente?
Acesse o repositório, leia o README e use a escada de decisão antes de pedir a próxima implementação ao Claude Code, Codex ou Cursor.
Veja também
Todos os artigos →YouTube Automation Agent: o agente open source que opera um canal de ponta a ponta
O youtube-automation-agent automatiza o fluxo inteiro de um canal: do tema ao vídeo publicado, passando por roteiro, narração, SEO e analytics. Veja como funciona, o que exige revisão humana e como avaliar o projeto antes de ligar o modo autônomo.

/brag: transforme seu projeto em vídeo de lançamento com um comando
A skill que lê o código do seu projeto, escreve o roteiro e entrega um MP4 de 15 a 25 segundos com música e texto para postar. Como instalar, usar, personalizar, a diferença entre /brag e /brag-slim, o que ela faz com seus arquivos e onde ela não serve.
Jarvis com Claude Code: guia completo de instalação e MCP
Transforme o Claude Code em um assistente de voz no navegador, no estilo Jarvis. Neste guia, você encontra a instalação, a configuração do microfone, o funcionamento com MCP e os limites de segurança do projeto.