Resumo
O Caveman (JuliusBrussee/caveman, Apache-2.0, 109.342 estrelas em 03/10/2026) tem duas peças:
- a skill (a "pedra pequena"): um arquivo de regras que faz o agente responder curto. Código, comandos, caminhos e mensagens de erro ficam intactos; só some o "enchimento" da resposta.
- o proxy (a "pedra grande"): um CLI que roda na sua máquina, entre o agente e o provedor, e encolhe o que o agente lê (logs, saída de teste, JSON, diffs). O original fica guardado e o agente pode pedir de volta.
A descrição do repo promete "65% menos tokens". Quem mediu de fora achou outra coisa: a JetBrains testou só a skill em 86 tarefas reais no Claude Code e mediu 8,5% menos tokens de saída, sem mudança de qualidade detectável (p = 0,82). O próprio README admite que esse número foi o motivo para criar o proxy, porque a maior parte da conta de um agente é leitura, não escrita.
No benchmark do próprio repo, o proxy levou 54 execuções no Claude Code de 885.793 para 591.673 tokens de entrada (-33,2%), com 18 de 18 respostas certas (intervalo de 95%: 14,6% a 48,5%; um caso, HTML, piorou 9,9%). O README avisa que os dados brutos ainda não estão publicados: é um relatório fixado, não uma reprodução pública.
| peça | o que encolhe | número (fonte: README, 03/10/2026) |
|---|---|---|
| skill | o que o agente fala | JetBrains: -8,5% de saída, qualidade igual · eval do repo: padrão -3% (ruído), ultracave -35% |
| proxy | o que o agente lê | benchmark do repo: -33,2% de entrada, 18/18 certas |
| /caveman-compress | arquivos de memória (CLAUDE.md) | 46% menores em média (5 exemplos do repo) |
Pré-requisitos
- Node.js instalado (
node -v). O instalador completo pede Node 22.13+; testei com Node 24 no Windows. - Um agente: Claude Code, Codex ou Cursor (o README lista 30+ agentes).
- Para o proxy: permissão para instalar um pacote npm global e baixar os binários do
caveman setup.
Instalação
Claude Code
Skill (1 comando, sem conta, sem API key):
npx skills add JuliusBrussee/caveman -g
Ou como plugin:
claude plugin marketplace add JuliusBrussee/caveman && claude plugin install caveman@caveman
No meu teste (03/10/2026, num projeto vazio), o instalador copiou 22 skills (caveman, ultracave, megacave, caveman-commit, caveman-review, caveman-compress, caveman-stats e outras) e avisou: "Review skills before use; they run with full agent permissions."
Codex
npx skills add JuliusBrussee/caveman -a codex -g
Depois, dentro da sessão:
/caveman
Atenção: no Codex o hook de shrink do proxy fica desligado, porque o runtime do Codex recusa a reescrita (openai/codex#18491). A skill funciona normalmente.
Cursor
Por sessão:
npx skills add JuliusBrussee/caveman -a cursor -g
Sempre ligado (grava .cursor/rules/caveman.mdc no seu repositório):
npx skills add JuliusBrussee/caveman -a cursor -g --with-init
O proxy (onde está a economia de leitura)
npm install -g @caveman-ai/cli && caveman setup --install
caveman claude # ou: caveman codex · caveman gemini · ...
Importante: sem o caveman setup --install, o proxy só repassa o texto. No meu teste, caveman shrink -- git log sem setup respondeu "engine unavailable; passthrough — run caveman setup" e não encolheu nada.
Como usar
/cavemanliga a voz curta;stop caveman(ounormal mode) desliga./ultracavecorta mais (é a versão que mediu -35% no eval do repo)./caveman-commitescreve o commit em uma linha;/caveman-reviewdá um achado por linha./caveman-compress CLAUDE.mdencolhe o arquivo de memória e guarda o original.- Com o proxy:
caveman learnlê o histórico do seu agente localmente e mostra para onde seus tokens vão, do maior para o menor.
Verificar (meça na sua sessão)
O próprio README diz que o teste na sua máquina vale mais que qualquer número da página:
caveman trial -- claude
caveman trial report
Isso roda uma sessão real com e sem caveman e mostra a diferença. Se você já ligou o caveman claude, desligue antes com caveman disable claude (e religue depois com caveman enable claude). Para o histórico: caveman stats; dentro do Claude Code: /caveman-stats.
Problemas comuns
- "O agente não ficou curto": digite
/caveman(em alguns agentes a skill é por sessão). No Cursor, use--with-initpara ficar sempre ligado. - "O proxy não economizou nada": rode
caveman setup --install; sem ele, é passthrough. - Windows: o
caveman shrinkrecusou onpm.cmd("cannot safely launch non-Node Windows command shim"); com executáveis nativos (git) funcionou. - Instalação quebrou: o README sugere abrir o agente dentro do repo do caveman e pedir: "Read CLAUDE.md and INSTALL.md, install caveman for me."
- Desinstalar:
npx -y github:JuliusBrussee/caveman -- --uninstall.
Limites (leia antes de instalar)
- Pule se você paga por requisição, não por token (ex.: requisições premium do Copilot): resposta curta é a mesma requisição.
- As regras da skill entram como ~1.000 tokens de entrada em toda chamada; em perguntas curtas, pode custar mais do que economiza.
- Telemetria do CLI vem ligada por padrão (ID aleatório, IP, contagem de tokens; nunca prompts, código ou caminhos). Para desligar:
caveman telemetry off
(ou DO_NOT_TRACK=1). A skill sozinha nunca envia nada.
- O benchmark do proxy é do próprio repo e ainda sem reprodução pública.
- O instalador traz 22 skills com permissão total do agente: revise antes.
Fontes
- README, INSTALL.md e API do GitHub de JuliusBrussee/caveman, lidos em 03/10/2026.
- Teste da JetBrains citado no README: Speaking to AI Agents like Cavemen….
- Meu teste: Windows, Node 24, 03/10/2026 (instalação da skill num projeto vazio e
caveman shrinksem setup).
Quer testar o Caveman com critério?
Salve o passo a passo, revise as permissões e rode o A/B antes de decidir. O ganho que importa é o que aparece nas suas próprias sessões.
Veja também
Todos os artigos →DeepSeek Harness: o que é, como usar e os riscos que você precisa conhecer
O DeepSeek Harness é um agente open source em que tudo funciona como plugin e agora tem aplicativo para Windows e macOS. Veja como testar pelo navegador, onde ele roda e por que a segurança precisa vir antes da primeira execução.
Pi 1.0: como instalar e rodar o agente com mais segurança
O Pi 1.0 é um harness de agente minimalista, extensível e open source, mas não tem sistema próprio de permissões. Veja o que mudou, como instalar e por que o isolamento precisa entrar no seu primeiro teste.
YouTube Automation Agent: o agente open source que opera um canal de ponta a ponta
O youtube-automation-agent automatiza o fluxo inteiro de um canal: do tema ao vídeo publicado, passando por roteiro, narração, SEO e analytics. Veja como funciona, o que exige revisão humana e como avaliar o projeto antes de ligar o modo autônomo.