Todo agente de IA tem o mesmo vício: explica antes de responder, pede desculpa antes de corrigir, enche a frase com gentileza que ninguém pediu. "Claro, ficaria feliz em ajudar com isso" não é resposta, é enrolação cobrada por token.
O problema não é estético. É financeiro e operacional. Cada palavra de enchimento que o modelo gera vira output token, e output token é o mais caro da conta. Multiplica isso por centenas de interações por dia, num time inteiro usando Claude Code ou Codex, e a fatura de API cresce sem que a qualidade do trabalho tenha melhorado nada.
Por que ninguém resolvia isso com "seja mais direto"?
Pedir pra IA "responder de forma mais concisa" no prompt funciona por uma mensagem, duas no máximo. Depois o modelo volta ao padrão, porque o pedido de brevidade não vira regra persistente, vira sugestão que se dissolve na conversa.
O caveman, skill open source criada por Julius Brussee, resolve isso tratando concisão como camada de comportamento instalável, não como pedido repetido a cada sessão. Uma vez ativa, ela reescreve como o agente fala, sem tocar em como ele pensa.
O mecanismo por trás do corte
A skill ataca quatro categorias específicas de excesso: artigo (a, o, um), enchimento (só, realmente, basicamente), gentileza performática (com certeza, ficaria feliz em ajudar) e o hedge, aquele rodeio que a IA usa antes de chegar no ponto.
O resultado testado com dados reais da API Claude, em dez prompts técnicos, foi de 65% de redução média nos tokens de output, variando de 22% a 87% dependendo da tarefa. Explicar um bug de re-render em React, por exemplo, caiu de 1180 para 159 tokens sem perder a causa nem a correção.

O ponto que separa isso de só "cortar palavra por cortar" é onde a skill não mexe. Ela protege elementos específicos como bloco de código, URL, cabeçalho e caminho de arquivo, que atravessam a reescrita intactos. E o raciocínio interno do modelo, aquilo que ele processa antes de responder, continua no tamanho normal. Só a fala final encolhe.
Como instalar e ativar
A instalação é uma linha de comando, funciona em Claude Code, Codex, Gemini CLI, Cursor, Windsurf, Copilot e mais de trinta outros agentes:
irm https://raw.githubusercontent.com/JuliusBrussee/caveman/main/install.ps1 | iexcurl -fsSL https://raw.githubusercontent.com/JuliusBrussee/caveman/main/install.sh | bashDepois de instalado, ativa digitando /caveman ou pedindo pro agente "falar como caveman" no próprio chat. Existem vários níveis de intensidade, do mais leve (só corta enchimento) até o mais radical (frases telegráficas). Pra desativar, basta pedir "modo normal".
- /caveman - Ativa o modo padrão (full).
- /caveman lite - Pouca compressão. Remove enrolação, mantém frases normais.
- /caveman full - Modo padrão. Remove artigos, usa frases curtas.
- /caveman ultra - Máxima compressão. Muitas abreviações e estilo telegráfico.
- /caveman wenyan - Versão experimental inspirada no chinês clássico.
- /caveman wenyan-lite - Wenyan mais legível.
- /caveman wenyan-ultra - Wenyan extremamente comprimido.
Além do modo de conversa, existem algumas "sub-skills":
- /caveman-review - Faz code review extremamente resumido, normalmente em uma linha por problema.
Exemplo:
L52 🔴 null dereference. Add guard.
L81 🟡 rename var. Improve clarity.
- /caveman-commit - Cria mensagens de commit seguindo Conventional Commits.
Exemplo:
feat(auth): add OAuth refresh flow
- /caveman-stats - Mostra quanto de tokens economizou usando a skill.
- /caveman-stats --share - Gera um resumo para compartilhar.
- /caveman-compress CLAUDE.md ou /caveman-compress AGENTS.md - Ele reescreve o arquivo em linguagem "caveman" para economizar tokens em todas as sessões futuras, criando um backup <arquivo>.original.md.
- normal mode ou normal mode - A skill é desligada até você ativá-la novamente.
O detalhe que evita o tiro no pé
A dúvida óbvia é se cortar palavra também corta precisão. A skill trata isso como regra explícita: em situação de risco técnico, segurança ou decisão irreversível, a resposta volta a ficar completa. Brevidade é o padrão, não a prioridade acima de tudo.
Existe até validação automática rodando por trás: a skill reescreve o texto, mas passa o resultado por um verificador que garante que código, erro e termo técnico saem exatos, palavra por palavra, do outro lado.
A próxima vez que você ver seu agente de IA gastando três frases pra dizer o que cabia numa, a pergunta não é se ele está sendo educado. É quanto essa educação está custando, em tempo de leitura e em token, multiplicado por todo mundo do seu time que também não percebeu.





Comentários (0)
Os comentários são moderados e caso viole nossos Termos e Condições de uso, o comentário será excluído. A persistência na violação acarretará em um banimento da sua conta.