
Caveman
Julius Brussee · Programação
Caveman é uma habilidade gratuita para Claude Code e um proxy local que encolhe o que um agente de programação escreve e lê, então ele queima menos tokens e custa menos para rodar. A habilidade força respostas comprimidas no estilo caverna que mantêm cada fato técnico. O proxy é um agente de compressão de tokens para a outra direção. Ele encolhe os registros, os diffs e a saída de testes pelos quais o agente passa. Funciona com mais de 30 agentes, não precisa de conta e começa com um único comando.

Sobre Caveman
O que é o Caveman
Caveman é um economizador de tokens de código aberto para agentes de programação com IA. Ele ataca a conta por dois lados. A habilidade muda como um agente fala e troca preâmbulos longos por prosa de caverna concisa. O proxy muda o que um agente lê. Ele aperta a saída de ferramentas, os registros, o JSON e os diffs antes que cheguem ao seu provedor.
A proposta é simples. Código, comandos, caminhos de arquivo e mensagens de erro nunca são comprimidos. Só a prosa ao redor deles. Assim você obtém o mesmo diagnóstico e a mesma correção, sem os rodeios. Avisos de segurança e confirmações continuam voltando em frases completas.
O principal limite é o alcance. Caveman economiza mais quando um agente escreve muita prosa ou lê registros enormes. Onde ele fica devendo? Se você paga por requisição em vez de por token, ou seu trabalho é quase pura geração de código, a economia encolhe. O texto extra de regras pode até custar um pouco. O mantenedor diz isso abertamente e aponta para uma página que lista onde ele perde.
Como começar
- Instale a habilidade com um único comando, sem conta nem chave de API:
npx skills add JuliusBrussee/caveman -g. - Pergunte qualquer dúvida de programação ao seu agente. As respostas normais agora voltam curtas, e você pode ajustar a intensidade com
/caveman liteou/caveman ultra. - Para o lado da leitura, instale a CLI com
npm install -g @caveman-ai/clie depois rodecaveman learnpara ver para onde seus tokens realmente vão. - Envolva seu agente com
caveman claude(oucodex,gemini,aidere outros) para que a saída de ferramentas seja comprimida antes que o provedor a veja. - Rode
caveman trial -- claudepara comparar A/B uma sessão real e depois confiracaveman trial reportpara ver se ele economizou algo.
Informações do produto
Uma visão rápida dos preços, das plataformas compatíveis e do desempenho de Caveman.
Ideal para
Os usuários, tarefas e cenários em que esta ferramenta se encaixa melhor.
Usuários
- Desenvolvedores que pagam por token
- Usuários de agentes em sessões longas
- Equipes que constroem sobre Claude Code ou Codex
Tarefas
- Dúvidas cotidianas de programação
- Enxugar arquivos de memória
- Comprimir saída barulhenta de comandos
Cenários
- Depurar uma suíte de testes que falha
- Auditar para onde vão os tokens
- Revisar um pull request
Principais recursos
Modos de resposta do Caveman
A habilidade define o quão comprimido seu agente fala. Consulte níveis desde o /caveman lite para um tom enxuto mas educado até o /caveman ultra para quase grunhidos, com um modo wenyan para chinês clássico se você quiser. Código, comandos e mensagens de erro ficam intactos em todos os níveis. Diga stop caveman e a prosa normal volta.
Proxy local para ler menos
O proxy fica entre seu agente e seu provedor na sua própria máquina. Ele detecta cada tipo de carga, seja JSON, registro, código, diff ou página web. Depois manda a carga para um compressor que mantém aquilo de que as respostas dependem. Cada byte comprimido ganha um backup em SQLite local, então o agente pode puxar o original de volta com um identificador de recuperação.
Compressão reversível
Nada aqui tem perda de um jeito que você não possa desfazer. Os originais de tudo que o proxy aperta ficam no disco, e o agente pode pedir a versão completa de volta por meio de uma ferramenta de recuperação sempre que a cópia comprimida não bastar para responder à pergunta. O comando /caveman-compress também faz backup do seu arquivo de memória antes de reescrevê-lo.
Descoberta de consumos de tokens
Rodar caveman learn lê seu histórico de agente existente de forma local e somente leitura, e depois classifica seus consumos de tokens do pior para o melhor com uma correção de uma linha atrás de cada um. Um comando seguinte entrega essas correções ao Claude Code ou ao Codex um diff por vez e reverte qualquer mudança que não baixe os tokens por turno.
Amplo suporte a agentes
O Caveman funciona em mais de 30 agentes. Tem perfis de envoltura nativos para dez deles, incluindo Claude Code, OpenAI Codex CLI, Gemini CLI, Aider e OpenClaw. Envolver nunca edita seus arquivos de configuração. Você pode desfazer com um único comando.
Middleware para seu próprio app
Se você está construindo um agente em vez de rodar um, um envoltório de middleware em TypeScript ou Python comprime resultados grandes de ferramentas antes que o modelo os veja. Adaptadores nativos cobrem frameworks como o Vercel AI SDK, LangChain, OpenAI e Anthropic. Seu histórico de conversa mantém cada byte original.
Economia de tokens no Claude Code que você pode medir
O Caveman publica seus próprios resultados de referência e também linka as verificações de terceiros. A JetBrains testou a habilidade sozinha em 86 tarefas reais de programação e achou 8,5% menos tokens de saída sem mudança de qualidade detectável. Um artigo da Adobe Research mediu que o estilo corta o custo entre 1,4 e 2,4 vezes. É o tipo de prova que você pode pesar antes de instalar.
Prós e contras
Prós
- Habilidade gratuita, sem conta, sem chave de API e com licença MIT nas superfícies de adoção.
- Corta tanto o que um agente escreve quanto o que ele lê, cobrindo os dois maiores ralos de tokens.
- A compressão permanece reversível, então o agente sempre pode recuperar os bytes originais.
- Funciona em mais de 30 agentes de programação e se encaixa no seu próprio app por meio de um pequeno envoltório de middleware.
- Publica seus números e as verificações de terceiros, incluindo os casos em que perde.
Contras
- O arquivo de regras viaja como tokens de entrada em cada chamada, então uma pergunta e resposta de uma linha e enxuta pode custar mais do que economiza e você pode acabar pior do que antes.
- Economiza pouco se você paga por requisição em vez de por token, porque uma resposta mais curta ainda é uma requisição.
- O núcleo do motor tem código disponível sob BSL-1.1, não é totalmente de código aberto, e hospedá-lo para terceiros exige uma licença comercial.
- A CLI envia contagens de uso anônimas por padrão, então você precisa rodar `caveman telemetry off` se quiser que ela fique completamente silenciosa.
Perguntas frequentes
Deixa os agentes de programação com IA mais baratos ao reduzir o uso de tokens. A habilidade comprime as respostas do agente, e o proxy comprime os registros, os diffs e a saída que o agente lê, deixando código e mensagens de erro intactos.
Conteúdo relacionado
Explore ferramentas, skills e artigos relacionados a Caveman.
Alternativas a Caveman
Forefront
Forefront · ProgramaçãoO Forefront é uma plataforma web para construir com IA de código aberto. Você ajusta os principais modelos de linguagem de código aberto com seus próprios dados, avalia o desempenho deles e os roda por uma API ou os exporta para hospedar por conta própria. Desenvolvedores que querem a conveniência de uma plataforma fechada, mas fazem questão de ser donos dos modelos e dos dados, são o público-alvo aqui.
Startkit
StartKit.AI · ProgramaçãoStartkit é um boilerplate para criar produtos de SaaS com IA e wrappers de IA. Pense nele como um boilerplate para startups de IA com as partes chatas já conectadas: autenticação, pagamentos com Stripe e Lemon Squeezy, limites de uso, e-mail transacional e um kit inicial de API de IA que conversa com OpenAI, Anthropic, Groq ou Llama. Você clona o repositório, define seu preço e começa pela parte do produto que as pessoas realmente pagam. Ele é feito em Next.js sobre React e Tailwind, então boa parte do código boilerplate já parece familiar.
Testim
Tricentis · ProgramaçãoO Testim é uma plataforma de automação de testes com IA para criar e executar testes de ponta a ponta em aplicações web, mobile e Salesforce. Ele se apoia no aprendizado de máquina para manter os testes estáveis quando uma interface muda, então as equipes gastam menos tempo consertando seletores quebrados. Nada mal para uma ferramenta de testes automatizados que você pode começar a usar hoje. Você cria testes gravando ações no navegador e depois adiciona JavaScript quando precisa de mais controle. É uma escolha sólida para equipes de QA ocupadas.
