Caveman

Caveman

Julius Brussee · Programação

Caveman é uma habilidade gratuita para Claude Code e um proxy local que encolhe o que um agente de programação escreve e lê, então ele queima menos tokens e custa menos para rodar. A habilidade força respostas comprimidas no estilo caverna que mantêm cada fato técnico. O proxy é um agente de compressão de tokens para a outra direção. Ele encolhe os registros, os diffs e a saída de testes pelos quais o agente passa. Funciona com mais de 30 agentes, não precisa de conta e começa com um único comando.

Prévia da interface de Caveman

Sobre Caveman

O que é o Caveman

Caveman é um economizador de tokens de código aberto para agentes de programação com IA. Ele ataca a conta por dois lados. A habilidade muda como um agente fala e troca preâmbulos longos por prosa de caverna concisa. O proxy muda o que um agente lê. Ele aperta a saída de ferramentas, os registros, o JSON e os diffs antes que cheguem ao seu provedor.

A proposta é simples. Código, comandos, caminhos de arquivo e mensagens de erro nunca são comprimidos. Só a prosa ao redor deles. Assim você obtém o mesmo diagnóstico e a mesma correção, sem os rodeios. Avisos de segurança e confirmações continuam voltando em frases completas.

O principal limite é o alcance. Caveman economiza mais quando um agente escreve muita prosa ou lê registros enormes. Onde ele fica devendo? Se você paga por requisição em vez de por token, ou seu trabalho é quase pura geração de código, a economia encolhe. O texto extra de regras pode até custar um pouco. O mantenedor diz isso abertamente e aponta para uma página que lista onde ele perde.

Como começar

  1. Instale a habilidade com um único comando, sem conta nem chave de API: npx skills add JuliusBrussee/caveman -g.
  2. Pergunte qualquer dúvida de programação ao seu agente. As respostas normais agora voltam curtas, e você pode ajustar a intensidade com /caveman lite ou /caveman ultra.
  3. Para o lado da leitura, instale a CLI com npm install -g @caveman-ai/cli e depois rode caveman learn para ver para onde seus tokens realmente vão.
  4. Envolva seu agente com caveman claude (ou codex, gemini, aider e outros) para que a saída de ferramentas seja comprimida antes que o provedor a veja.
  5. Rode caveman trial -- claude para comparar A/B uma sessão real e depois confira caveman trial report para ver se ele economizou algo.

Informações do produto

Uma visão rápida dos preços, das plataformas compatíveis e do desempenho de Caveman.

Plano gratuitoSim
Planos pagos$0
PlataformaClaude Code, Codex, Gemini CLI, Aider, opencode, Pi, Hermes, plus 30+ skills-compatible agents
DesenvolvedorJulius Brussee
CategoriaProgramação
Data de lançamentoApr 2025
Última atualizaçãoJul 2026
Visitas ao site649.3M
Ranking global do site50
Disponibilidade da APISim

Ideal para

Os usuários, tarefas e cenários em que esta ferramenta se encaixa melhor.

Usuários

  • Desenvolvedores que pagam por token
  • Usuários de agentes em sessões longas
  • Equipes que constroem sobre Claude Code ou Codex

Tarefas

  • Dúvidas cotidianas de programação
  • Enxugar arquivos de memória
  • Comprimir saída barulhenta de comandos

Cenários

  • Depurar uma suíte de testes que falha
  • Auditar para onde vão os tokens
  • Revisar um pull request

Principais recursos

Modos de resposta do Caveman

A habilidade define o quão comprimido seu agente fala. Consulte níveis desde o /caveman lite para um tom enxuto mas educado até o /caveman ultra para quase grunhidos, com um modo wenyan para chinês clássico se você quiser. Código, comandos e mensagens de erro ficam intactos em todos os níveis. Diga stop caveman e a prosa normal volta.

Proxy local para ler menos

O proxy fica entre seu agente e seu provedor na sua própria máquina. Ele detecta cada tipo de carga, seja JSON, registro, código, diff ou página web. Depois manda a carga para um compressor que mantém aquilo de que as respostas dependem. Cada byte comprimido ganha um backup em SQLite local, então o agente pode puxar o original de volta com um identificador de recuperação.

Compressão reversível

Nada aqui tem perda de um jeito que você não possa desfazer. Os originais de tudo que o proxy aperta ficam no disco, e o agente pode pedir a versão completa de volta por meio de uma ferramenta de recuperação sempre que a cópia comprimida não bastar para responder à pergunta. O comando /caveman-compress também faz backup do seu arquivo de memória antes de reescrevê-lo.

Descoberta de consumos de tokens

Rodar caveman learn lê seu histórico de agente existente de forma local e somente leitura, e depois classifica seus consumos de tokens do pior para o melhor com uma correção de uma linha atrás de cada um. Um comando seguinte entrega essas correções ao Claude Code ou ao Codex um diff por vez e reverte qualquer mudança que não baixe os tokens por turno.

Amplo suporte a agentes

O Caveman funciona em mais de 30 agentes. Tem perfis de envoltura nativos para dez deles, incluindo Claude Code, OpenAI Codex CLI, Gemini CLI, Aider e OpenClaw. Envolver nunca edita seus arquivos de configuração. Você pode desfazer com um único comando.

Middleware para seu próprio app

Se você está construindo um agente em vez de rodar um, um envoltório de middleware em TypeScript ou Python comprime resultados grandes de ferramentas antes que o modelo os veja. Adaptadores nativos cobrem frameworks como o Vercel AI SDK, LangChain, OpenAI e Anthropic. Seu histórico de conversa mantém cada byte original.

Economia de tokens no Claude Code que você pode medir

O Caveman publica seus próprios resultados de referência e também linka as verificações de terceiros. A JetBrains testou a habilidade sozinha em 86 tarefas reais de programação e achou 8,5% menos tokens de saída sem mudança de qualidade detectável. Um artigo da Adobe Research mediu que o estilo corta o custo entre 1,4 e 2,4 vezes. É o tipo de prova que você pode pesar antes de instalar.

Prós e contras

Prós

  • Habilidade gratuita, sem conta, sem chave de API e com licença MIT nas superfícies de adoção.
  • Corta tanto o que um agente escreve quanto o que ele lê, cobrindo os dois maiores ralos de tokens.
  • A compressão permanece reversível, então o agente sempre pode recuperar os bytes originais.
  • Funciona em mais de 30 agentes de programação e se encaixa no seu próprio app por meio de um pequeno envoltório de middleware.
  • Publica seus números e as verificações de terceiros, incluindo os casos em que perde.

Contras

  • O arquivo de regras viaja como tokens de entrada em cada chamada, então uma pergunta e resposta de uma linha e enxuta pode custar mais do que economiza e você pode acabar pior do que antes.
  • Economiza pouco se você paga por requisição em vez de por token, porque uma resposta mais curta ainda é uma requisição.
  • O núcleo do motor tem código disponível sob BSL-1.1, não é totalmente de código aberto, e hospedá-lo para terceiros exige uma licença comercial.
  • A CLI envia contagens de uso anônimas por padrão, então você precisa rodar `caveman telemetry off` se quiser que ela fique completamente silenciosa.

Perguntas frequentes

Deixa os agentes de programação com IA mais baratos ao reduzir o uso de tokens. A habilidade comprime as respostas do agente, e o proxy comprime os registros, os diffs e a saída que o agente lê, deixando código e mensagens de erro intactos.

Conteúdo relacionado

Explore ferramentas, skills e artigos relacionados a Caveman.

Alternativas a Caveman

Forefront

Forefront

Forefront · Programação

O Forefront é uma plataforma web para construir com IA de código aberto. Você ajusta os principais modelos de linguagem de código aberto com seus próprios dados, avalia o desempenho deles e os roda por uma API ou os exporta para hospedar por conta própria. Desenvolvedores que querem a conveniência de uma plataforma fechada, mas fazem questão de ser donos dos modelos e dos dados, são o público-alvo aqui.

Grátis / $0 - $99/moVer detalhes
Startkit

Startkit

StartKit.AI · Programação

Startkit é um boilerplate para criar produtos de SaaS com IA e wrappers de IA. Pense nele como um boilerplate para startups de IA com as partes chatas já conectadas: autenticação, pagamentos com Stripe e Lemon Squeezy, limites de uso, e-mail transacional e um kit inicial de API de IA que conversa com OpenAI, Anthropic, Groq ou Llama. Você clona o repositório, define seu preço e começa pela parte do produto que as pessoas realmente pagam. Ele é feito em Next.js sobre React e Tailwind, então boa parte do código boilerplate já parece familiar.

Pago / $99 - $499 one-timeVer detalhes
Testim

Testim

Tricentis · Programação

O Testim é uma plataforma de automação de testes com IA para criar e executar testes de ponta a ponta em aplicações web, mobile e Salesforce. Ele se apoia no aprendizado de máquina para manter os testes estáveis quando uma interface muda, então as equipes gastam menos tempo consertando seletores quebrados. Nada mal para uma ferramenta de testes automatizados que você pode começar a usar hoje. Você cria testes gravando ações no navegador e depois adiciona JavaScript quando precisa de mais controle. É uma escolha sólida para equipes de QA ocupadas.

Grátis / Custom pricing on requestVer detalhes