Caveman

Caveman

Julius Brussee · Programación

Caveman es una habilidad gratuita para Claude Code y un proxy local que reduce lo que un agente de programación escribe y lee, así quema menos tokens y cuesta menos ejecutarlo. La habilidad obliga a dar respuestas comprimidas estilo cavernícola que conservan cada dato técnico. El proxy es un agente de compresión de tokens para la otra dirección. Reduce los registros, los diffs y la salida de pruebas por los que el agente va pasando. Funciona con más de 30 agentes, no necesita cuenta y se inicia con un solo comando.

Vista previa de la interfaz de Caveman

Acerca de Caveman

Qué es Caveman

Caveman es un ahorrador de tokens de código abierto para agentes de programación con IA. Ataca la factura desde dos lados. La habilidad cambia cómo habla un agente y sustituye los preámbulos largos por prosa cavernícola escueta. El proxy cambia lo que lee un agente. Aprieta la salida de herramientas, los registros, el JSON y los diffs antes de que lleguen a tu proveedor.

La propuesta es sencilla. El código, los comandos, las rutas de archivos y los mensajes de error nunca se comprimen. Solo la prosa que los rodea. Así obtienes el mismo diagnóstico y la misma solución, sin los rodeos previos. Las advertencias de seguridad y las confirmaciones siguen llegando en frases completas.

El límite principal es el alcance. Caveman ahorra más cuando un agente escribe mucha prosa o lee registros enormes. ¿Dónde se queda corto? Si pagas por solicitud en lugar de por token, o tu trabajo es casi pura generación de código, el ahorro se encoge. El texto extra de reglas incluso puede costarte un poco. El mantenedor lo dice abiertamente y te señala una página donde enumera los casos en los que pierde.

Primeros pasos

  1. Instala la habilidad con un solo comando, sin cuenta ni clave de API: npx skills add JuliusBrussee/caveman -g.
  2. Pregúntale a tu agente cualquier duda de programación. Las respuestas normales ahora vuelven cortas, y puedes fijar la intensidad con /caveman lite o /caveman ultra.
  3. Para el lado de la lectura, instala la CLI con npm install -g @caveman-ai/cli y luego ejecuta caveman learn para ver adónde van tus tokens en realidad.
  4. Envuelve tu agente con caveman claude (o codex, gemini, aider y otros) para que la salida de herramientas se comprima antes de que la vea el proveedor.
  5. Ejecuta caveman trial -- claude para comparar A/B una sesión real y luego revisa caveman trial report para ver si te ahorró algo.

Información del producto

Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de Caveman.

Plan gratuitoSí
Planes de pago$0
PlataformaClaude Code, Codex, Gemini CLI, Aider, opencode, Pi, Hermes, plus 30+ skills-compatible agents
DesarrolladorJulius Brussee
CategoríaProgramación
Fecha de lanzamientoApr 2025
Última actualizaciónJul 2026
Visitas al sitio web649.3M
Ranking global del sitio50
Disponibilidad de la APISí

Ideal para

Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.

Usuarios

  • Desarrolladores que pagan por token
  • Usuarios de agentes con sesiones largas
  • Equipos que construyen sobre Claude Code o Codex

Tareas

  • Dudas cotidianas de programación
  • Recortar archivos de memoria
  • Comprimir la salida ruidosa de comandos

Casos de uso

  • Depurar una suite de pruebas que falla
  • Auditar adónde van los tokens
  • Revisar un pull request

Funciones clave

Modos de respuesta de Caveman

La habilidad fija cuán comprimido habla tu agente. Consulta niveles desde /caveman lite para un tono ajustado pero cortés hasta /caveman ultra para casi gruñidos, con un modo wenyan para chino clásico si lo quieres. El código, los comandos y los mensajes de error quedan intactos en todos los niveles. Di stop caveman y vuelve la prosa normal.

Proxy local para leer menos

El proxy se coloca entre tu agente y tu proveedor en tu propia máquina. Detecta cada tipo de carga útil, ya sea JSON, registro, código, diff o página web. Luego la envía a un compresor que conserva aquello de lo que dependen las respuestas. Cada byte comprimido se respalda en un SQLite local, así el agente puede recuperar el original con un identificador de recuperación.

Compresión reversible

Aquí nada es con pérdida de una forma que no puedas deshacer. Los originales de todo lo que aprieta el proxy se quedan en disco, y el agente puede pedir la versión completa mediante una herramienta de recuperación cuando la copia comprimida no basta para responder la pregunta. El comando /caveman-compress también respalda tu archivo de memoria antes de reescribirlo.

Descubrimiento de consumos de tokens

Ejecutar caveman learn lee tu historial de agente existente de forma local y de solo lectura, y luego ordena tus consumos de tokens del peor al mejor con una solución de una línea detrás de cada uno. Un comando posterior entrega esas soluciones a Claude Code o Codex de a un diff por vez y revierte cualquier cambio que no baje los tokens por turno.

Amplio soporte de agentes

Caveman funciona en más de 30 agentes. Tiene perfiles de envoltura nativos para diez de ellos, entre ellos Claude Code, OpenAI Codex CLI, Gemini CLI, Aider y OpenClaw. Envolver nunca edita tus archivos de configuración. Puedes deshacerlo con un solo comando.

Middleware para tu propia app

Si estás construyendo un agente en lugar de ejecutar uno, un envoltorio de middleware en TypeScript o Python comprime los resultados grandes de herramientas antes de que los vea el modelo. Los adaptadores nativos cubren marcos como el Vercel AI SDK, LangChain, OpenAI y Anthropic. Tu historial de conversación conserva cada byte original.

Ahorro de tokens en Claude Code que puedes medir

Caveman publica sus propios resultados de referencia y también enlaza las comprobaciones de terceros. JetBrains probó la habilidad sola en 86 tareas reales de programación y encontró un 8,5 % menos de tokens de salida sin un cambio de calidad detectable. Un artículo de Adobe Research midió que el estilo recorta el costo entre 1,4 y 2,4 veces. Es el tipo de prueba que puedes sopesar antes de instalar.

Ventajas y desventajas

Ventajas

  • Habilidad gratuita sin cuenta, sin clave de API y con licencia MIT en las superficies de adopción.
  • Recorta tanto lo que un agente escribe como lo que lee, cubriendo los dos mayores desagües de tokens.
  • La compresión sigue siendo reversible, así el agente siempre puede recuperar los bytes originales.
  • Funciona en más de 30 agentes de programación y se conecta a tu propia app mediante un pequeño envoltorio de middleware.
  • Publica sus cifras y las comprobaciones de terceros, incluidos los casos en los que pierde.

Desventajas

  • El archivo de reglas viaja como tokens de entrada en cada llamada, así que una pregunta y respuesta de una sola línea y escueta puede costar más de lo que ahorra y podrías terminar peor que antes.
  • Ahorra poco si pagas por solicitud en lugar de por token, porque una respuesta más corta sigue siendo una solicitud.
  • El núcleo del motor tiene código disponible bajo BSL-1.1, no es totalmente de código abierto, y alojarlo para terceros exige una licencia comercial.
  • La CLI envía recuentos de uso anónimos de forma predeterminada, así que tienes que ejecutar `caveman telemetry off` si lo quieres completamente silencioso.

Preguntas frecuentes

Abarta los agentes de programación con IA reduciendo su uso de tokens. La habilidad comprime las respuestas del agente, y el proxy comprime los registros, los diffs y la salida que el agente lee, mientras deja intactos el código y los mensajes de error.

Contenido relacionado

Explora herramientas, habilidades y artículos relacionados con Caveman.

Alternativas a Caveman

Forefront

Forefront

Forefront · Programación

Forefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.

Gratis / $0 - $99/moVer detalles
Startkit

Startkit

StartKit.AI · Programación

Startkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.

De pago / $99 - $499 one-timeVer detalles
Testim

Testim

Tricentis · Programación

Testim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.

Gratis / Custom pricing on requestVer detalles