
Caveman
Julius Brussee · 코딩
Caveman은 무료 Claude Code 스킬이자 로컬 프록시로, 코딩 에이전트가 쓰고 읽는 내용을 줄여 토큰을 덜 태우고 실행 비용을 낮춘다. 이 스킬은 모든 기술적 사실을 유지한 채 압축된 원시인 말투의 답변을 강제한다. 프록시는 반대 방향의 토큰 압축 에이전트다. 에이전트가 훑고 지나가는 로그, diff, 테스트 출력을 줄인다. 30개 이상의 에이전트에서 작동하고 계정이 필요 없으며 명령 하나로 시작한다.

Caveman 소개
Caveman이란
Caveman은 AI 코딩 에이전트를 위한 오픈소스 토큰 절약 도구다. 청구서를 양쪽에서 공략한다. 스킬은 에이전트가 말하는 방식을 바꿔 긴 서두를 간결한 원시인 말투로 대체한다. 프록시는 에이전트가 읽는 내용을 바꾼다. 도구 출력, 로그, JSON, diff를 제공자에게 도달하기 전에 압축한다.
요점은 단순하다. 코드, 명령, 파일 경로, 오류 메시지는 절대 압축되지 않는다. 그 주변의 문장만 압축된다. 그래서 같은 진단과 같은 수정을, 군더더기 없이 얻는다. 보안 경고와 확인은 여전히 완전한 문장으로 돌아온다.
가장 큰 한계는 적용 범위다. 에이전트가 문장을 많이 쓰거나 거대한 로그를 읽을 때 Caveman이 가장 많이 절약한다. 어디서 부족할까. 토큰이 아니라 요청 단위로 지불하거나 작업이 거의 순수 코드 생성이라면 절약분은 줄어든다. 추가되는 규칙 텍스트가 오히려 조금의 비용이 될 수도 있다. 관리자는 이를 공개적으로 밝히며, 손해 보는 상황을 나열한 페이지로 안내한다.
시작하기
- 명령 하나로 스킬을 설치한다. 계정도 API 키도 필요 없다:
npx skills add JuliusBrussee/caveman -g. - 에이전트에게 아무 코딩 질문이나 던진다. 이제 평범한 답도 짧게 돌아오며, 강도는
/caveman lite나/caveman ultra로 설정한다. - 읽기 쪽은
npm install -g @caveman-ai/cli로 CLI를 설치한 뒤caveman learn을 실행해 토큰이 실제로 어디로 가는지 본다. caveman claude(또는codex,gemini,aider등)로 에이전트를 감싸면 제공자가 보기 전에 도구 출력이 압축된다.caveman trial -- claude로 실제 세션을 A/B 비교하고,caveman trial report로 무엇을 절약했는지 확인한다.
제품 정보
Caveman의 요금, 지원 플랫폼, 성능을 한눈에 확인해 보세요.
추천 대상
이 도구가 가장 잘 맞는 사용자, 작업, 상황입니다.
사용자
- 토큰 단위로 지불하는 개발자
- 긴 세션 에이전트 사용자
- Claude Code나 Codex 위에 무언가를 만드는 팀
작업
- 일상적인 코딩 질문
- 메모리 파일 다듬기
- 시끄러운 명령 출력 압축
활용 상황
- 실패하는 테스트 스위트 디버깅
- 토큰 소모처 감사
- 풀 리퀘스트 검토
주요 기능
Caveman 답변 모드
스킬은 에이전트가 얼마나 압축해서 말할지 정한다. /caveman lite의 간결하지만 예의 바른 단계부터 /caveman ultra의 거의 으르렁거림까지 단계를 고를 수 있고, 원하면 한문 모드인 wenyan도 있다. 코드와 명령과 오류 메시지는 어느 단계에서도 그대로다. stop caveman이라고 말하면 평범한 문장이 돌아온다.
덜 읽기 위한 로컬 프록시
프록시는 자기 기계에서 에이전트와 제공자 사이에 앉는다. JSON, 로그, 코드, diff, 웹페이지 등 페이로드 종류를 하나하나 알아본다. 그런 다음 답변이 의존하는 부분을 유지하는 압축기로 보낸다. 압축된 모든 바이트는 로컬 SQLite에 백업이 남아, 에이전트가 복구 핸들로 원본을 되가져올 수 있다.
되돌릴 수 있는 압축
여기서는 되돌릴 수 없는 방식의 손실이 없다. 프록시가 압축하는 모든 것의 원본은 디스크에 남고, 압축본으로 답이 부족할 때면 에이전트가 검색 도구를 통해 전체 버전을 요청할 수 있다. /caveman-compress 명령도 메모리 파일을 다시 쓰기 전에 백업을 만든다.
토큰 소모처 찾기
caveman learn을 실행하면 기존 에이전트 기록을 로컬에서 읽기 전용으로 읽고, 토큰 소모처를 심한 순서로 줄 세우며 각각에 한 줄 수정을 붙인다. 이어지는 명령은 그 수정을 Claude Code나 Codex에 diff 하나씩 넘기고, 턴당 토큰을 낮추지 않는 변경은 되돌린다.
폭넓은 에이전트 지원
Caveman은 30개 이상의 에이전트에서 작동한다. 그중 10개에는 네이티브 랩 프로필이 있으며 Claude Code, OpenAI Codex CLI, Gemini CLI, Aider, OpenClaw 등이 포함된다. 감싸기는 설정 파일을 절대 고치지 않는다. 명령 하나로 되돌릴 수 있다.
자기 앱을 위한 미들웨어
에이전트를 실행하는 대신 만드는 쪽이라면, TypeScript나 Python 미들웨어 래퍼가 모델이 보기 전에 큰 도구 결과를 압축한다. 네이티브 어댑터는 Vercel AI SDK, LangChain, OpenAI, Anthropic 같은 프레임워크를 지원한다. 대화 기록은 원본 바이트를 모두 유지한다.
측정할 수 있는 Claude Code 토큰 절약
Caveman은 자체 벤치마크 결과를 공개하고 제3자 검증도 링크한다. JetBrains는 이 스킬만으로 86개의 실제 코딩 작업을 테스트해 감지 가능한 품질 변화 없이 출력 토큰이 8.5% 줄었다. Adobe Research 논문은 이 문체가 비용을 1.4배에서 2.4배 줄인다고 측정했다. 설치 전에 따져 볼 수 있는 그런 종류의 증거다.
장단점
장점
- 계정도 API 키도 필요 없는 무료 스킬이며 도입 표면에 MIT 라이선스가 붙는다.
- 에이전트가 쓰는 것과 읽는 것을 모두 줄여 두 개의 큰 토큰 누수를 막는다.
- 압축이 되돌릴 수 있는 상태로 남아 에이전트가 언제든 원본 바이트를 되찾을 수 있다.
- 30개 이상의 코딩 에이전트에서 작동하고 작은 미들웨어 래퍼로 자기 앱에도 연결된다.
- 자체 수치와 제3자 검증을 공개하며 손해 보는 경우도 포함한다.
단점
- 규칙 파일이 매 호출마다 입력 토큰으로 따라붙어, 간결한 한 줄 문답은 절약분보다 더 들 수 있고 이전보다 나빠질 수도 있다.
- 토큰이 아니라 요청 단위로 지불하면 더 짧은 답도 여전히 한 요청이라 절약이 적다.
- 엔진 핵심은 BSL-1.1로 소스가 공개된 상태이며 완전한 오픈소스가 아니고, 제3자를 위해 호스팅하려면 상용 라이선스가 필요하다.
- CLI는 기본적으로 익명 사용 횟수를 보내므로 완전히 조용하게 하려면 `caveman telemetry off`를 실행해야 한다.
자주 묻는 질문
토큰 사용을 줄여 AI 코딩 에이전트를 더 싸게 만든다. 스킬은 에이전트의 답변을 압축하고, 프록시는 에이전트가 읽는 로그, diff, 출력을 압축하며, 코드와 오류 메시지는 그대로 둔다.
관련 콘텐츠
Caveman와 관련된 도구, 스킬, 아티클을 살펴보세요.
Caveman 대안
Forefront
Forefront · 코딩Forefront는 오픈소스 AI로 무언가를 만드는 웹 플랫폼이다. 대표적인 오픈소스 언어 모델을 자신의 데이터로 미세 조정하고, 성능을 평가하고, API로 실행하거나 내보내 직접 호스팅할 수 있다. 폐쇄형 플랫폼의 편의를 원하면서도 모델과 데이터의 소유권은 놓지 않으려는 개발자가 대상이다.
Startkit
StartKit.AI · 코딩Startkit은 AI SaaS와 AI 래퍼 제품을 만들기 위한 보일러플레이트다. 지루한 부분을 미리 연결해 둔 AI 스타트업 보일러플레이트라고 생각하면 된다. 인증, Stripe와 Lemon Squeezy 결제, 사용량 제한, 트랜잭션 이메일, 그리고 OpenAI, Anthropic, Groq, Llama와 통신하는 AI API 스타터 키트가 포함된다. 저장소를 복제하고 가격을 정한 뒤 사용자가 실제로 돈을 내는 부분에 착수하면 된다. React와 Tailwind 위의 Next.js로 만들어졌기 때문에 보일러플레이트 코드의 상당 부분이 이미 익숙하게 느껴진다.
Testim
Tricentis · 코딩Testim은 웹, 모바일, Salesforce 애플리케이션 전반에 걸쳐 엔드투엔드 테스트를 만들고 실행하는 AI 기반 테스트 자동화 플랫폼이다. 머신러닝에 기대어 인터페이스가 바뀌어도 테스트를 안정적으로 유지하므로, 팀은 깨진 셀렉터를 고치는 데 쓰는 시간을 줄인다. 오늘부터 쓸 수 있는 자동화 테스트 도구치고 나쁘지 않다. 브라우저에서 동작을 녹화해 테스트를 만들고, 더 세밀한 제어가 필요하면 JavaScript를 더한다. 바쁜 QA 팀에게 탄탄한 선택이다.
