
Caveman
Julius Brussee · 程式設計
Caveman 是一款免費的 Claude Code 技能,也是本機代理,能縮減開發代理寫出與讀入的內容,讓它燒掉更少 token、執行成本更低。這項技能強制代理以壓縮的「原始人」語氣回覆,同時保留每一項技術事實。代理則是反方向的壓縮 token 工具,縮減代理捲過的日誌、diff 與測試輸出。它支援 30 種以上的代理,不需要帳號,一個指令就能開始。

關於 Caveman
Caveman 是什麼
Caveman 是給 AI 開發代理用的開源省 token 工具。它從兩邊進攻帳單。技能改變代理說話的方式,把冗長的開場白換成簡潔的原始人語氣。代理改變代理讀入的內容,在工具輸出、日誌、JSON 與 diff 抵達你的供應商之前先壓縮它們。
訴求很簡單。程式碼、指令、檔案路徑與錯誤訊息永遠不會被壓縮,只有圍繞它們的文字會。所以你得到相同的診斷與相同的修正,只是少了那些清嗓子的廢話。安全警告與確認訊息仍會以完整句子回傳。
最大的限制在於適用範圍。當代理寫下大量文字或讀入龐大日誌時,Caveman 省得最多。它在哪裡表現不佳?如果你是按請求而非按 token 付費,或你的工作幾乎是純程式碼生成,省下的部分就會縮水。多出來的規則文字甚至可能讓你多花一點。維護者坦率說明這點,並帶你去看一頁列出它落敗情境的清單。
開始使用
- 用單一指令安裝技能,不需要帳號或 API 金鑰:
npx skills add JuliusBrussee/caveman -g。 - 向你的代理提出任何開發問題。現在一般回答都會變短,你可以用
/caveman lite或/caveman ultra設定強度。 - 針對讀入端,用
npm install -g @caveman-ai/cli安裝 CLI,然後執行caveman learn看看你的 token 實際流向何處。 - 用
caveman claude(或codex、gemini、aider等)包住你的代理,讓工具輸出在供應商看到之前先被壓縮。 - 執行
caveman trial -- claude對一場真實工作階段做 A/B 測試,再查看caveman trial report看看是否幫你省下了什麼。
產品資訊
快速了解 Caveman 的定價、支援平台與效能。
適合對象
這項工具最適合的使用者、任務與情境。
使用者
- 按 token 付費的開發者:如果你的供應商按 token 計費,Caveman 同時削減寫出與讀入兩端。真正漏錢的就是讀入那一端。
- 長時間使用代理的人:如果你的代理在日誌、diff 與測試輸出裡待上好幾個小時,代理會在這些串流抵達模型之前先修剪它們。
- 在 Claude Code 或 Codex 上打造工具的團隊:包裝設定檔可直接接上你已在執行的代理,不必改任何設定。
任務
- 日常開發問題:問一個 React 錯誤或一則審查意見,用極少的字數得到同樣的修正。
- 修剪記憶檔案:`/caveman-compress` 指令會剪掉 CLAUDE.md 這類檔案裡的文字,每個標題、路徑與指令都保留。
- 壓縮吵雜的指令輸出:包住一次測試執行,失敗行會留下,進度雜訊則消失。真正減少 AI token,而且不丟細節。
情境
- 偵錯失敗的測試套件:Caveman 保留堆疊追蹤與錯誤行,丟掉 INFO 的碎念,所以代理讀得更少就能找到同樣的錯誤。
- 稽核 token 流向:`caveman learn` 會讀取數個月的本機代理歷史,把你最大的 token 消耗來源從最嚴重排到最輕微。
- 審查 pull request:`/caveman-review` 每行回傳一項發現,例如標記出空指標解參考並附上簡短指示。
主要功能
Caveman 回覆模式
技能決定你的代理說話有多壓縮。查詢各種等級,從 /caveman lite 的簡潔但客氣,到 /caveman ultra 的幾乎只是低吼,若你想要,還有古典中文的 wenyan 模式。程式碼、指令與錯誤訊息在每個等級都不受影響。說 stop caveman,正常文字就會回來。
少讀一點的本機代理
代理就待在你機器上、你的代理與你的供應商之間。它偵測每種酬載類型,不論是 JSON、日誌、程式碼、diff 或網頁,然後把酬載送往一個壓縮器,保留回答所依賴的內容。每個被壓縮的位元組都會在本機 SQLite 留下一份備份,所以代理能用復原控制碼把原始內容取回。
可逆壓縮
這裡沒有任何東西以無法復原的方式失真。代理壓縮的一切,原始檔都留在磁碟上,當壓縮副本不足以回答問題時,代理隨時能透過取回工具要求完整版本。/caveman-compress 指令在改寫你的記憶檔案之前也會先備份。
找出 token 消耗來源
執行 caveman learn 會以本機、唯讀方式讀取你既有的代理歷史,然後把你最大的 token 消耗來源從最嚴重排到最輕微,每項後面附上一行修正。後續指令會把這些修正一項一項以 diff 交給 Claude Code 或 Codex,並還原任何未能降低每回合 token 的變更。
廣泛的代理支援
Caveman 支援 30 種以上的代理。它為其中十種提供原生包裝設定檔,包括 Claude Code、OpenAI Codex CLI、Gemini CLI、Aider 與 OpenClaw。包裝永遠不會改動你的設定檔,一個指令就能還原。
給你自己的應用程式用的中介軟體
如果你是在打造代理而非執行代理,TypeScript 或 Python 的中介軟體外殼會在模型看到之前先壓縮大型工具結果。原生轉接器涵蓋 Vercel AI SDK、LangChain、OpenAI 與 Anthropic 等框架。你的對話歷史保留每一個原始位元組。
可量測的 Claude Code 省 token 效果
Caveman 公布自家的基準測試結果,也連結第三方的檢驗。JetBrains 在 86 項真實開發任務上單獨測試這項技能,發現輸出 token 少了 8.5%,且沒有偵測到品質變化。一篇 Adobe Research 論文測得這種風格讓成本降低 1.4 到 2.4 倍。這類證據讓你在安裝前可以自行衡量。
優缺點
優點
- 免費技能,不需帳號、不需 API 金鑰,採用介面還採 MIT 授權。
- 同時削減代理寫出與讀入的內容,涵蓋兩大 token 消耗來源。
- 壓縮可逆,代理隨時能取回原始位元組。
- 支援 30 種以上的開發代理,並透過小型中介軟體外殼接入你自己的應用程式。
- 公布自家數字與第三方檢驗,包括它落敗的情境。
缺點
- 規則檔在每次呼叫時都作為輸入 token 一起送出,所以簡短的一問一答可能花得比省得多,最後可能比原本更糟。
- 如果你是按請求而非按 token 付費,省下的很有限,因為再短的回答仍是一次請求。
- 引擎核心以 BSL-1.1 提供原始碼,並非完全開源,要為第三方代管需要商業授權。
- CLI 預設會送出匿名使用次數,若想完全安靜,得執行 `caveman telemetry off`。
常見問題
它透過縮減 token 用量讓 AI 開發代理更便宜。技能壓縮代理的回覆,代理則壓縮代理讀入的日誌、diff 與輸出,同時保留程式碼與錯誤訊息。
相關內容
探索與 Caveman 相關的工具、技能與文章。
Caveman 替代方案
Forefront
Forefront · 程式設計Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。
Startkit
StartKit.AI · 程式設計Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。
Testim
Tricentis · 程式設計Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。
