AgentLoop

AgentLoop

aiedwardyi · 程式設計

AgentLoop 是一款在本機執行的協調常駐程式,能把一個範圍明確的程式目標變成實際交付的成果。你可以把它想成一套真正屬於你自己的本機代理工作流程。你在 ChatGPT 或 Claude 裡規劃一次、交出目標,AgentLoop 就會一輪接一輪地執行全新的 Codex 或 Claude Code worker,同時由一位獨立評審執行你在 GUIDELINES.md 寫下的標準。你的專案檔案就是記憶,所以迴圈之間不會遺失任何東西,而每個判定、成本與逐字紀錄都能在即時儀表板上看到。它是為無人看守的程式迴圈而設計,你可以放著讓它跑,之後再回頭檢查。

AgentLoop 的介面預覽

關於 AgentLoop

AgentLoop 是什麼

AgentLoop 是一款程式碼代理協調器,為獨自執行長時間代理任務、無法全程盯著每個工作階段的獨立開發者而設計。你不必整天在聊天視窗與終端機之間搬運計畫,只要設定一次目標與終點,剩下的交接就交給迴圈處理。

核心概念很簡單。每個迴圈都會啟動一個全新的 worker 行程,藉此去除長時間對話中堆積的過時假設與死掉的脈絡。進度是靠專案檔案本身往前推進,而不是靠一段不斷膨脹的對話。不是聊天紀錄。接著由一位獨立評審讀取你的評分規則與 worker 的產出,它的判定決定迴圈要繼續、失敗還是交付。

它在你程式碼原本所在的地方執行:Node.js 18+、Git,以及 Codex 或 Claude Code 的命令列介面。沒有託管工作區,也不需要 npm install。這也正是它最大的限制。AgentLoop 是給熟悉終端機的開發者使用的命令列工具,不是點一下就啟動的 app,而且它必須有那兩套程式引擎之一才能做任何事。如果你本來就在用這些工具,設定很快。如果沒有,就不快了。

開始使用

  1. 確認你的電腦已安裝 Node.js 18+、Git,以及 Codex 或 Claude Code 的命令列介面。
  2. 複製儲存庫並進入資料夾:git clone --branch v1.2.0 --depth 1 https://github.com/aiedwardyi/AgentLoop.git,然後 cd AgentLoop。
  3. 用 node src/daemon.js 啟動常駐程式,並開啟本機儀表板。
  4. 在 goal.md 寫下你範圍明確的目標,並在 GUIDELINES.md 寫下你的完成定義。
  5. 在儀表板上為每個迴圈挑選引擎,然後讓 worker 與評審迴圈持續執行,直到評審回傳 PASS 判定。

產品資訊

快速了解 AgentLoop 的定價、支援平台與效能。

免費方案是
付費方案$0
平台Desktop (Windows, macOS, Linux) via Node.js CLI
開發者aiedwardyi
類別程式設計
發布日期Jul 2025
最近更新Sep 2025
網站訪問量N/A
網站全球排名N/A
API 提供狀態N/A

適合對象

這項工具最適合的使用者、任務與情境。

使用者

  • 獨立開發者:同時在好幾個專案上執行長時間的程式任務,不必逐一看管每個工作階段,前提是你熟悉命令列,並且已安裝 Codex 或 Claude Code。
  • 獨自推出功能的獨立開發者:在你忙別的事情時,讓一整套建置、審查、修正的循環跑起來,前提是你的任務有明確的驗收標準。
  • 重視流程的工程師:把完成定義集中在單一的 GUIDELINES.md 檔案裡,讓每個 worker 與評審都用同一套標準被檢視。

任務

  • 功能開發:交出一個範圍明確的目標,例如在整個介面與 API 加上 CSV 匯出,讓 worker 動手建置,同時由評審檢查邊界情況與文件。
  • 程式碼移轉:以小型、可驗證的增量把程式碼庫移到較新的模式,而不是一次冒險重寫。
  • 強化處理:把「讓它更安全」這種模糊需求,透過把規則寫進評分標準,變成具體的修正。
  • 回歸測試覆蓋:讓評審挑出現有測試套件漏掉的缺陷,再為它們補上測試。
  • 產品打磨:第一次 PASS 之後,打磨迴圈會持續一次提出並驗證一項改進。

情境

  • 在個人專案上跑整夜,你希望早上就有進度,又不想盯著每一次工具呼叫。
  • 多專案的日子,你把彼此獨立的任務排進佇列,趁工作空檔查看儀表板。
  • 透過把評分標準寫得明確又可重複,把你的標準教給 junior 或 AI worker。
  • 事後稽核代理的推理過程,因為每個迴圈、判定與逐字紀錄都會留在時間軸上。

主要功能

每個迴圈都有全新脈絡

AgentLoop 會為每個 worker 與每個評審工作階段啟動全新的引擎行程,所以不會有任何先前的聊天紀錄跟著它們。這能避免脈絡腐化,也就是讓長時間對話變得不可靠的過時假設堆積。可長久保存的記憶是專案本身,加上評審寫下的具體修正,這能避免為了重讀一段不斷膨脹的對話而浪費 token。

依你的評分標準運作的獨立評審

你把完成定義放進 GUIDELINES.md。每個迴圈都會有全新的評審,連同 worker 的產出與專案檔案一起讀取該檔案。評審的最後一行是一份嚴格合約:它必須落在 PASS、帶修正說明的 FAIL,或 CONTINUE。FAIL 會變成注入給下一個 worker 的指示,所以回饋會轉化為行動,而不是一個你得手動轉達的評論。在專案本身的評估中,一位全新的評審在九項測試全都通過之後,仍找出一項混合的百分比解碼缺陷。

以檔案作為長久記憶

進度存在 PLAN.md 與 STATE.md 裡,而不是存在對話中。worker 讀取計畫與狀態、做出一個增量、更新狀態,然後結束。因為記憶存在檔案裡,迴圈能維持在範圍內,也更容易放著不管。這也意味著你能讀取代理所依據的同一批產物,清楚看到每一步改了什麼。

即時儀表板與可觀測性

每個迴圈、判定、逐字紀錄、成本與檔案交接都會顯示在本機儀表板上。你可以直接從那裡取消一次執行,不必去追查某個行程,也能透過 MCP 橋接向 ChatGPT 詢問狀態。不必瞎猜。對那些曾試著事後除錯無人看守的代理執行的人來說,有沒有把時間軸記錄下來,就是修好問題與憑空猜測之間的差別。

支援 Codex 與 Claude Code

AgentLoop 把 Codex 命令列介面與 Claude Code 當作可互換的引擎來執行。你可以從儀表板為每個迴圈挑一個,或透過橋接為每個任務挑一個。這個專案把規劃與本機執行分開,而發展藍圖接下來指向雙向的代理提問與研究迴圈。

Git 中的自動檢查點

對位於 git 工作樹內的專案,自動檢查點預設為開啟,所以常駐程式能在迴圈完成時提交進度。突發失敗,例如某個卡住的任務達到重試上限,不會抹掉已經完成的工作。復原只差一道 git 指令,而不是賠掉一個下午。這在整夜執行時格外重要。

設計上就維持範圍的迴圈

一個迴圈刻意採循序方式。彼此獨立、排進佇列的任務可以跑到並行上限,但單一迴圈絕不會變成在同一專案上亂竄的平行蜂群。這是刻意的。預算也有上限。maxCycles 從 1 到 50,預設為 3,而 taskRetries 會限制連續失敗次數,之後任務就會被標為受阻並跳過。

優缺點

優點

  • 免費且採 MIT 授權,完整原始碼都在 GitHub 上。
  • 在你的現有儲存庫上本機執行,所以你的程式碼永遠不會離開你的電腦。
  • 每個迴圈都有全新的 worker 與評審行程,能減少困擾長時間代理對話的脈絡腐化。
  • 評審執行的是你自己寫下的規則,讓品質檢查一致且可重複。
  • 即時儀表板記錄每個判定、成本與逐字紀錄,讓無人看守的執行仍可稽核。
  • 可搭配 Codex 命令列介面或 Claude Code,能配合你本來就在用的引擎。

缺點

  • 只能透過命令列設定。沒有圖形化安裝程式,所以非開發者會卡在必要的 Node.js、Git 與引擎命令列步驟上。
  • 你需要另外有 Codex 或 Claude Code 的訂閱或 API 存取權。AgentLoop 本身免費,但沒有這些引擎之一,迴圈就跑不起來。
  • 評分標準才是吃重的那一塊。模糊的驗收標準會產生模糊的判定,所以它有利於本來就會寫精確規格的團隊。
  • 沒有託管選項。如果你想要一個能從任何瀏覽器開啟的受管理的工作區,這不是你要的。

常見問題

AgentLoop 是一款在本機執行的常駐程式,負責協調程式碼代理。你想停止在規劃者與程式碼代理之間手動轉達訊息嗎?那就是它接手的工作。它把範圍明確的目標送給全新的 Codex 或 Claude Code worker,讓一位獨立評審依你的評分標準審查每個結果,並重複這個迴圈,直到成果符合你的標準。

相關內容

探索與 AgentLoop 相關的工具、技能與文章。

AgentLoop 替代方案

Forefront

Forefront

Forefront · 程式設計

Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。

免費 / $0 - $99/mo查看詳情
Startkit

Startkit

StartKit.AI · 程式設計

Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。

付費 / $99 - $499 one-time查看詳情
Testim

Testim

Tricentis · 程式設計

Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。

免費 / Custom pricing on request查看詳情