
AgentLoop
aiedwardyi · コーディング
AgentLoopは、範囲を限定したコーディング目標を実際に出荷される成果へ変える、ローカル実行のオーケストレーションdaemonである。自分が本当に所有するローカルエージェントワークフローだと考えればいい。ChatGPTかClaudeで一度計画し、目標を渡せば、AgentLoopがサイクルごとに新しいCodexまたはClaude Codeワーカーを走らせ、独立した批評役がGUIDELINES.mdに書いた基準を守らせる。プロジェクトのファイルが記憶として機能するため、サイクル間で何も失われず、すべての判定・コスト・記録はライブダッシュボードで確認できる。放置して後から見返せる、無人コーディングループ向けに作られている。

AgentLoop について
AgentLoopとは何か
AgentLoopは、長いエージェント作業を回し、すべてのセッションを監視する余裕がないソロ開発者向けのコーディングエージェントオーケストレーターである。一日中チャットウィンドウとターミナルの間で計画を運ぶ代わりに、目標と終着点を一度だけ決めれば、あとはループが引き継ぎを担う。
中心となる考え方は単純だ。各サイクルはまったく新しいワーカープロセスを起動する。これにより、長いチャットにたまる古い前提や死んだ文脈が取り除かれる。作業は成長し続ける会話ではなく、プロジェクトのファイルそのものを通じて前に進む。チャットログではない。次に独立した批評役がルーブリックとワーカーの出力を読み、その判定がループを続けるか、失敗させるか、出荷するかを決める。
すでにコードがある場所で動く。Node.js 18+、Git、そしてCodexかClaude CodeのCLIのいずれかだ。ホスト型ワークスペースもnpm installもない。これは同時に最大の制約でもある。AgentLoopはターミナルに慣れた開発者向けのコマンドラインツールであり、クリックで始まるアプリではない。何かを行うにはこの2つのコーディングエンジンのどちらかが要る。これらのツールをすでに使っているなら導入は速い。使っていなければ速くない。
はじめかた
- マシンにNode.js 18+、Git、そしてCodex CLIかClaude Code CLIのいずれかが入っていることを確認する。
- リポジトリをクローンしてフォルダに移動する。
git clone --branch v1.2.0 --depth 1 https://github.com/aiedwardyi/AgentLoop.gitの後、cd AgentLoop。 node src/daemon.jsでdaemonを起動し、ローカルダッシュボードを開く。- 範囲を限定した目標を
goal.mdに、完了の定義をGUIDELINES.mdに書く。 - ダッシュボードでループごとにエンジンを選び、批評役がPASS判定を返すまでワーカーと批評役のサイクルを回す。
AIツール情報
AgentLoopの料金、対応プラットフォーム、性能を簡単に確認できます。
こんな人におすすめ
このツールが最も力を発揮するユーザー、タスク、シーン。
ユーザー
- ソロ開発者。コマンドラインに慣れ、CodexかClaude Codeを導入済みであれば、セッションごとに見張らずに複数プロジェクトの長いコーディング作業を回せる。
- ひとりで機能を出すインディーハッカー。タスクに明確な受け入れ基準があれば、別の作業をしながら構築・レビュー・修正の一巡を動かせる。
- プロセスを重視するエンジニア。完了の定義を単一のGUIDELINES.mdにまとめ、すべてのワーカーと批評役を同じ基準で判定させる。
タスク
- 機能開発。UIとAPI全体へのCSV出力追加のような範囲を限定した目標を渡し、批評役がエッジケースとドキュメントを確認する間にワーカーが構築する。
- コード移行。危険な一括リライトではなく、小さく検証可能な増分でコードベースを新しいパターンへ移す。
- 堅牢化の一巡。「もっと安全に」という曖昧な依頼を、ルールをルーブリックに書くことで具体的な修正に変える。
- リグレッションの網羅。既存のテストスイートが見逃す欠陥を批評役に指摘させ、それからテストを追加する。
- 製品の磨き込み。最初のPASSの後、磨き込みのサイクルが一度に1つの改善を提案し検証し続ける。
シーン
- 個人プロジェクトを夜通し回し、毎回のツール呼び出しを監視せずに朝には進捗が欲しいとき。
- 複数プロジェクトを抱える日。独立したタスクを並べ、他の作業の合間にダッシュボードを確認する。
- ルーブリックを明示的で再現可能にすることで、ジュニアやAIワーカーに自分の基準を教える。
- 事後にエージェントの推論を監査する。各サイクル、判定、記録がタイムラインに残るためだ。
主な機能
サイクルごとに新しい文脈
AgentLoopはワーカーごと、批評役セッションごとに新しいエンジンプロセスを起動するため、過去のチャット履歴は付いてこない。これにより文脈の腐敗、つまり長く走るチャットを信頼できなくする古い前提の蓄積を避けられる。永続する記憶はプロジェクトそのものと、批評役が書く具体的な修正であり、膨れ上がる会話を読み直すためにトークンを燃やすことを防ぐ。
自分のルーブリックを伴う独立した批評役
完了の定義はGUIDELINES.mdに置く。新しい批評役が毎サイクル、そのファイルとワーカーの出力、プロジェクトのファイルを読む。批評役の最終行は厳格な契約だ。PASS、修正メモ付きのFAIL、CONTINUE のいずれかで終えなければならない。FAILは次のワーカーに注入される指示になり、フィードバックは手で伝えるコメントではなく行動に変わる。プロジェクト自身の評価では、9つのテストすべてが通過した後に、新しい批評役が混合パーセントデコードの欠陥を見つけた。
永続する記憶としてのファイル
進捗はPLAN.mdとSTATE.mdに住む。会話ではない。ワーカーは計画と状態を読み、1つの増分を行い、状態を更新して終了する。記憶がファイルにあるため、ループは範囲内に収まり、放置しやすい。エージェントが扱うのと同じ成果物を読めるので、各ステップで何が変わったかを正確に確認できるという意味でもある。
ライブダッシュボードと可観測性
各サイクル、判定、記録、コスト、ファイルの引き継ぎがローカルダッシュボードに表示される。プロセスを探し回る代わりにそこから実行をキャンセルでき、MCPブリッジ経由でChatGPTに状態を尋ねられる。当て推量は要らない。無人エージェント実行を事後にデバッグしようとしたことのある人にとって、タイムラインが記録されているかどうかは、問題を直すことと推測することの差になる。
CodexとClaude Codeのサポート
AgentLoopはCodex CLIとClaude Codeを交換可能なエンジンとして動かす。ダッシュボードでループごとに、またはブリッジ経由でタスクごとに選べる。このプロジェクトは計画とローカル実行を切り離しておき、ロードマップは次に双方向のエージェント質問とリサーチループを目指す。
Gitの自動チェックポイント
gitワークツリー内のプロジェクトでは、自動チェックポイントが既定で有効であり、サイクルが完了するたびにdaemonが進捗をコミットできる。再試行上限に達したスタックしたタスクのような突然の失敗でも、すでに済んだ作業を消さない。復旧はgitコマンド1つ分であり、無駄にした午後ではない。夜通しの実行ではこれが効く。
設計上の範囲制限
ループは意図的に逐次実行だ。独立して並べたタスクは並行上限まで走れるが、1つのループが同じプロジェクトを駆け回る並列の群れになることはない。これは意図的だ。予算にも上限がある。maxCyclesは1から50で既定は3、taskRetriesは連続失敗を制限し、上限に達するとタスクは停止扱いでスキップされる。
メリットとデメリット
メリット
- 無料かつMITライセンスで、完全なソースがGitHubにある。
- 既存のリポジトリに対してローカルで動くため、コードが自分のマシンから出ない。
- サイクルごとに新しいワーカーと批評役のプロセスを立てるため、長いエージェントチャットを悩ませる文脈の腐敗が減る。
- 批評役は自分で書いたルールを守らせるので、品質チェックが一貫して再現可能になる。
- ライブダッシュボードがすべての判定・コスト・記録を記録するので、無人の実行も監査可能なまま保たれる。
- Codex CLIまたはClaude Codeで動くので、すでに使っているエンジンに合う。
デメリット
- コマンドラインでのセットアップのみ。GUIインストーラーがないため、非開発者は必須のNode.js、Git、エンジンCLIの手順でつまずく。
- CodexかClaude CodeのサブスクリプションまたはAPIアクセスが別途要る。AgentLoop自体は無料だが、どちらかのエンジンがなければループは回らない。
- ルーブリックが重い仕事を担う。曖昧な受け入れ基準は曖昧な判定を生むため、すでに精密な仕様を書くチームに向く。
- ホスト型の選択肢がない。どのブラウザからでも開ける管理されたワークスペースが欲しいなら、これはそうではない。
よくある質問
AgentLoopはコーディングエージェントをオーケストレーションするローカルdaemonだ。プランナーとコーディングエージェントの間で手動でメッセージを中継するのをやめたいか。それこそが引き受ける仕事である。範囲を限定した目標を新しいCodexまたはClaude Codeワーカーへ送り、独立した批評役にルーブリックに照らして各結果を検討させ、作業が自分の基準を満たすまでサイクルを繰り返す。
関連コンテンツ
AgentLoopに関連するツール、スキル、記事を探す。
AgentLoopの代替ツール
Forefront
Forefront · コーディングForefrontはオープンソースAIで構築するためのウェブプラットフォームだ。主要なオープンソース言語モデルを自分のデータで微調整し、性能を評価し、API経由で実行したり、エクスポートして自分でホストしたりできる。クローズドなプラットフォームの手軽さを求めつつ、モデルとデータの所有権にはこだわる開発者が対象だ。
Startkit
StartKit.AI · コーディングStartkitは、AI SaaSとAIラッパー製品を作るためのボイラープレートだ。面倒な部分をあらかじめ配線済みにしたAIスタートアップボイラープレートと考えればいい。認証、StripeとLemon Squeezyの決済、利用制限、トランザクションメール、そしてOpenAI、Anthropic、Groq、Llamaと通信するAI APIスターターキットが含まれる。リポジトリをクローンして価格を設定し、ユーザーが実際にお金を払う部分に取りかかれる。ReactとTailwind上のNext.jsで作られているため、ボイラープレートコードの多くはすでに見慣れたものだ。
Testim
Tricentis · コーディングTestimは、Web・モバイル・Salesforceアプリ向けにエンドツーエンドテストを構築して実行するAIテスト自動化プラットフォームだ。機械学習を頼りに、インターフェースが変わってもテストを安定させ、チームが壊れたセレクターの修正に費やす時間を減らす。今日から使い始められる自動テストツールとしては悪くない。ブラウザで操作を録画してテストを作り、より細かい制御が必要なときはJavaScriptを足す。忙しいQAチームにとって堅実な選択肢である。
