
Buildermark
Gelatinous Development · コーディング
Buildermarkは、コードベースのどれだけがAIコーディングエージェントによって生成されたかを追跡・分析するオープンソースのローカルファースト計測ツールだ。コーディングエージェントのログとgitコミットを突き合わせてすべての行を帰属させ、コミットした瞬間に結果を表示する。すべて自分のマシン上で動き、アカウントもクラウド同期もない。

Buildermark について
Buildermarkとは
Buildermarkは、ほとんどのチームが声に出して尋ねるのをやめた問いに答える。このコードのうち、エージェントが実際に書いたのはどれくらいか。一つの仕事だけを担うAIコーディングエージェント追跡ツールだと考えればいい。このAIコード帰属ツールは、コーディングエージェントとの会話の差分をgitコミットの差分と突き合わせ、各コミットのうちエージェント由来の正確な割合を報告する。エージェントのフックは不要。手動のタグ付けも要らない。
魅力は、邪魔をしないことにある。ローカルのアプリコンテナがlocalhost:55022でGoサーバーを動かし、自分のマシン上でWeb UIを配信する。データが自分のコンピュータから出ることはない。プライベートリポジトリや厳しいコンプライアンス規則の下で働くなら、ここが重要だ。ローカルファースト開発ツールとしては、そこが要点そのものだ。Buildermarkは自分で読んで監査できるオープンソースのコード分析であり、MITライセンスで公開されている。
正直に言うべき制約は範囲だ。デスクトップアプリにはmacOS 15かWindows 10が必要で、LinuxユーザーはCLIしか使えない。これらの数値を組織全体で集計するTeam Serverはまだ順番待ちで、リリースされていない。チーム横断のダッシュボードが今すぐ必要な人にとって、Buildermarkはまだそこに届いていない。組織ビューはない。まだ。
はじめに
- macOSかWindowsのデスクトップアプリをダウンロードするか、LinuxのCLIをインストールする。
- Buildermarkにエージェントとの会話を自動でインポートさせる。VMやコンテナから履歴を取り込む場合は共有フォルダのパスを追加する。
- git履歴を読み込ませ、突き合わせるコミットを用意する。
- コミットごとのエージェント帰属率を確認するか、localhost:55022のWeb UIを開いてより詳しい内訳を見る。
- 任意で、エージェントとの会話を自分で評価するか、/rate-buildermarkスキルでエージェント自身に批評を記録させる。
AIツール情報
Buildermarkの料金、対応プラットフォーム、性能を簡単に確認できます。
こんな人におすすめ
このツールが最も力を発揮するユーザー、タスク、シーン。
ユーザー
- 複数のコーディングエージェントを使い、エージェントがどれだけコードを書いたか明確な答えを知りたい個人開発者
- AIコーディングエージェントの導入が実際に成果を変えているかを評価するエンジニアリングリード
- ソースコードの履歴を第三者のクラウドに送れない、プライバシーに敏感なチーム
タスク
- リポジトリ上でエージェント帰属を測る
- 自分のコードベースでエージェントを比較評価する
- コーディングエージェントとの会話を保存する
- エージェントの出力を評価する
シーン
- AIコーディングの予算を、感覚ではなく数字で正当化したり疑問視したりしたい
- ホスティング型の分析サービスが使えないプライベートなコードベースで作業する
- チームをどちらかに決める前に、同じプロジェクトで2つのエージェントを比較する
主な機能
コミットごとのエージェント帰属
Buildermarkはコーディングエージェントの差分をコミットに突き合わせ、各行をエージェントか人間かに帰属させる。コミットのうちエージェントが書いた正確な割合が得られ、エージェントのフックにも手動のタグ付けにも頼らない。フォーマットに依存しないマッチャーは、自動フォーマッタや並べ替え、行末のノイズにも耐える。
会話の評価
エージェントとの会話は手作業で評価できるし、/rate-buildermarkスキルでエージェント自身に批評を記録させることもできる。これで生のチャット履歴が、セッションやエージェントをまたいで比較できるシグナルに変わる。
エージェントの比較評価
ツールは各エージェントが実際のコードベースにどれだけ寄与したかを知っているので、Claude、Codex、Gemini、Cursorが自分の実作業でどう機能するかを比べられる。コードが自分のものだからこそ、合成ベンチマークより役に立つ。
ローカルファーストのデータ処理
データが自分のマシンから出ることはない。分析もテレメトリもゼロ、アプリは完全にlocalhost:55022で動き、外向きのリクエストは更新確認だけだ。BuildermarkはMITライセンスなので、この主張は約束ではなく検証できる。
会話とコミットの自動インポート
Claude Code、Codex、Geminiなどの会話は自動でインポートされ、VMやコンテナから取り込むための共有フォルダのパスも追加できる。git履歴は自動で読み込まれ、差分の突き合わせはその後で走る。
ネイティブ通知
帰属情報はコミットした瞬間に通知センターに現れるので、ダッシュボードを開かなくてもコミットごとのエージェント率が分かる。macOS、Windows、Linuxで動作する。
クラウドエージェント向けブラウザ拡張機能
Chrome、Firefox、Safariの拡張機能は、Claude Code CloudやCodex Cloudのようなクラウドベースのエージェントから会話をインポートする。各会話のページをクリックして数秒待つと、拡張機能がインポートを確認する。
メリットとデメリット
メリット
- localhost:55022で完全にローカル動作するので、プライベートリポジトリはプライベートのまま
- MITライセンスでオープンソースなので、プライバシーに関する主張を監査できる
- フォーマットに依存しない差分照合は、自動フォーマッタや移動したコードにも耐える
- 主要なエージェントを一か所で網羅する: Claude Code、Codex、Gemini、Cursor
- ネイティブ通知が別のダッシュボードなしで帰属情報を目の前に出す
デメリット
- デスクトップアプリはmacOS 15+とWindows 10+のみで、LinuxユーザーはGUIなしのCLIになる
- 組織全体の集計用Team Serverはまだ順番待ちで、チーム横断ビューはまだない
- 公開APIがなく、その上に独自のレポートを作るのが難しい
- クラウドエージェントの会話は自動同期ではなく、ブラウザ拡張機能でのクリック操作が必要
よくある質問
コードのどれだけがAIコーディングエージェントに書かれたかを測る。目的は単純だ。AI生成コードを測定し、割合に変換する。エージェントとの会話の差分をgitコミットの差分に突き合わせ、コミットごとの割合を報告する。
関連コンテンツ
Buildermarkに関連するツール、スキル、記事を探す。
Buildermarkの代替ツール
Forefront
Forefront · コーディングForefrontはオープンソースAIで構築するためのウェブプラットフォームだ。主要なオープンソース言語モデルを自分のデータで微調整し、性能を評価し、API経由で実行したり、エクスポートして自分でホストしたりできる。クローズドなプラットフォームの手軽さを求めつつ、モデルとデータの所有権にはこだわる開発者が対象だ。
Startkit
StartKit.AI · コーディングStartkitは、AI SaaSとAIラッパー製品を作るためのボイラープレートだ。面倒な部分をあらかじめ配線済みにしたAIスタートアップボイラープレートと考えればいい。認証、StripeとLemon Squeezyの決済、利用制限、トランザクションメール、そしてOpenAI、Anthropic、Groq、Llamaと通信するAI APIスターターキットが含まれる。リポジトリをクローンして価格を設定し、ユーザーが実際にお金を払う部分に取りかかれる。ReactとTailwind上のNext.jsで作られているため、ボイラープレートコードの多くはすでに見慣れたものだ。
Testim
Tricentis · コーディングTestimは、Web・モバイル・Salesforceアプリ向けにエンドツーエンドテストを構築して実行するAIテスト自動化プラットフォームだ。機械学習を頼りに、インターフェースが変わってもテストを安定させ、チームが壊れたセレクターの修正に費やす時間を減らす。今日から使い始められる自動テストツールとしては悪くない。ブラウザで操作を録画してテストを作り、より細かい制御が必要なときはJavaScriptを足す。忙しいQAチームにとって堅実な選択肢である。
