
Buildermark
Gelatinous Development · 코딩
Buildermark는 코드베이스의 얼마만큼이 AI 코딩 에이전트로 생성되었는지 추적하고 분석하는 오픈소스 로컬 우선 측정 도구다. 코딩 에이전트 로그와 git 커밋을 맞춰 모든 줄을 귀속시키고, 커밋하는 순간 결과를 보여준다. 모든 것이 자신의 컴퓨터에서 돌아가며 계정도 클라우드 동기화도 없다.

Buildermark 소개
Buildermark란 무엇인가
Buildermark는 대부분의 팀이 소리 내어 묻기를 그만둔 질문에 답한다. 이 코드 중 얼마나를 에이전트가 실제로 작성했는가. 한 가지 일만 하는 AI 코딩 에이전트 추적 도구라고 생각하면 된다. 이 AI 코드 귀속 도구는 코딩 에이전트 대화의 변경 사항을 git 커밋의 변경 사항과 맞춰, 각 커밋에서 에이전트가 만들어낸 정확한 비율을 알려준다. 에이전트 훅도 필요 없다. 수동 태깅도 없다.
매력은 방해하지 않는다는 점이다. 로컬 앱 컨테이너가 localhost:55022에서 Go 서버를 돌리고 자신의 컴퓨터에서 웹 UI를 제공한다. 데이터는 컴퓨터를 벗어나지 않는다. 사설 저장소나 엄격한 규정 준수 아래에서 일한다면 이 점이 중요하다. 로컬 우선 개발자 도구로서 그게 핵심이다. Buildermark는 직접 읽고 감사할 수 있는 오픈소스 코드 분석이며, MIT 라이선스로 공개된다.
솔직히 말해야 할 제약은 범위다. 데스크톱 앱은 macOS 15나 Windows 10이 필요하고, Linux 사용자는 CLI만 받는다. 이 수치를 조직 전체로 집계할 Team Server는 아직 대기 명단에 있고 출시되지 않았다. 팀 간 대시보드가 지금 필요한 사람에게 Buildermark는 아직 거기까지 가지 못했다. 조직 뷰는 없다. 아직은.
시작하기
- macOS나 Windows용 데스크톱 앱을 내려받거나 Linux CLI를 설치한다.
- Buildermark가 에이전트 대화를 자동으로 가져오게 하고, VM이나 컨테이너에서 기록을 끌어온다면 공유 폴더 경로를 추가한다.
- 맞춰볼 커밋이 있도록 git 기록을 불러오게 한다.
- 커밋별 에이전트 귀속 비율을 확인하거나, localhost:55022의 웹 UI를 열어 더 자세한 내역을 본다.
- 원한다면 에이전트 대화를 직접 평가하거나, /rate-buildermark 스킬로 에이전트가 스스로 비평을 기록하게 한다.
제품 정보
Buildermark의 요금, 지원 플랫폼, 성능을 한눈에 확인해 보세요.
추천 대상
이 도구가 가장 잘 맞는 사용자, 작업, 상황입니다.
사용자
- 여러 코딩 에이전트를 쓰면서 에이전트가 코드를 얼마나 작성했는지 명확한 답을 원하는 개인 개발자
- AI 코딩 에이전트 도입이 실제 결과를 바꾸는지 평가하는 엔지니어링 리드
- 소스 기록을 제3자 클라우드로 보낼 수 없는, 프라이버시에 민감한 팀
작업
- 저장소에서 에이전트 귀속 측정
- 자체 코드베이스로 에이전트 비교 평가
- 코딩 에이전트 대화 보관
- 에이전트 출력 평가
활용 상황
- AI 코딩 예산을 감이 아니라 숫자로 정당화하거나 의문을 제기하려 할 때
- 호스팅형 분석 서비스를 쓸 수 없는 사설 코드베이스에서 일할 때
- 팀을 하나로 정하기 전에 같은 프로젝트에서 두 에이전트를 비교할 때
주요 기능
커밋별 에이전트 귀속
Buildermark는 코딩 에이전트 변경 사항을 커밋과 맞추고 각 줄을 에이전트나 사람에게 귀속시킨다. 커밋 중 에이전트가 작성한 정확한 비율을 얻으며, 에이전트 훅이나 수동 태깅에 의존하지 않는다. 포맷에 구애받지 않는 매처는 자동 포매터와 재정렬, 줄 바꿈 잡음에도 견딘다.
대화 평가
에이전트 대화를 직접 평가하거나, /rate-buildermark 스킬로 에이전트가 스스로 비평을 기록하게 할 수 있다. 이는 원시 채팅 기록을 세션과 에이전트를 넘나들며 비교할 수 있는 신호로 바꾼다.
에이전트 비교 평가
이 도구는 각 에이전트가 실제 코드베이스에 얼마나 기여했는지 아니까, Claude, Codex, Gemini, Cursor가 자신의 실작업에서 어떻게 하는지 비교할 수 있다. 코드가 자신의 것이기에 합성 벤치마크보다 쓸모 있다.
로컬 우선 데이터 처리
데이터는 컴퓨터를 벗어나지 않는다. 분석도 텔레메트리도 없고, 앱은 전적으로 localhost:55022에서 돌며, 유일한 외부 요청은 업데이트 확인이다. Buildermark는 MIT 라이선스이므로 이 주장은 약속이 아니라 검증 가능하다.
대화와 커밋 자동 가져오기
Claude Code, Codex, Gemini 등 여러 에이전트의 대화가 자동으로 가져와지고, VM과 컨테이너에서 끌어오도록 공유 폴더 경로를 추가할 수 있다. git 기록은 스스로 불러오고, 변경 사항 맞추기는 그 뒤에 실행된다.
네이티브 알림
귀속 정보는 커밋하는 순간 알림 센터에 나타나므로, 대시보드를 열지 않고도 커밋별 에이전트 비율을 본다. macOS, Windows, Linux에서 작동한다.
클라우드 에이전트용 브라우저 확장 기능
Chrome, Firefox, Safari 확장 기능은 Claude Code Cloud와 Codex Cloud 같은 클라우드 기반 에이전트에서 대화를 가져온다. 각 대화 페이지를 클릭해 몇 초 기다리면 확장 기능이 가져오기를 확인한다.
장단점
장점
- localhost:55022에서 완전히 로컬로 돌아가므로 사설 저장소는 사설로 남는다
- MIT 라이선스 오픈소스라 프라이버시 주장을 감사할 수 있다
- 포맷에 구애받지 않는 변경 사항 맞추기는 자동 포매터와 옮겨진 코드에도 견딘다
- 주요 에이전트를 한곳에서 다룬다: Claude Code, Codex, Gemini, Cursor
- 네이티브 알림이 별도 대시보드 없이 귀속 정보를 눈앞에 보여준다
단점
- 데스크톱 앱은 macOS 15+와 Windows 10+ 전용이라 Linux 사용자는 GUI 없는 CLI만 받는다
- 조직 전체 집계용 Team Server는 아직 대기 명단에 있어 팀 간 뷰가 아직 없다
- 공개 API가 없어 그 위에 맞춤 보고를 만드는 데 한계가 있다
- 클라우드 에이전트 대화는 스스로 동기화되지 않고 브라우저 확장 기능 클릭이 필요하다
자주 묻는 질문
코드의 얼마만큼이 AI 코딩 에이전트로 작성되었는지 측정한다. 목표는 단순하다. AI 생성 코드를 측정해 비율로 바꾸는 것이다. 에이전트 대화의 변경 사항을 git 커밋 변경 사항에 맞춰 커밋별 비율을 알려준다.
관련 콘텐츠
Buildermark와 관련된 도구, 스킬, 아티클을 살펴보세요.
Buildermark 대안
Forefront
Forefront · 코딩Forefront는 오픈소스 AI로 무언가를 만드는 웹 플랫폼이다. 대표적인 오픈소스 언어 모델을 자신의 데이터로 미세 조정하고, 성능을 평가하고, API로 실행하거나 내보내 직접 호스팅할 수 있다. 폐쇄형 플랫폼의 편의를 원하면서도 모델과 데이터의 소유권은 놓지 않으려는 개발자가 대상이다.
Startkit
StartKit.AI · 코딩Startkit은 AI SaaS와 AI 래퍼 제품을 만들기 위한 보일러플레이트다. 지루한 부분을 미리 연결해 둔 AI 스타트업 보일러플레이트라고 생각하면 된다. 인증, Stripe와 Lemon Squeezy 결제, 사용량 제한, 트랜잭션 이메일, 그리고 OpenAI, Anthropic, Groq, Llama와 통신하는 AI API 스타터 키트가 포함된다. 저장소를 복제하고 가격을 정한 뒤 사용자가 실제로 돈을 내는 부분에 착수하면 된다. React와 Tailwind 위의 Next.js로 만들어졌기 때문에 보일러플레이트 코드의 상당 부분이 이미 익숙하게 느껴진다.
Testim
Tricentis · 코딩Testim은 웹, 모바일, Salesforce 애플리케이션 전반에 걸쳐 엔드투엔드 테스트를 만들고 실행하는 AI 기반 테스트 자동화 플랫폼이다. 머신러닝에 기대어 인터페이스가 바뀌어도 테스트를 안정적으로 유지하므로, 팀은 깨진 셀렉터를 고치는 데 쓰는 시간을 줄인다. 오늘부터 쓸 수 있는 자동화 테스트 도구치고 나쁘지 않다. 브라우저에서 동작을 녹화해 테스트를 만들고, 더 세밀한 제어가 필요하면 JavaScript를 더한다. 바쁜 QA 팀에게 탄탄한 선택이다.
