
Buildermark
Gelatinous Development · Programación
Buildermark es una herramienta de medición de código abierto y local-first que rastrea y analiza cuánto de tu base de código generan los agentes de programación con IA. Cruza los registros de tu agente de programación con los commits de git para atribuir cada línea y te muestra el resultado en el momento en que haces el commit. Todo corre en tu propia máquina, sin cuentas y sin sincronización en la nube.

Acerca de Buildermark
Qué es Buildermark
Buildermark responde a una pregunta que la mayoría de los equipos ha dejado de hacer en voz alta: ¿cuánto de este código lo escribió realmente un agente? Digamos que es un rastreador de agentes de programación con IA con una sola tarea. La herramienta de atribución de código con IA cruza los diffs de tus conversaciones con el agente de programación contra los diffs de tus commits de git, y luego reporta el porcentaje exacto de cada commit que provino de un agente. Sin hooks de agente. Sin etiquetado manual.
Su atractivo es que no se interpone en tu camino. Un contenedor de app local ejecuta un servidor en Go en localhost:55022 y sirve una interfaz web en tu máquina. Tus datos nunca salen de tu ordenador, algo que importa si trabajas con repos privados o bajo reglas estrictas de cumplimiento. Como herramienta para desarrolladores local-first, de eso se trata. Buildermark es analítica de código de código abierto que puedes leer y auditar tú mismo, publicada bajo la licencia MIT.
La limitación honesta es el alcance. La app de escritorio necesita macOS 15 o Windows 10, y los usuarios de Linux solo obtienen una CLI. El Team Server que sumaría estos números en toda una organización sigue en lista de espera, sin lanzarse. Si necesitas paneles entre equipos hoy, Buildermark aún no está ahí. Sin vista de organización. Todavía no.
Primeros pasos
- Descarga la app de escritorio para macOS o Windows, o instala la CLI de Linux.
- Deja que Buildermark importe tus conversaciones con el agente de forma automática, agregando rutas de carpetas compartidas si traes historial desde máquinas virtuales o contenedores.
- Deja que cargue tu historial de git para tener commits con los que comparar.
- Revisa los porcentajes de atribución de agente por commit, o abre la interfaz web en localhost:55022 para un desglose más completo.
- De forma opcional, puntúa tú mismo las conversaciones con el agente, o deja que el agente registre su propia crítica con la habilidad /rate-buildermark.
Información del producto
Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de Buildermark.
Ideal para
Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.
Usuarios
- Desarrolladores independientes que usan varios agentes de programación y quieren una respuesta clara sobre cuánto código escribieron los agentes
- Líderes de ingeniería que evalúan si adoptar agentes de programación con IA está cambiando de verdad el trabajo producido
- Equipos celosos de su privacidad que no pueden enviar el historial de código a una nube de terceros
Tareas
- Medir la atribución de agentes en un repositorio
- Comparar agentes contra tu propia base de código
- Archivar conversaciones con agentes de programación
- Puntuar la salida de los agentes
Casos de uso
- Intentar justificar o cuestionar un presupuesto de programación con IA con números en lugar de corazonadas
- Trabajar en una base de código privada donde un servicio de analítica alojado no es una opción
- Comparar dos agentes en el mismo proyecto antes de comprometer a tu equipo con uno
Funciones clave
Atribución de agentes por commit
Buildermark cruza los diffs de tu agente de programación con los commits y atribuye cada línea a un agente o a una persona. Obtienes el porcentaje exacto de un commit escrito por un agente, sin depender de hooks de agente y sin etiquetado manual. El comparador agnóstico al formato resiste formateadores automáticos, reordenamientos y ruido en los finales de línea.
Puntuación de conversaciones
Puedes puntuar las conversaciones con el agente a mano, o dejar que el agente registre su propia crítica mediante la habilidad /rate-buildermark. Eso convierte un historial de chat en bruto en una señal que puedes comparar entre sesiones y agentes.
Comparación de agentes
Como la herramienta sabe cuánto aportó cada agente a tu base de código real, puede comparar cómo rinden Claude, Codex, Gemini y Cursor en tu trabajo real. Eso sirve más que un benchmark sintético, porque el código es tuyo.
Manejo de datos local-first
Tus datos nunca salen de tu máquina. Hay cero analítica y cero telemetría, la app corre por completo en localhost:55022 y la única petición saliente es una comprobación de actualizaciones. Buildermark tiene licencia MIT, así que la afirmación se puede verificar en lugar de ser una promesa.
Importación automática de conversaciones y commits
Las conversaciones de Claude Code, Codex, Gemini y otros agentes se importan de forma automática, y puedes agregar rutas de carpetas compartidas para traer datos desde máquinas virtuales y contenedores. El historial de git se carga solo, y la comparación de diffs se ejecuta después.
Notificaciones nativas
La atribución aparece en tu centro de notificaciones en el momento en que haces el commit, así ves el porcentaje del agente para cada commit sin abrir un panel. Funciona en macOS, Windows y Linux.
Extensiones de navegador para agentes en la nube
Las extensiones para Chrome, Firefox y Safari importan conversaciones de agentes basados en la nube como Claude Code Cloud y Codex Cloud. Haces clic en la página de cada conversación, esperas unos segundos y la extensión confirma la importación.
Ventajas y desventajas
Ventajas
- Corre totalmente en local en localhost:55022, así los repos privados siguen siendo privados
- Licencia MIT y código abierto, lo que hace auditables las afirmaciones de privacidad
- La comparación de diffs agnóstica al formato sobrevive a formateadores automáticos y código movido
- Cubre los agentes principales en un solo lugar: Claude Code, Codex, Gemini y Cursor
- Las notificaciones nativas te ponen la atribución delante sin un panel aparte
Desventajas
- La app de escritorio solo funciona en macOS 15+ y Windows 10+, así que los usuarios de Linux obtienen una CLI sin interfaz gráfica
- El Team Server para agregados de toda la organización sigue en lista de espera, así que todavía no hay vista entre equipos
- No hay API pública, lo que limita crear informes personalizados encima
- Las conversaciones de agentes en la nube necesitan un clic en una extensión de navegador en lugar de sincronizarse solas
Preguntas frecuentes
Mide cuánto de tu código fue escrito por agentes de programación con IA. El objetivo es simple: medir el código generado por IA y convertirlo en un porcentaje. Cruza los diffs de las conversaciones con el agente contra los diffs de tus commits de git y reporta un porcentaje por commit.
Contenido relacionado
Explora herramientas, habilidades y artículos relacionados con Buildermark.
Alternativas a Buildermark
Forefront
Forefront · ProgramaciónForefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.
Startkit
StartKit.AI · ProgramaciónStartkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.
Testim
Tricentis · ProgramaciónTestim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.
