
Timmy-TUI
woodman33 · Programación
Timmy-TUI (con la marca TIMMY) es una interfaz de terminal de código abierto y un plano de control para el trabajo de agentes de IA. Registra cada ejecución como un recibo firmado y encadenado por hash, para que veas qué hizo un agente, cuánto costó y qué produjo. La reproducción funciona solo con el recibo. Se ejecuta en local sobre Node.js y se conecta a los modelos de frontera de OpenRouter o a los modelos gratuitos de Ollama en local cuando no quieres pagar por tokens.

Acerca de Timmy-TUI
Qué es Timmy-TUI
Timmy-TUI es una caja negra local para agentes de IA, empaquetada como una interfaz de usuario de terminal que ejecutas en tu propia máquina. Su trabajo es la rendición de cuentas. Los agentes editan archivos, ejecutan comandos y llaman a modelos. Normalmente les crees lo que dicen que pasó. TIMMY, en cambio, sella un recibo por cada ejecución: qué se ejecutó, dónde, cuánto tardó, cuánto costó y qué artefactos produjo.
Los recibos están encadenados por hash sha256 y firmados con ed25519, lo que significa que cada registro se enlaza con el anterior. Cambia una entrada y la cadena se rompe. De eso se trata. "Confía en el recibo, no en el modelo" es la propia frase del proyecto, y resume el diseño. Si alguna vez has visto a un agente afirmar que tuvo éxito mientras se alejaba en silencio de su entorno, esto está pensado para ti.
El límite principal es el público. Timmy-TUI es una herramienta para desarrolladores que vive en un terminal sobre Node.js. No hay panel en el navegador para usuarios no técnicos, ni app para el móvil. Algunos caminos que incluye, como los flujos 3D para Blender o Unreal, dan por hecho que ya tienes esas herramientas instaladas.
Primeros pasos
- Clona el repositorio con
git clone https://github.com/woodman33/timmy-tui.gity luego ejecutanpm installdentro de la carpeta.
- Copia
.env.examplea.envy añade unaOPENROUTER_API_KEYsi quieres modelos de frontera. Sáltate este paso y TIMMY recurre a los modelos locales de Ollama sin coste.
- Lanza la TUI con
npm start. PulsaTabpara cambiar de pestaña,?para la gramática de teclas yCtrl+Kpara la paleta de comandos.
- Ejecuta
timmy demopara sellar tu primer recibo en.timmy/receipts/demo-receipt.json, otimmy proof "create a hello world worker"para generar una carpeta completa de ejecución de prueba con un archivo de reproducción.
- Apunta cualquier agente que hable MCP al servidor integrado con
timmy mcp servepara empezar a grabar sus llamadas a herramientas.
Información del producto
Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de Timmy-TUI.
Ideal para
Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.
Usuarios
- Desarrolladores que ejecutan agentes en scripts de producción
- Equipos que necesitan auditar el gasto en modelos
- Cualquiera receloso de las facturas de modelos de frontera para tareas ligeras
- Ingenieros que ya viven en un terminal
Tareas
- Reproducir una ejecución fallida de un agente
- Verificar que una ejecución tuvo éxito de verdad
- Repartir un prompt entre varios modelos
- Registrar llamadas a herramientas dentro de un agente que ya existe
Casos de uso
- Depurar un agente que produjo un archivo roto a las 2 de la mañana
- Pasar el trabajo a un compañero
- Seguir los costes a lo largo de una semana de experimentos con agentes
- Detectar un modelo que cambió en silencio
Funciones clave
Recibos firmados y encadenados por hash
Cada ejecución se sella en un recibo con encadenamiento por hash sha256 y una firma ed25519. Guarda los hashes del prompt y de la respuesta, el uso de tokens, el coste, la latencia y una clase de error. Las ejecuciones fallidas y las denegadas también se sellan, así que los huecos de un registro no son silenciosos. Ese último detalle importa. Casi todas las herramientas de registro solo anotan los éxitos, que es justo cuando menos necesitas el historial.
Bloqueo de entorno y reproducción honesta
TIMMY vincula el sistema operativo, la arquitectura y los hashes de compilación de las herramientas a cada recibo. Cuando reproduces, se niega a fingir que una máquina que se ha desviado es la misma que produjo la ejecución. Así que una reproducción o coincide con el entorno o te dice que no. La reproducción lee solo del manifiesto, mientras que las listas de corte EDL reensamblan los clips en un paquete portátil .agentrun que lleva las ediciones, los hashes y los recibos con intercambio OTIO para las herramientas que hablan ese formato.
Puesto de mando y delegación
El Puesto de mando toma un DispatchPlan tipado, validado con CUE, y lo ejecuta a través de un ciclo de vida. Los tokens de operador se vinculan al hash completo del plan, así que la aprobación es de un solo uso y caduca. Las rutas de pago se deniegan por defecto sin un límite de gasto, lo que evita que un agente suba una factura sin avisar. Es una barandilla que configuras una vez y olvidas.
Caminos de ejecución
TIMMY dirige agentes a través de varios caminos de ejecución, cada uno pensado para un tipo de trabajo distinto. Entre ellos están OpenHands en modo sandbox desechable o nada, OpenCode, Pi y jcode. Hay caminos 3D para Blender, Godot, Unity, Unreal y Houdini, además de caminos de API protegidos por clave. La multiplexación de terminal con tmux, zellij y rmux te deja ver varias ejecuciones a la vez.
Bucles de juez
Para respuestas con más confianza, los bucles de juez reparten un prompt entre varios modelos en local y luego escalan a un modelo de frontera solo cuando la confianza cruza un umbral. Cada bucle sella tanto los recibos hijos como el padre, así que puedes rastrear cómo se llegó a una respuesta final en vez de ver solo el punto de llegada.
Servidor MCP y servicios complementarios
El servidor MCP integrado expone 24 herramientas a cualquier agente que hable MCP, con un puente de ejecución de cliente y un camino de invocación OpenAPI que deja a un agente existente delegar trabajo sin reconstruir su propia capa de herramientas. Los servicios complementarios añaden un espejo de chat en el navegador en el puerto 3001, un navegador de recibos y una encuesta de despacho en el 4310, y un Mission Map en el 4321. Así el trabajo en el terminal tiene una capa visual cuando la quieres.
Ventajas y desventajas
Ventajas
- Los recibos están firmados y encadenados por hash, así que manipular el registro se detecta en vez de pasar en silencio.
- Se ejecuta por completo en local sobre Node.js, lo que mantiene los datos del agente en tu propia máquina.
- Los modelos locales gratuitos de Ollama hacen que puedas trabajar a $0 cuando el acceso de frontera no está disponible o no lo quieres.
- El bloqueo de entorno hace que la reproducción sea honesta sobre el desvío en vez de dar resultados engañosos.
- El servidor MCP envuelve agentes existentes sin obligar a reescribirlos.
- Código abierto bajo licencia MIT, así que puedes leer y cambiar el código.
Desventajas
- Es una interfaz de terminal, así que a quien esté fuera de un flujo de desarrollo le costará moverse por ella.
- La lista de funciones es densa. Los recibos, los planes de despacho y los bucles de juez llevan tiempo de aprendizaje antes de que se note el fruto.
- Algunos caminos 3D y de API necesitan la herramienta externa o la clave ya configurada, así que no son plug-and-play.
- Los recibos solo cubren lo que pasa por TIMMY. Un agente que nunca lo toca no deja registro.
Preguntas frecuentes
Timmy-TUI es una caja negra para agentes de IA. Registra las ejecuciones como recibos firmados y encadenados por hash, capturando qué se ejecutó, en qué entorno, cuánto tardó y cuánto costó. La reproducción del agente funciona luego solo con el recibo. La mejor forma de describirlo es caja negra y plano de control para la actividad de agentes.
Contenido relacionado
Explora herramientas, habilidades y artículos relacionados con Timmy-TUI.
Alternativas a Timmy-TUI
Forefront
Forefront · ProgramaciónForefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.
Startkit
StartKit.AI · ProgramaciónStartkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.
Testim
Tricentis · ProgramaciónTestim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.
