
Timmy-TUI
woodman33 · Coding
Timmy-TUI (Markenname TIMMY) ist eine Open-Source-Terminal-Oberfläche und eine Steuerzentrale für die Arbeit von KI-Agenten. Er zeichnet jeden Lauf als signierten, hash-verketteten Beleg auf, sodass du siehst, was ein Agent getan hat, was es gekostet hat und was dabei herausgekommen ist. Das Replay funktioniert allein aus dem Beleg. Er läuft lokal auf Node.js und spricht mit den Frontier-Modellen von OpenRouter oder mit den kostenlosen lokalen Ollama-Modellen, wenn du keine Tokens bezahlen willst.

Über Timmy-TUI
Was ist Timmy-TUI
Timmy-TUI ist ein lokaler Flugschreiber für KI-Agenten, verpackt als Terminal-Benutzeroberfläche, die du auf deiner eigenen Maschine startest. Seine Aufgabe ist Rechenschaft. Agenten bearbeiten Dateien, führen Befehle aus und rufen Modelle auf. Normalerweise glaubst du ihnen, was passiert ist. TIMMY versiegelt stattdessen für jeden Lauf einen Beleg: was gelaufen ist, wo, wie lange es gedauert hat, was es gekostet hat und welche Artefakte entstanden sind.
Die Belege sind mit sha256 hash-verkettet und mit ed25519 signiert, das heißt, jeder Eintrag verweist auf den vorherigen. Ändere einen Eintrag, und die Kette bricht. Genau darum geht es. "Trust the receipt, not the model" ist der eigene Satz des Projekts, und er fasst das Design zusammen. Wenn du schon erlebt hast, wie ein Agent Erfolg behauptet und dabei leise von seiner Umgebung abweicht, ist das hier für dich gedacht.
Die wichtigste Grenze ist die Zielgruppe. Timmy-TUI ist ein Entwicklerwerkzeug, das in einem Terminal auf Node.js lebt. Es gibt kein Browser-Dashboard für nicht-technische Nutzer und keine Mobile-App. Manche Spuren, die mitgeliefert werden, etwa die 3D-Pipelines für Blender oder Unreal, setzen voraus, dass diese Werkzeuge bereits installiert sind.
Erste Schritte
- Klone das Repo mit
git clone https://github.com/woodman33/timmy-tui.gitund führe dannnpm installim Ordner aus.
- Kopiere
.env.examplenach.envund ergänze einenOPENROUTER_API_KEY, wenn du Frontier-Modelle willst. Überspringst du das, greift TIMMY kostenlos auf lokale Ollama-Modelle zurück.
- Starte die TUI mit
npm start. DrückeTabfür den Tab-Wechsel,?für die Tasten-Grammatik undCtrl+Kfür die Befehlspalette.
- Führe
timmy demoaus, um deinen ersten Beleg unter.timmy/receipts/demo-receipt.jsonzu versiegeln, odertimmy proof "create a hello world worker", um einen vollständigen Proof-Lauf-Ordner mit Replay-Datei zu erzeugen.
- Richte jeden MCP-sprechenden Agenten mit
timmy mcp serveauf den eingebauten Server, um seine Tool-Aufrufe aufzuzeichnen.
Produktinformationen
Ein kurzer Überblick über Preise, unterstützte Plattformen und die Leistung von Timmy-TUI.
Am besten für
Die Nutzer, Aufgaben und Szenarien, für die dieses Tool am besten passt.
Nutzer
- Entwickler, die Agenten in Produktionsskripten laufen lassen
- Teams, die Modellausgaben prüfen müssen
- Alle, die bei Frontier-Modellrechnungen für leichte Aufgaben vorsichtig sind
- Ingenieure, die ohnehin im Terminal leben
Aufgaben
- Einen fehlgeschlagenen Agentenlauf nachspielen
- Prüfen, ob ein Lauf wirklich erfolgreich war
- Einen Prompt über mehrere Modelle verteilen
- Tool-Aufrufe in einen bestehenden Agenten aufzeichnen
Szenarien
- Einen Agenten debuggen, der um 2 Uhr nachts eine kaputte Datei erzeugt hat
- Arbeit an eine Kollegin übergeben
- Kosten über eine Woche Agenten-Experimente verfolgen
- Ein Modell erwischen, das sich leise geändert hat
Wichtigste Funktionen
Signierte, hash-verkettete Belege
Jeder Lauf versiegelt zu einem Beleg mit sha256-Hash-Verkettung und einer ed25519-Signatur. Er speichert Prompt- und Antwort-Hashes, Token-Verbrauch, Kosten, Latenz und eine Fehlerklasse. Auch fehlgeschlagene und abgelehnte Läufe werden versiegelt, sodass die Lücken in einem Protokoll nicht stumm bleiben. Dieses letzte Detail zählt. Die meisten Logging-Werkzeuge halten nur die Erfolge fest, also genau dann, wenn du die Historie am wenigsten brauchst.
Umgebungssperre und ehrliches Replay
TIMMY bindet Betriebssystem, Architektur und Tool-Build-Hashes an jeden Beleg. Beim Replay weigert er sich, eine abgedriftete Maschine für die auszugeben, die den Lauf erzeugt hat. Ein Replay passt also entweder zur Umgebung oder sagt dir, dass es nicht passt. Das Replay liest allein aus dem Manifest, während EDL-Schnittlisten die Clips zu einem portablen .agentrun-Bundle zusammensetzen, das Änderungen, Hashes und Belege mit OTIO-Austausch für Werkzeuge trägt, die dieses Format sprechen.
Kommandoposten und Delegation
Der Kommandoposten nimmt einen typisierten DispatchPlan, mit CUE validiert, und führt ihn durch einen Lebenszyklus. Operator-Tokens binden an den vollständigen Plan-Hash, sodass die Freigabe einmalig und ablaufend ist. Bezahlte Routen verweigern standardmäßig ohne Ausgabengrenze, was verhindert, dass ein Agent leise eine Rechnung hochtreibt. Es ist ein Schutzgeländer, das du einmal einstellst und vergisst.
Ausführungsspuren
TIMMY steuert Agenten über mehrere Ausführungsspuren, jede für eine andere Art von Arbeit gebaut. Dazu gehören OpenHands im Modus Wegwerf-Sandbox-oder-nichts, OpenCode, Pi und jcode. Es gibt 3D-Spuren für Blender, Godot, Unity, Unreal und Houdini sowie schlüsselgeschützte API-Spuren. Terminal-Multiplexing mit tmux, zellij und rmux lässt dich mehrere Läufe gleichzeitig beobachten.
Judge-Schleifen
Für sicherere Antworten verteilen Judge-Schleifen einen Prompt lokal über mehrere Modelle und eskalieren erst zu einem Frontier-Modell, wenn die Sicherheit eine Schwelle überschreitet. Jede Schleife versiegelt sowohl die Kind- als auch die Eltern-Belege, sodass du nachverfolgen kannst, wie eine endgültige Antwort zustande kam, statt nur den Endpunkt zu sehen.
MCP-Server und Begleitdienste
Der mitgelieferte MCP-Server stellt jedem MCP-sprechenden Agenten 24 Tools bereit, mit einer Client-Exec-Brücke und einer OpenAPI-Invoker-Spur, die einen bestehenden Agenten Arbeit abgeben lässt, ohne seine eigene Tool-Schicht neu zu bauen. Begleitdienste ergänzen einen Browser-Chat-Spiegel auf Port 3001, einen Beleg-Browser und eine Dispatch-Übersicht auf 4310 sowie eine Mission Map auf 4321. So hat die Terminalarbeit eine visuelle Ebene, wenn du eine willst.
Vor- und Nachteile
Vorteile
- Belege sind signiert und hash-verkettet, sodass Manipulation am Protokoll erkennbar ist statt stumm zu bleiben.
- Läuft vollständig lokal auf Node.js, was die Agentendaten auf deiner eigenen Maschine hält.
- Kostenlose lokale Ollama-Modelle lassen dich für $0 arbeiten, wenn Frontier-Zugang nicht verfügbar oder nicht gewünscht ist.
- Die Umgebungssperre macht Replay ehrlich über Drift, statt irreführende Ergebnisse zu liefern.
- Der MCP-Server wickelt bestehende Agenten ein, ohne einen Neuschrieb zu erzwingen.
- Open Source unter MIT-Lizenz, sodass du den Code lesen und ändern kannst.
Nachteile
- Es ist eine Terminal-Oberfläche, wer außerhalb eines Entwickler-Workflows steht, findet die Bedienung mühsam.
- Die Funktionsliste ist dicht. Belege, Dispatch-Pläne und Judge-Schleifen brauchen Lernzeit, bevor der Nutzen sichtbar wird.
- Manche 3D- und API-Spuren brauchen das externe Werkzeug oder den Schlüssel bereits eingerichtet, sind also nicht plug-and-play.
- Belege decken nur ab, was durch TIMMY läuft. Ein Agent, der ihn nie berührt, hinterlässt keine Aufzeichnung.
Häufige Fragen
Timmy-TUI ist ein Flugschreiber für KI-Agenten. Er zeichnet Läufe als signierte, hash-verkettete Belege auf und erfasst, was ausgeführt wurde, in welcher Umgebung, wie lange es dauerte und was es kostete. Das Agenten-Replay funktioniert dann allein aus dem Beleg. Am besten beschreibt man es als Flugschreiber und Steuerzentrale für Agentenaktivität.
Ähnliche Inhalte
Entdecke passende Tools, Skills und Artikel zu Timmy-TUI.
Alternativen zu Timmy-TUI
Forefront
Forefront · CodingForefront ist eine Webplattform zum Bauen mit Open-Source-KI. Sie lassen sich führende Open-Source-Sprachmodelle mit eigenen Daten feintunen, ihre Leistung bewerten und sie über eine API ausführen oder exportieren, um sie selbst zu hosten. Entwickler, die den Komfort einer geschlossenen Plattform wollen, aber darauf bestehen, ihre Modelle und Daten zu besitzen, sind hier die Zielgruppe.
Startkit
StartKit.AI · CodingStartkit ist ein Boilerplate zum Bauen von KI-SaaS-Produkten und KI-Wrappern. Man kann es sich als KI-Startup-Boilerplate vorstellen, bei dem die langweiligen Teile schon verdrahtet sind: Authentifizierung, Zahlungen über Stripe und Lemon Squeezy, Nutzungslimits, transaktionale E-Mail und ein KI-API-Starter-Kit, das mit OpenAI, Anthropic, Groq oder Llama spricht. Man klont das Repository, setzt seinen Preis und kümmert sich um den Teil des Produkts, für den Menschen wirklich bezahlen. Es basiert auf Next.js über React und Tailwind, deshalb fühlt sich ein Großteil des Boilerplate-Codes schon vertraut an.
Testim
Tricentis · CodingTestim ist eine KI-gestützte Plattform für Testautomatisierung, mit der man End-to-End-Tests für Web-, Mobile- und Salesforce-Anwendungen baut und ausführt. Sie setzt auf maschinelles Lernen, um Tests stabil zu halten, wenn sich eine Oberfläche ändert, sodass Teams weniger Zeit mit der Reparatur kaputter Selektoren verbringen. Nicht schlecht für ein Tool für automatisierte Tests, das Sie heute schon nutzen können. Sie erstellen Tests, indem Sie Aktionen im Browser aufzeichnen, und fügen danach JavaScript hinzu, wenn Sie mehr Kontrolle brauchen. Für ein beschäftigtes QA-Team eine solide Wahl.
