
SKI
SKI · Stimme & Sprache · Coding
SKI ist ein kostenloser Sprachassistent, der auf dem Gerät läuft und eine gesprochene Schleife in beide Richtungen zwischen dir und deinem KI-Coding-Agenten aufbaut. Sieh es als Sprachassistenten für KI-Coding-Agenten: Du sprichst das gewünschte Ergebnis aus, Tools wie Claude Code, Cursor, Codex, Gemini CLI und OpenClaw erledigen die Arbeit, und SKI liest das Ergebnis mit einer natürlichen Stimme zurück. Spracherkennung und Stimme laufen auf deiner eigenen Maschine, sodass Audio und Transkripte auf deiner Festplatte bleiben statt in irgendeiner Cloud. Coding per Stimme wird so zum Gespräch.

Über SKI
Was ist SKI
SKI ist ein Desktop-Widget für macOS, Windows und Linux, gebaut um eine Idee: Mit einem Coding-Agenten zu sprechen sollte sich wie ein Gespräch anfühlen, nicht wie Diktat. Statt Prompts zu tippen und Antworten zu lesen, beschreibst du laut, was du willst, und der Agent antwortet dir laut. Die App übernimmt die Spracherkennung am Eingang und erzeugt die gesprochene Antwort am Ausgang.
Der Reiz liegt bei Tempo und Datenschutz. Eine gesprochene Anfrage ist schneller als eine getippte, und die ganze Schleife läuft lokal, sodass dein Audio nie hochgeladen wird. SKI ist lebenslang kostenlos, und es arbeitet offline, sobald die lokalen Modelle eingerichtet sind. Für Entwickler mit RSI-Beschwerden, oder für alle, die es leid sind, zwischen Tastatur und Terminal zu wechseln, ist genau diese Kombination der Punkt. Sprich statt zu tippen.
Die Grenzen sollte man vorab kennen. Alles hängt von einem lokalen Sprachmodell und einer lokalen Stimme ab, die für guten Lauf ordentliche Hardware brauchen, und die Liste der unterstützten Agenten ist konkret. Steht dein Tool nicht darauf, kann SKI noch nicht helfen. Meeting-Transkription und automatischer Kalender-Beitritt bringen mehr bewegliche Teile ins Spiel, und genau diese Bereiche brauchen am ehesten Gefrickel.
Erste Schritte
- Lade den Installer von der offiziellen Seite herunter: ein DMG auf dem Mac, ein EXE unter Windows. Der Einrichtungsassistent führt dich durch die Auswahl von Mikrofon, Stimme und Hotkey, ohne Karte.
- Öffne deinen Coding-Agenten (Claude Code, Cursor, Codex oder einen anderen unterstützten) und tippe
skiin die Sitzung, um ihn mit dem Widget zu verbinden. - Warte, bis der Statuspunkt grün wird, was bestätigt, dass der Agent dich hören und zurückreden kann.
- Sprich deine Anfrage laut aus; deine Worte landen als Text im Agenten und er beginnt zu arbeiten.
- Wenn er fertig ist, antwortet er laut. Nutze die Hover-Bedienelemente, um das Mikrofon stumm zu schalten, auf reine Textantworten umzustellen oder deinem nächsten Satz einen Screenshot beizufügen.
Produktinformationen
Ein kurzer Überblick über Preise, unterstützte Plattformen und die Leistung von SKI.
Am besten für
Die Nutzer, Aufgaben und Szenarien, für die dieses Tool am besten passt.
Nutzer
- Entwickler, die schneller sprechen als tippen
- Programmierer mit RSI oder Handschmerzen
- Datenschutzbewusste Teams mit sensiblen Codebasen
Aufgaben
- Ein Feature beschreiben und den Agenten bauen lassen
- Änderungen freihändig durchsehen
- Meetings lokal transkribieren
Szenarien
- Mehrere Repos gleichzeitig fahren
- Einen Agenten am Standup teilnehmen lassen
- Offline oder in einem abgeschotteten Netz arbeiten
Wichtigste Funktionen
Sprache und Stimme komplett auf dem Gerät
Beide Hälften des Gesprächs laufen auf deinem Rechner: Spracherkennung hört zu, eine neuronale Stimme spricht. Nichts wird hochgeladen, weil es keine Cloud gibt, an die man es schicken könnte. Praktisch heißt das: dein Audio und deine Transkripte bleiben auf deiner Festplatte, und die lokale Spracherkennung hält die Schleife offline am Laufen. Wer privaten Code oder Kundendaten verarbeitet, verliert damit eine ganze Kategorie von Sorgen.
Ein echtes Gespräch, kein Diktat
Diktier-Tools hören beim Text auf. SKI schließt die Schleife, indem es die Antwort des Agenten laut ausspricht. Voll-Duplex-Echounterdrückung lässt dich über offene Lautsprecher mitten im Satz unterbrechen und trotzdem gehört werden, du brauchst also kein Push-to-Talk und kein Headset. Es erkennt, wann du fertig bist, und schickt den Gedanken komplett ab, was das Hin und Her natürlich macht. Keine Grammatik zu lernen. Einfach reden.
Live-Agentenstatus und Routing über mehrere Projekte
Ein grüner Punkt zeigt, dass der Agent wirklich zuhört, in Echtzeit statt per Umfrage. Du kannst mehrere Repos gleichzeitig einbinden, sogar über verschiedene Agenten hinweg, und per Klick auf den Projektnamen wechseln. Jedes Projekt antwortet mit eigener Stimme. In einer Sitzung mit drei Aufgaben siehst du auf einen Blick, welche gerade geantwortet hat.
Prüfmodus vor dem Senden
Schalte ihn ein, und jedes Transkript landet zuerst in einer bearbeitbaren Blase. Nichts erreicht deinen Agenten, bevor du das Häkchen setzt, was dir die Chance gibt, ein falsch gehörtes Wort zu korrigieren oder eine schlechte Anfrage zu stoppen, bevor sie läuft. Es ist die Art Schutzgeländer, die zählt, wenn ein Agent Dateien selbst schreiben und löschen kann. Früh einschalten lohnt sich.
Screenshots auf Abruf
Ein Hotkey greift deinen Bildschirm, und das Bild reist mit deiner nächsten gesprochenen Anfrage mit. Dein Agent kann auch selbst einen Screenshot machen, wenn er sehen muss, was du siehst, was zählt, weil einen Layout-Bug oder einen visuellen Fehler laut zu beschreiben viel langsamer ist als ihn einfach zu zeigen. Warum zählt das? Weil ein Bild allemal mehr sagt als ein Absatz.
Lokaler Meeting-Recorder und Transkription
SKI nimmt dein Mikrofon plus den Raumklang auf und transkribiert auf dem Gerät, mit nach Sprecher getaggten Spuren und einem Live-Transkript während des Calls. Aufnahmezeit und Aufbewahrung sind unbegrenzt, und du kannst nach Markdown oder reinen Text exportieren. Weil kein Bot dem Call beitritt, sehen die anderen Teilnehmer einfach dich im Meeting, keinen Recorder.
Dein Agent im Call
Füge eine Meeting-URL ins Widget ein, und dein Coding-Agent tritt als Live-Teilnehmer bei: sprechend, zuhörend, präsentierend oder still mitschreibend. Er sieht den Bildschirm, kann ihn teilen und liest und sendet Chat. Google Meet, Teams und Zoom werden unterstützt, und du kannst ein Meeting direkt aus dem Widget heraus starten.
Läuft über deinen ganzen Agenten-Stack
Eine einzige Skill deckt die Agenten ab, die Entwickler ohnehin nutzen: Claude Code, Cursor, Codex, Gemini CLI, OpenClaw und mehr. Verbinden ist ein Klick pro Agent, wechselst du also zwischen Projekten das Tool, verlierst du die Sprachschleife nicht. Diese Breite macht es zur Gewohnheit statt zum Ein-Tool-Trick.
Vor- und Nachteile
Vorteile
- Lebenslang kostenlos, ohne Konto oder Kreditkarte zum Start. Installieren und loslegen.
- Sprache und Stimme laufen auf dem Gerät, sodass Audio und Transkripte deine Maschine nie verlassen.
- Unterstützt ein breites Spektrum an Coding-Agenten, darunter Claude Code, Cursor, Codex und Gemini CLI.
- Voll-Duplex-Unterbrechung lässt dich den Agenten unterbrechen und gehört werden, ohne Push-to-Talk.
- Unbegrenzte lokale Meeting-Aufnahme und -Aufbewahrung, mit Export nach Markdown oder Text.
Nachteile
- Lokale Sprach- und Stimmmodelle brauchen für guten Lauf eine halbwegs fähige Maschine, ältere Hardware kann also hängen.
- Keine öffentliche API, was den Einbau einer SKI-artigen Stimme in eigene Tools oder Pipelines ausschließt.
- Die Agenten-Unterstützung ist eine feste Liste; ist dein Coding-Tool nicht dabei, gibt es keinen Ausweichweg.
- Meeting-Funktionen wie der automatische Kalender-Beitritt brauchen Extra-Einrichtung und ein verbundenes, aktives Projekt.
Häufige Fragen
Es fügt deinem KI-Coding-Agenten eine gesprochene Schleife in beide Richtungen hinzu. Du sagst, was du willst, der Agent erledigt die Arbeit in deinem Projekt, und SKI liest die Antwort mit natürlicher Stimme zurück. Alles läuft auf deinem eigenen Rechner.
Ähnliche Inhalte
Entdecke passende Tools, Skills und Artikel zu SKI.
Alternativen zu SKI
Prosp
Prosp · Schreiben · Stimme & Sprache · MarketingProsp ist ein KI-Tool für LinkedIn-Ansprache, gebaut für Agenturen und Vertriebsteams, und es schreibt die Nachricht und die Sprachnachricht mit Ihrer eigenen Stimme für jeden Interessenten, damit sie wirklich antworten. Sie verbinden Ihre Konten, finden Leads und lassen die KI personalisierte Nachrichten in großem Umfang entwerfen und versenden, alles aus einem Posteingang. Es ist für Menschen gemacht, die Outbound in großem Stil betreiben. Das ist das ganze Versprechen. Jeder Kontaktpunkt muss trotzdem menschlich wirken.
Wordly AI Translation
Wordly · Stimme & Sprache · ProduktivitätWordly AI Translation ist eine KI-Echtzeitübersetzungs- und Untertitelungsplattform für Besprechungen, Konferenzen und Veranstaltungen. Sie liefert Live-Übersetzung, Untertitel, Transkripte und Zusammenfassungen in mehr als 60 Sprachen, und Teilnehmer treten per QR-Code-Scan oder über einen Link bei, statt eigene Kopfhörer zu nutzen. Die Plattform arbeitet mit Zoom, Microsoft Teams, Google Meet und Webex zusammen und richtet sich an Organisationen, die mehrsprachigen Zugang wollen, ohne für jede Sitzung menschliche Dolmetscher zu engagieren. So einfach ist das.
Musicful
Musicful AI · Stimme & Sprache · VideoMusicful ist ein KI-Musikgenerator und KI-Musikvideo-Ersteller, der Text in Minuten in Musik verwandelt. Du gibst einen Text, einen Songtext oder eine gesummte Melodie ein und erhältst einen fertigen Track mit Gesang und Instrumenten. Er dient außerdem als KI-Songgenerator, erstellt Musikvideos aus den Songs, die du machst, und bietet ein KI-Cover-Werkzeug plus eine Entwickler-API. Die Plattform läuft im Webbrowser und über eine Android-App, sodass du einen Song am Desktop beginnen und am Handy fortsetzen kannst.
