
kodwai
kodwai · Coding
kodwai ist eine kostenlose Plattform für Coding-Herausforderungen mit KI-Agenten. Man wählt ein Problem in Ticketgröße, löst es auf der eigenen Maschine mit dem eigenen Agenten und reicht dann die Sitzung zur Bewertung ein. Man kann es sich als Vibe-Coding-Plattform mit einer Zahl daran vorstellen. Was sie von einer Seite im LeetCode-Stil unterscheidet, ist das, was gemessen wird. Die Plattform liest den gesamten Durchlauf und bewertet, wie man den Agenten steuert, prüft und liefert, nicht was man auswendig gelernt hat. Jedes Ergebnis landet in einer öffentlichen Rangliste.

Über kodwai
Was ist kodwai
kodwai ist eine Challenge-Plattform, die um die Art und Weise gebaut ist, wie Coding heute tatsächlich funktioniert. Man richtet einen Agenten auf ein echtes Problem, erwischt ihn, wenn er sich sicher irrt, und prüft, was er geliefert hat. Die Seite argumentiert, dass Urteilsvermögen die Fähigkeit ist, die es zu messen lohnt, und genau darauf zielt ihre Bewertung.
Die Plattform positioniert sich gegen Whiteboard-Rätsel und altmodische Algorithmus-Übungen. Richtet man einen modernen Agenten auf eines davon, löst er das Problem in Sekunden, das Ergebnis sagt also nichts über die Person hinter der Tastatur aus. Tests zu bestehen beweist noch weniger, denn ein sorgloser Einmal-Prompt kann eine Testsuite grün machen, ohne Prüfung, Zerlegung oder Erholung zu zeigen, wenn der Agent vom Kurs abkommt.
Es gibt eine echte Grenze, die man im Kopf behalten sollte. kodwai führt den eigenen Code nicht in einer Sandbox aus und hostet die Arbeit nicht. Man bringt seinen eigenen Agenten und seinen eigenen Editor mit, und die Plattform bewertet nur die Sitzung, die man ihr schickt. Nicht ideal, wenn man eine verwaltete Laufzeit wollte. Wer einen verwalteten Online-Judge mit eingebauter Laufzeit sucht, findet hier nicht das Richtige.
Erste Schritte
- Ein Konto bei kodwai anlegen und die offenen Herausforderungen nach Kategorie und Schwierigkeit durchsehen.
- Eine Herausforderung vom Terminal aus starten und den Agenten wählen, dann das CLI die Problemdateien, den Startcode und die Tests herunterladen lassen.
- Das Problem auf der eigenen Maschine mit dem eigenen Agenten im eigenen Editor lösen.
- Den Submit-Befehl ausführen, um Code, git-Historie, Testläufe, Agent-Transkript und Zeit zu paketieren.
- Die Bewertung lesen, die Belege je Signal prüfen und sich in der Rangliste wiederfinden.
Produktinformationen
Ein kurzer Überblick über Preise, unterstützte Plattformen und die Leistung von kodwai.
Am besten für
Die Nutzer, Aufgaben und Szenarien, für die dieses Tool am besten passt.
Nutzer
- Jobsuchende, die eine Bewertung wollen, die mehr sagt als ein gelöstes Rätsel
- Berufstätige Entwickler, die eine ehrliche Einschätzung ihrer eigenen Gewohnheiten wollen
- Teams, die vergleichen, wie verschiedene Ingenieure einen Agenten steuern
Aufgaben
- Das Schreiben von Spezifikationen üben, bevor man Arbeit an einen Agenten übergibt
- Prüfen, ob man die Fehler eines Agenten erwischt
- Eine öffentliche Erfolgsbilanz aufbauen
Szenarien
- Kandidaten in einem Einstellungsprozess bewerten, in dem Agenten einen Teil der Arbeit machen
- Den eigenen Arbeitsablauf an einem ruhigen Nachmittag schärfen
- Den eigenen Ansatz mit dem eines Teamkollegen am selben Problem vergleichen
Wichtigste Funktionen
Agent-unabhängige Herausforderungen
kodwai funktioniert mit dem Agenten, den man bereits nutzt, sei es Claude Code, Cursor oder Codex. Das CLI initialisiert die Herausforderung, lädt die Problemdateien herunter und startet den Timer, dann gibt es die Kontrolle an das eigene Setup zurück. Es gibt keinen proprietären Agenten zu lernen und keine Sandbox, gegen die man ankämpft.
Echte Probleme in Ticketgröße
Die Herausforderungen sind nach der Art von Arbeit modelliert, die man tatsächlich annehmen würde, nicht nach abstrakten Rätseln. Kann man ein Problem in derselben Form lösen wie die Tickets, die man die ganze Woche bearbeitet? Das ist die Messlatte. Man kann nach Kategorie und Schwierigkeit filtern und eines wählen, das den Aufgaben in der normalen Warteschlange ähnelt. Das Format sollte sich wie die Arbeit anfühlen.
Bewertung auf Sitzungsebene
Statt bestanden oder nicht bestanden liest kodwai die gesamte Sitzung. Es bewertet Richtung, Ergebnis und Lift und liefert Belege je Signal zurück, damit man sieht, warum jede Achse so bewertet wurde. Ein sorgloser Prompt, der die Tests zufällig besteht, wird trotzdem niedrig bewertet, denn die Bewertung von Coding-Herausforderungen schaut auf den Prozess, nicht nur auf das Ergebnis. Behandeln Sie es als KI-Coding-Benchmark dafür, wie man arbeitet, nicht für das, was man erinnert.
Eine öffentliche Rangliste
Jede bewertete Einsendung bringt einen in eine öffentliche Rangliste. Das macht einen persönlichen Übungslauf zu etwas Teilbarem und gibt der Plattform eine Möglichkeit, Entwickler danach zu ranken, wie sie mit Agenten arbeiten, statt nach auswendig gelernten Antworten.
Einsendung mit einem Befehl
Das Einreichen ist ein einziger CLI-Befehl. Er paketiert Code, git-Historie, Testläufe, Agent-Transkript und verstrichene Zeit in ein Bündel zur Bewertung. Kein Bericht, der von Hand zusammengestellt wird. Das ist der ganze Ablauf.
Funktioniert mit dem eigenen Setup
Nichts zu installieren, das mit dem eigenen Editor kämpft. Man löst das Problem auf der eigenen Maschine, in der eigenen Umgebung, mit den eigenen Werkzeugen. kodwai bewertet die Sitzung im Nachhinein. Der reale Arbeitsablauf bleibt intakt.
Vor- und Nachteile
Vorteile
- Kostenlos, ohne eine kostenpflichtige Stufe, die die Herausforderungen sperrt.
- Eigener Agent mitbringbar, man wird also mit den Werkzeugen gemessen, mit denen man wirklich arbeitet.
- Bewertet den Prozess, nicht nur, ob die Tests bestehen, was näher daran liegt, wie echte Arbeit beurteilt wird.
- Funktioniert von Anfang an mit populären Agenten, darunter Claude Code, Cursor und Codex.
- Öffentliche Rangliste und Belege je Signal machen Fortschritt leicht nachvollziehbar und teilbar.
Nachteile
- Keine Sandbox und keine gehostete Laufzeit, man braucht also eine funktionierende lokale Umgebung und ein eigenes Agent-Abo.
- Die Bewertungen hängen von einem Einsendungspaket ab, das das Agent-Transkript enthält, was etwas Gelassenheit beim Teilen der Sitzung voraussetzt.
- Als neuere Plattform wachsen die Bibliothek der Herausforderungen und die Kategorienabdeckung noch.
Häufige Fragen
Ja. Die Plattform ist vollständig kostenlos, und es gibt keine kostenpflichtige Stufe für die Herausforderungen oder die Rangliste.
Ähnliche Inhalte
Entdecke passende Tools, Skills und Artikel zu kodwai.
Alternativen zu kodwai
Forefront
Forefront · CodingForefront ist eine Webplattform zum Bauen mit Open-Source-KI. Sie lassen sich führende Open-Source-Sprachmodelle mit eigenen Daten feintunen, ihre Leistung bewerten und sie über eine API ausführen oder exportieren, um sie selbst zu hosten. Entwickler, die den Komfort einer geschlossenen Plattform wollen, aber darauf bestehen, ihre Modelle und Daten zu besitzen, sind hier die Zielgruppe.
Startkit
StartKit.AI · CodingStartkit ist ein Boilerplate zum Bauen von KI-SaaS-Produkten und KI-Wrappern. Man kann es sich als KI-Startup-Boilerplate vorstellen, bei dem die langweiligen Teile schon verdrahtet sind: Authentifizierung, Zahlungen über Stripe und Lemon Squeezy, Nutzungslimits, transaktionale E-Mail und ein KI-API-Starter-Kit, das mit OpenAI, Anthropic, Groq oder Llama spricht. Man klont das Repository, setzt seinen Preis und kümmert sich um den Teil des Produkts, für den Menschen wirklich bezahlen. Es basiert auf Next.js über React und Tailwind, deshalb fühlt sich ein Großteil des Boilerplate-Codes schon vertraut an.
Testim
Tricentis · CodingTestim ist eine KI-gestützte Plattform für Testautomatisierung, mit der man End-to-End-Tests für Web-, Mobile- und Salesforce-Anwendungen baut und ausführt. Sie setzt auf maschinelles Lernen, um Tests stabil zu halten, wenn sich eine Oberfläche ändert, sodass Teams weniger Zeit mit der Reparatur kaputter Selektoren verbringen. Nicht schlecht für ein Tool für automatisierte Tests, das Sie heute schon nutzen können. Sie erstellen Tests, indem Sie Aktionen im Browser aufzeichnen, und fügen danach JavaScript hinzu, wenn Sie mehr Kontrolle brauchen. Für ein beschäftigtes QA-Team eine solide Wahl.
