
kodwai
kodwai · 程式設計
kodwai 是一個針對 AI 代理程式編碼挑戰的免費平台。你挑一個票據大小的問題,在自己的機器上用自家代理程式解決,然後提交這次工作階段以取得評分。可以把它想成一個附帶分數的 vibe coding 平台。它與 LeetCode 這類網站的不同之處,在於它衡量的東西。平台會讀取你整段執行過程,評的是你如何引導、驗證並用代理程式交付,而不是你背下來的內容。每一筆結果都會登上公開排行榜。

關於 kodwai
什麼是 kodwai
kodwai 是一個圍繞著現今編碼實際運作方式打造的挑戰平台。你把代理程式指向一個真實問題,在它自信滿滿卻出錯時抓出它,並檢查它交付了什麼。這個網站主張,判斷力才是值得衡量的能力,而這正是它評分所瞄準的目標。
這個平台的定位,是衝著白板謎題與老派演算法練習而來。把現代代理程式指向其中一題,它幾秒內就解掉,所以結果完全看不出鍵盤後面那個人的實力。通過測試能證明的事更少,因為一個隨便的單次提示就能讓整組測試變綠,卻完全沒展現驗證、拆解,或在代理程式偏離軌道時的復原能力。
有個實際的限制要記在心上。kodwai 不會在沙箱裡執行你的程式碼,也不代管你的作品。你自備代理程式與編輯器,平台只評分你送出的那次工作階段。如果你想要的是代管執行環境,這就不理想。如果你想要的是內建執行環境的代管線上評測系統,那這不是。
開始使用
- 在 kodwai 建立帳號,並依分類與難度瀏覽開放中的挑戰。
- 從終端機啟動挑戰並選擇你的代理程式,接著讓 CLI 下載問題檔案、起始程式碼與測試。
- 在自己的機器上、用自家編輯器與自家代理程式解決這個問題。
- 執行提交指令,將你的程式碼、git 歷程、測試執行、代理程式逐字稿與時間打包。
- 讀取你的分數、檢視各項訊號的佐證,並在排行榜上找到自己。
產品資訊
快速了解 kodwai 的定價、支援平台與效能。
適合對象
這項工具最適合的使用者、任務與情境。
使用者
- 想拿到一個比「解開謎題」更能說明事情的成績的求職者:排行榜與各項訊號的細分,讓招募主管有具體的東西可看,前提是他們本來就在用代理程式。
- 想誠實檢視自己習慣的在職開發者:分數會顯示你究竟會驗證代理程式交付的東西,還是只接受第一次跑綠的結果。
- 想比較不同工程師如何引導代理程式的團隊:所有人都跑同一道挑戰,結果因此可相比。但每個人仍需要自己的代理程式訂閱。
任務
- 在把工作交給代理程式之前練習寫規格:Direction 這項訊號會獎勵清楚的說明書,所以這個練習會逼你先想清楚問題。
- 測試自己是否抓得到代理程式的錯誤:挑戰包含真實的票據級問題,其中自信卻錯誤的答案很容易被忽略。
- 建立公開的紀錄:提交一次執行會把它加進你的排行榜名次,你可以把這個名次指給別人看。
情境
- 在代理程式負責部分工作的招募流程中評估人選:工作階段的逐字稿比一場限時演算法回合更能呈現全貌。
- 在悠閒的午後打磨自己的工作流程:挑一道貼近你實際交付工作的挑戰,看看你的流程在哪裡漏水。
- 在同一个問題上與隊友比較彼此的做法:同一道挑戰、兩次工作階段,分數會顯示你們各自引導代理程式的方式有何不同。
主要功能
不拘代理程式的挑戰
kodwai 能搭配你已在使用的代理程式,不論是 Claude Code、Cursor 還是 Codex。CLI 會初始化挑戰、下載問題檔案並啟動計時器,接著把控制權交回你的環境。沒有專有代理程式要學,也沒有沙箱要對抗。
真實的票據級問題
挑戰是照著你實際會接下的工作型態設計,而非抽象謎題。你能用處理整週票據的同一種形式解決一個問題嗎?這就是門檻。你可以依分類與難度篩選,挑一個看起來像你平常待辦佇列裡的任務。格式應該要感覺像工作。
工作階段層級的評分
kodwai 不是給過或不過,而是讀取整段工作階段。它評的是 Direction、Outcome 與 Lift,並回傳各項訊號的佐證,讓你看見每個軸為何得到那樣的分數。一個碰巧通過測試的隨便提示,分數依然低,因為編碼挑戰評分看的是過程,不只是結果。把它當成評量你「如何工作」的 AI 編碼基準,而不是評量你記得什麼。
公開排行榜
每一次計分的提交都會把你放上公開排行榜。這讓個人的練習變成可分享的東西,也讓平台能以開發者與代理程式協作的方式排名的依據,而不是靠背誦的答案。
一行指令提交
提交只要一行 CLI 指令。它會把你的程式碼、git 歷程、測試執行、代理程式逐字稿與經過時間打包成一個評分用的組合。不必手動組報告。整個流程就是這樣。
搭配你自己的環境運作
沒有什麼要安裝、會跟你編輯器打架的東西。你在自己的機器上、自己的環境裡、用自己工具解決問題。kodwai 是在事後評分那次工作階段。你真實的工作流程保持不變。
優缺點
優點
- 免費使用,沒有付費層擋住挑戰。
- 自備代理程式,因此是用你實際工作的工具來衡量你。
- 評的是過程,不只是測試是否通過,這更接近真實工作被評判的方式。
- 開箱即可搭配 Claude Code、Cursor 與 Codex 等熱門代理程式。
- 公開排行榜與各項訊號的佐證,讓進度容易追蹤與分享。
缺點
- 沒有沙箱或代管執行環境,所以你需要可運作的本地環境,以及自己的代理程式訂閱。
- 分數取決於一份包含你代理程式逐字稿的提交組合,這代表你對分享工作階段得有一定的接受度。
- 作為較新的平台,挑戰庫與分類涵蓋範圍仍在成長。
常見問題
是的。這個平台完全免費,挑戰與排行榜都沒有付費層。
相關內容
探索與 kodwai 相關的工具、技能與文章。
kodwai 替代方案
Forefront
Forefront · 程式設計Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。
Startkit
StartKit.AI · 程式設計Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。
Testim
Tricentis · 程式設計Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。
