LLM Stats

LLM Stats

LLM Stats · 商業 · 其他

LLM Stats 是免費的 AI 模型比較平台,在單一儀表板上依基準分數、速度與價格為超過 300 個語言模型排名。它把公開基準與即時 API 指標彙整進同一份 LLM 排行榜,讓你能並排比較 GPT、Claude、Gemini 與 DeepSeek,不必在十幾個供應商頁面之間來回切換。

LLM Stats 的介面預覽

關於 LLM Stats

什麼是 LLM Stats

LLM Stats 是給所有想看懂 AI 模型市場的人使用的評測中心。與其逐間閱讀各實驗室的行銷頁面,你有一個地方能把主流模型的推理、程式撰寫、數學與長脈絡分數並列比較。網站持續更新,同時追蹤封閉式與開放權重的發布。

核心價值在於比較。為什麼這件事重要?因為沒有任何實驗室會為對手模型公布誠實、可並列對照的數字。平台讓每個模型跑過一套 LLM Stats 綜合分數,這是個保守、會納入不確定性的數字,把基準佐證混合成單一排名。根據 LLM Stats 的說法,缺漏的結果就保持缺漏,不會被當成失敗計算。如此一來,測試做一半的模型就不會顯得比實際表現還差。細節很小。但當你要為真實專案挑模型時,差別很大。

限制則在於涵蓋範圍。排名反映的是現有的公開佐證。基準涵蓋稀薄的模型,排名可能低於它應得的位置。平台明白表示,它的分數不是針對特定任務的部署建議。把它當成研究捷徑,而不是最終答案。

開始使用

  1. 開啟 llm-stats.com,瀏覽主要的 AI 排行榜,其中列出附有分數、速度與每百萬權杖價格的排名模型。
  2. 用針對特定用途的排行榜縮小清單,例如最適合程式撰寫、寫作、數學或長脈絡的 AI。
  3. 依授權、速度或價格篩選,以配合你的預算與延遲需求。
  4. 開啟模型頁面,查看其基準細項、脈絡視窗與供應商價格。
  5. 如果你在開發軟體,可透過資料 API 或 MCP 整合,把同樣的數字匯入自己的應用程式。

產品資訊

快速了解 LLM Stats 的定價、支援平台與效能。

免費方案是
付費方案$0
平台Web
開發者LLM Stats
類別商業 · 其他
發布日期Nov 2024
最近更新Aug 2026
網站訪問量1.2M
網站全球排名50.8K
API 提供狀態是

適合對象

這項工具最適合的使用者、任務與情境。

使用者

  • 為專案挑選模型的 AI 開發者:價格與速度欄位讓你權衡每權杖成本與品質後再決定,而資料 API 能讓這些資料保持最新。
  • 評估市場的產品經理與創辦人:AI 模型排名能快速看出各類別由誰領先,不需要深厚技術背景。
  • 研究人員與學生:基準頁面在綜合分數旁揭露原始的 GPQA、MMLU 與 SWE-Bench 數字,讓你能檢視背後的佐證。

任務

  • 比較 AI 模型價格:輸入、快取輸入與輸出費率並列,讓你看出任何級距中最便宜的選項。
  • 挑選程式撰寫或寫作模型:各用途專屬的「最適合 AI」排行榜,依你真正在乎的能力排序模型。
  • 追蹤新發布:排行榜持續更新,新推出的模型會直接出現,不必自己查五個不同的部落格。

情境

  • 決定這季要付費使用哪個模型:單一檢視中的價格與基準資料,讓取捨變得具體,而不是憑空猜測。
  • 評估開放權重模型與封閉模型的優劣:開放式 LLM 排行榜把開放模型獨立出來,讓比較維持在同一基準上。
  • 把即時模型資料接進內部工具:資料 API 與 MCP 伺服器讓你在自己的儀表板中提供排名。

主要功能

LLM Stats 綜合分數

每個模型都有一個單一分數,把基準結果合併成可比較的數字。這個分數刻意保持審慎:佐證較少的模型會保留較多不確定性,而不是被扣分。排名獎勵廣泛且經過充分測試的表現,而非某個幸運的單一基準勝出。

即時 LLM 排行榜

主排行榜為超過 300 個模型排名,並從公開基準與 API 指標持續更新。欄位涵蓋推理、程式撰寫、代理、脈絡視窗、輸出速度與價格。一次掃完。依你在乎的項目排序。

分類排行榜

除了整體排名,網站也針對程式撰寫、寫作、研究、數學、長脈絡、工具呼叫、推理、圖像生成與影片創作設有專門榜單。每個榜單把相同的評分規則套用在更窄的基準組合上,當你的需求與通用智慧無關時特別有用。

AI 模型價格比較

專屬的價格頁面列出數百個模型每百萬權杖的輸入、快取輸入與輸出成本,另有依實際流量得出的每次對話觀察成本。它會標示每個價格的最後查核時間,並每 30 分鐘更新,數字不會過時。

開放式 LLM 排行榜

開放權重模型有獨立的排名,與封閉實驗室分開。當你想自行架設或微調時,這個區分很重要。開放與封閉模型很少在同一條件下競爭。

開放式競技場與遊樂場

平台設有聊天、程式撰寫、圖像與影片競技場,讓你能用真實提示詞讓模型互相對決。遊樂場則讓你直接試用模型。在信任任何排行榜數字前,這是很實用的檢查。

資料 API 與 MCP 伺服器

對開發者而言,資料 API 與 MCP 伺服器以程式化方式提供同樣的排行榜與價格資料。平台也為需要公開基準以外評估的團隊,提供客製化評測與資料標註服務。

優缺點

優點

  • 瀏覽免費,你與排行榜及價格表之間沒有付費牆。
  • 把數百個模型彙整進單一的 AI 模型比較檢視。不必再跳遍數十個供應商頁面。
  • 價格頁面顯示資料查核時間,並每 30 分鐘更新,成本數字能保持最新。
  • 開放與封閉模型分開排名,讓自行架設者的比較保持公平。
  • 資料 API 與 MCP 伺服器讓你輕鬆在自己的工具中重複使用資料。

缺點

  • 分數取決於公開基準,因此新模型或測試較少的模型,排名可能低於其實際能力所暗示的位置。
  • 深入的基準涵蓋偏向熱門模型,冷門或地區性模型得到的資料較稀薄。
  • 客製化評測與資料標註是付費服務,價格未公布在網站上,你得聯絡團隊索取報價。
  • 排行榜名次常隨新模型推出而變動,這可能讓存下的截圖在幾週內就過時。

常見問題

是。公開排行榜、模型頁面與價格比較都能免費瀏覽。公司確實為企業販售客製化評測與資料標註服務。核心資料不論如何都保持開放。

相關內容

探索與 LLM Stats 相關的工具、技能與文章。

LLM Stats 替代方案

Liveplan

Liveplan

Palo Alto Software · 商業

LivePlan 是一款商業計畫軟體,協助創辦人與小型企業主把一個想法變成可供資金方審閱的計畫。它結合了 AI 輔助撰寫、附上引用來源的市場研究,以及彼此連動的財務預測,因此當你改動一個數字時,損益表、現金流量表與資產負債表會一起變動。超過 150 萬家企業曾用它來規劃、預測,並對照真實的會計資料檢視績效。這數字背後是很多創辦人。它也代表這套工具經得起真實貸款方的考驗。

付費 / $20 - $40/mo查看詳情
Swms

Swms

Swms AI · 寫作 · 生產力 · 商業

Swms 是一款 AI 安全合規工具,能把一段對工作的簡單描述變成可直接使用的安全文件。你描述專案、工種與已知危害,它就會在數秒內寫出一份安全作業方法聲明、工作危害分析、安全作業程序、RAMS 或安全資料表。它還內建 Oscar,一個能用任何語言回答職場安全問題的聊天助理。建築、礦業、運輸與倉儲團隊都用它來減少那些原本會吃掉大半工作天的文書作業。

免費 / $20/mo查看詳情
Rows

Rows

Rows (Superhuman) · 生產力 · 商業

Rows 是一款 AI 試算表與資料分析工具,能從 50 多個來源匯入即時資料,接著讓你用白話文操作,不必寫 SQL 查詢或巢狀公式。你可以從 PDF 裡撈出數字,連接廣告平台、資料庫與銀行帳戶,並請 AI 建立報表、合併資料集,或架設會自動重算的模型。它在瀏覽器裡運行,操作起來就像試算表,如今隸屬於 Superhuman 旗下。

免費 / $0 - $87/mo查看詳情