Anthropic 推出旗下最便宜的小型模型,跑起來的成本大約只有前一代的四分之一。對按用量計費的團隊來說,這代表什麼?
Claude Haiku 5.5 成為 Anthropic 最便宜的小型模型
Anthropic 在 10 月 7 日發布 Claude Haiku 5.5,形容它是公司至今最便宜、最快、也最強的小型模型。對要付 API 帳單的人來說,重點只有一句:根據 Anthropic 的說法,Haiku 5.5 平均跑起來比 Haiku 4.5 便宜約 75%。
簡單說就是這樣。但整件事比一行數字更有意思,因為 Anthropic 這次除了推小模型,還順手調了另一個大模型的價格。
Haiku 是 Claude 家族裡體型最小、反應最快的一員,專門處理重複性工作:整理文件、分類與標記內容、針對單一檔案回答問題、處理資料庫式的查詢。如果你曾把聊天機器人接進客服信箱或文件流程,背後默默做苦工的多半就是 Haiku,遇到難題才交給更大的模型判斷。
Claude Haiku 5.5 接下同樣的飯碗,把它變得更便宜。獨立評測機構 Artificial Analysis 的智慧指數給它 43 分,表現稱職,但不是班上第一名。
便宜 75% 對 API 使用者代表什麼
成本下降是多數開發者在意的事。Anthropic 說 Haiku 5.5 的執行成本比 Haiku 4.5 低約 75%,換算下來,同樣的工作量大約只要付過去四分之一的錢。這差很多。
想像一個情境。一家新創公司每月要跑幾百萬次分類請求,過去因為太貴而只能挑重點文件處理,現在預算內突然能把每份文件都跑一遍。原本不划算的自動化,忽然變得可行。
Anthropic 把 Haiku 5.5 定位在高用量、對成本敏感的工作,也說它很適合當 Opus 5.5 與 Sonnet 5.5 底下的子代理,協助處理編碼任務。有個地方要留意:75% 是 Anthropic 自己算的平均值,你實際省多少取決於工作型態與輸出長度。公司沒有公布每個用量級距的完整單價,把這個平均當成大致方向就好,別當成保證。
另有媒體報導,在單一區段看到的降幅更誇張,宣稱 10 萬詞元以下的請求價格掉了約九成。不同來源算法不一,因為降幅本來就隨用量而變。
Sonnet 5.5 的快取讀取也降價
這次不只小模型的事。Anthropic 把 Claude Sonnet 5.5 的快取讀取價格砍了一半。快取讀取指的是模型重複使用已處理過的內容時所付的那一筆費用,而不是重新讀一遍。
快取對代理式工作特別重要。當模型要把一長串對話或一份大檔案一直放在眼前、反覆回頭參考時,這筆費用會一直累積。Anthropic 說這項調整讓 Sonnet 5.5 在多數代理任務上便宜約兩成。如果你正在做那種需要「記住整個專案」的助理,省下的就是這一條。
兩個動作指向同一件事:Anthropic 想搶的是天天都要跑的大量工作,靠的不只是能力,還有價格。
Haiku 5.5 在 Claude 5.5 家族裡的位置
Haiku 5.5 補上了一個秋天陸續推出的家族。Opus 5.5 在 9 月 22 日先登場,主打速度的 Sonnet 5.5 於 9 月 28 日跟上,兩篇發布文都預告 Haiku 5.5 會在「未來數週內」報到。10 月 7 日就是它現身的日子。
三款模型依成本與能力分工。Opus 處理最難的問題,Sonnet 居中負責代理任務,Haiku 接走高用量、容錯度高的雜活。常見的搭配是讓 Haiku 先跑第一輪,遇到不尋常的狀況再往上送。
挑選的依據很單純:看你的預算。
上線範圍與 Claude Max 新額度
Claude Haiku 5.5 即刻可在 Claude Platform 使用,也同步登上 AWS、Google Cloud 與 Microsoft Azure,已經在這些雲端跑 Claude 的團隊不必另外接線就能切換。
Anthropic 另外為 Claude Max 與 Team 訂閱者加了每月 API 額度,鎖定在 Claude Platform 上開發代理與應用的人。這對詞元用量最大的開發族群來說,是個明顯的招手。
有個調校細節值得知道:Haiku 5.5 是第一款可以調整「思考力度」的 Haiku 級模型。你可以把它調向速度與成本,也能調向準確度,看眼前任務需要什麼。
如果你的工作大多是摘要、標記與查詢,Haiku 5.5 值得拿來對著現有設定測一輪。小改動,大省錢。先挑一個高用量的工作換上去,一週後比一比帳單和輸出品質,再決定要把範圍擴到多大。






