Claude Haiku 5
Anthropic 最快最便宜的模型(當前實為 Haiku 4.5),以接近旗艦的編碼能力把成本和延遲壓到最低
深度報告
-
Anthropic 當前最快、最便宜的模型是 Claude Haiku 4.5,於 2025 年 10 月釋出,每百萬 token 定價 1 美元(輸入)/ 5 美元(輸出),在把成本和延遲壓到最低的同時,保持著接近 Sonnet 級的編碼能力。需要先把話說在前面:截至 2026 年 7 月 17 日,Anthropic 官方並未釋出任何名為「Claude Haiku 5」的模型。第五代體系目前只落地了 Fable 5、Sonnet 5 與 Opus 4.8,Haiku 這一檔仍停留在 4.5。本報告以當前可驗證的 Haiku 4.5 為基準,講清楚 Haiku 這臺「高吞吐輕量檔」的定位、能力邊界和取捨,並提示「Claude Haiku 5」在官方口徑下尚屬預期,而非已釋出產品。
-
Anthropic 的模型體系一直分三檔:入門級的 Haiku、中端的 Sonnet、高階的 Opus。2026 年 4 月,公司又塞進了兩款超越 Opus 的型號 Fable 5 與 Mythos 5,把能力上限又抬了一截。這兩款旗艦曾在 6 月 12 日因美國出口管制被短暫下線,直到 7 月 1 日才恢復全球訪問,但與 Haiku 4.5 無關。Haiku 4.5 本身在 2025 年 10 月 15 日釋出,是第一個帶擴充套件思考、計算機操控和上下文感知的 Haiku 型號,直接把速度檔與推理檔之間的落差收窄了一大截。Anthropic 首席產品官 Mike Krieger 在釋出時強調的分工是:Sonnet 負責複雜規劃,Haiku 驅動子智慧體高速執行,兩者配合讓整個 agent 生態跑得更順。
-
Haiku 4.5 的規格很剋制但夠用:20 萬 token 上下文視窗,最大輸出 6.4 萬 token;支援文字加影象輸入,文字加語音輸出;擴充套件思考預設開啟,這也是 Haiku 家族第一次帶推理;同時具備工具呼叫、計算機操控和視覺能力。速度上,實測約 98.9 token/秒,首 token 延遲 0.68 秒,是 Claude 全系最快的一檔。 能力基準方面,SWE-bench Verified 拿到 73.3%,與 Sonnet 4 的 72.7% 幾乎持平,但成本只有它的三分之一;Terminal-Bench 41%,OSWorld 50.7%(超過 Sonnet 4 的 42.2%,說明在模擬人類操作電腦上反而更穩);藉助 Python 工具時數學任務 96.3%。它的知識截止日期是 2025 年 2 月,訓練資料截止到 2025 年 7 月,這是輕量檔為了新鮮度與成本的折中。
-
API 定價為每百萬輸入 token 1 美元、輸出 token 5 美元,是 Anthropic 最便宜的模型;提示詞快取寫入 1.25 美元、讀取 0.10 美元;Batch 批處理再打五折;在 claude.ai 的免費檔直接可用。若工作負載需要落在美國境內推理,價格是輸入輸出的 1.1 倍。這套結構決定了 Haiku 的服務物件是高併發、低延遲、成本敏感的生產流水線,而不是需要極致深度的分析任務。
-
開發者社群對 Haiku 4.5 的好評集中在「價效比」三個字上:很多人提到它在編碼基準上接近 Sonnet 4.5,卻只要三分之一的成本、兩倍的速度,特別適合 agent 和工具呼叫場景。Hacker News 上的使用者評價它「細膩的編碼任務表現出色」,但也指出「某些情況下偏慢,需要嚴格的規則約束才能避免跑偏」。也有 YouTube 評測發現,在非編碼場景下它相比 GPT-5 略顯失望。免費使用者普遍的體感是「日常問答明顯更快」——因為它就是 claude.ai 免費檔背後的主力引擎之一。
-
行業媒體普遍把 Haiku 4.5 看作把「速度檔」和「推理檔」拉平的轉折點。AI NewsCycle 在報道 Sonnet 5 時明確寫道,第五代體系裡「Haiku 和 Opus 仍在等待各自的更新」,側面印證 Haiku 5 尚未到來。放到橫向對比裡,Haiku 4.5 的對手是 OpenAI 的 GPT-5.4 nano(約 0.15/0.60 美元)和 Gemini 2.5 Flash(0.30/2.50 美元)。評測一致的結論是:Haiku 4.5 在指令遵循、結構化輸出和長對話連貫性上更穩,但單價遠高於 nano 系列;如果你的工作負載需要絕對最低成本,nano 更划算,若質量與可靠性敏感,Haiku 更可靠。
-
第一是安全定位。Anthropic 文件與社群都反覆提示,Haiku 對提示詞注入的防護最弱,處理不可信使用者輸入時要格外謹慎,官方更建議把它當「低成本的只讀 worker」來用。第二是命名混亂。daily 速遞裡把這一檔標成「Claude Haiku 5」,但官方既沒釋出也沒預告,選型時容易誤以為有更強的型號可用。第三是出口管制餘波,6 月 12 日 Fable 5 與 Mythos 5 曾被暫停(現已恢復),雖然不影響 Haiku,但提醒使用者頂級能力在合規上仍有不確定性。第四是時效性,知識截止 2025 年 2 月,對需要最新資訊的場景偏弱。
-
適合用 Haiku 4.5 的:高併發的分類、抽取、路由任務,實時客服,輕量子智慧體,成本敏感的生產流水線。不適合的:需要最新知識(截止 2025 年 2 月)、處理不可信使用者輸入且要求強安全防護、以及超過 20 萬 token 的超長文件。替代方案上,要更便宜可以看 GPT-5.4 nano 或 Gemini 2.5 Flash,要更強推理上 Sonnet 5,最難的長程任務交給 Opus 4.8。常見的落地套路是 nano 做意圖分類、Haiku 做中等執行、Sonnet/Opus 兜底複雜查詢,用模型路由把整體成本壓下來。
-
Claude Haiku 4.5 是 Anthropic「速度—成本」檔的標杆,把近前沿能力壓到最低單價,是生產環境裡最該被用好的「廉價勞動力」。但要記住,「Claude Haiku 5」截至 2026 年 7 月尚未釋出,日常選型請以 Haiku 4.5 為準,並在把它接進處理不可信輸入的鏈路時,對提示詞注入風險保持警惕。
使用者評論
-
MrNellyPedraza_2024—整體評價:它不是完美的,但是市場現在最需要的那種模型——夠強(接近半年前的頂級)、夠快(實時可用)、夠便宜(能規模化)。別盲目把所有任務都遷過去,按用例分層才是正解。我們算過賬,把合適的服務從 Sonnet 降到 Haiku,單位經濟直接轉盈。 -
calja—「Claude Haiku 5」?官方根本沒發,現在能用的就是 4.5,別被名字帶偏了。 -
NathanRoberts00709—品牌心智是真問題,使用者都覺得非 Opus 不行,明明很多活 Haiku 就夠了,可一提到小模型就本能不信任,推廣起來比技術本身還難。 -
Bobby_JohnsonK—跟 GPT-5.4 nano、Gemini 2.5 Flash 比過一輪:nano 便宜到離譜($0.05/$0.40),但 Haiku 在指令遵循和複雜 JSON 結構化輸出上明顯更穩,我們做資料抽取寧可多花點也選它。純路由分類類才丟給 nano。 -
Philip_Taylor68—安全那塊要注意,Haiku 對提示詞注入幾乎零防護,凡是處理使用者不可信輸入的鏈路別直接用它,當只讀 worker 最穩。 -
姜貞軍—知識截止 2025 年 2 月,問最新訊息會胡說,生產環境記得加搜尋。 -
anKRI—比較意外的是 Haiku 4.5 比 3.5 更敢接活、更配合,以前版本會繞開的內容現在能處理,說明對齊確實改了,只是對話深度還是欠點。 -
Philip.ThompsonJr—我們用「Sonnet 規劃、一堆 Haiku 並行執行子任務」的編排模式,體感就像架構師帶著一群工程師幹活,成本、效率、質量都兼顧了。不過這變相逼我們上了多模型架構,對單一廠商的依賴反而更深了,這點想清楚再上。 -
Michael_Edwards_2021—價效比之王,沒毛病。 -
PLnie—xitu 那篇說別拿 Haiku 做客戶對話和需求收集,我是同意的,它適合「知道要做什麼」的執行型任務,模糊需求還是交給大模型吧。 -
Abigail_GrayQ—實測有個坑得提醒:agent 改寫程式碼時它偶爾不讀全相關檔案,會憑空造 helper 函式,我在長鏈任務裡踩過兩次。後來按函式粒度拆任務、在 claude.md 裡寫「重構前先搜現有 helper」才壓住錯誤率。小模型當 worker 沒問題,但得有人盯著。 -
ALhol—提示詞快取那事挺坑,字首不穩定就命中不了,調 prompt 真是門玄學。 -
realByronWood_pro—非編碼場景確實一般,我拿它寫文案對比 GPT-5 差點意思,但做分類和抽取這種髒活累活它是真便宜。 -
EHall520—HN 上那條「73% 的 SWE-Bench 對我夠用了,我甚至願意為 Haiku 4.5 比 Sonnet 多付錢,因為速度太值了」我是真認同。我們團隊把 PR 流水線裡的程式碼評審子任務全拆給 Haiku 跑,單次輸出經常衝到 200 token/秒以上,開發者等反饋的焦躁感一下沒了。 -
BruceRolers—用 Claude Code 配 Haiku 4.5 寫小功能確實爽,半小時搓出一個內部工具,迭代快得飛起,就是複雜重構還是得切回 Sonnet。 -
trueAaronTenold_pro—我把客服路由全換成 Haiku 了,成本直接砍到三分之一。 -
Eugene.Phillips_Max—免費檔就能用,日常問答明顯比之前快一截,真香。 -
Ashley.Wood_Pro—回不去了,太快了。