Claude Haiku 5
Anthropic 最快最便宜的模型(当前实为 Haiku 4.5),以接近旗舰的编码能力把成本和延迟压到最低
深度报告
-
Anthropic 当前最快、最便宜的模型是 Claude Haiku 4.5,于 2025 年 10 月发布,每百万 token 定价 1 美元(输入)/ 5 美元(输出),在把成本和延迟压到最低的同时,保持着接近 Sonnet 级的编码能力。需要先把话说在前面:截至 2026 年 7 月 17 日,Anthropic 官方并未发布任何名为「Claude Haiku 5」的模型。第五代体系目前只落地了 Fable 5、Sonnet 5 与 Opus 4.8,Haiku 这一档仍停留在 4.5。本报告以当前可验证的 Haiku 4.5 为基准,讲清楚 Haiku 这台「高吞吐轻量档」的定位、能力边界和取舍,并提示「Claude Haiku 5」在官方口径下尚属预期,而非已发布产品。
-
Anthropic 的模型体系一直分三档:入门级的 Haiku、中端的 Sonnet、高端的 Opus。2026 年 4 月,公司又塞进了两款超越 Opus 的型号 Fable 5 与 Mythos 5,把能力上限又抬了一截。这两款旗舰曾在 6 月 12 日因美国出口管制被短暂下线,直到 7 月 1 日才恢复全球访问,但与 Haiku 4.5 无关。Haiku 4.5 本身在 2025 年 10 月 15 日发布,是第一个带扩展思考、计算机操控和上下文感知的 Haiku 型号,直接把速度档与推理档之间的落差收窄了一大截。Anthropic 首席产品官 Mike Krieger 在发布时强调的分工是:Sonnet 负责复杂规划,Haiku 驱动子智能体高速执行,两者配合让整个 agent 生态跑得更顺。
-
Haiku 4.5 的规格很克制但够用:20 万 token 上下文窗口,最大输出 6.4 万 token;支持文本加图像输入,文本加语音输出;扩展思考默认开启,这也是 Haiku 家族第一次带推理;同时具备工具调用、计算机操控和视觉能力。速度上,实测约 98.9 token/秒,首 token 延迟 0.68 秒,是 Claude 全系最快的一档。 能力基准方面,SWE-bench Verified 拿到 73.3%,与 Sonnet 4 的 72.7% 几乎持平,但成本只有它的三分之一;Terminal-Bench 41%,OSWorld 50.7%(超过 Sonnet 4 的 42.2%,说明在模拟人类操作电脑上反而更稳);借助 Python 工具时数学任务 96.3%。它的知识截止日期是 2025 年 2 月,训练数据截止到 2025 年 7 月,这是轻量档为了新鲜度与成本的折中。
-
API 定价为每百万输入 token 1 美元、输出 token 5 美元,是 Anthropic 最便宜的模型;提示词缓存写入 1.25 美元、读取 0.10 美元;Batch 批处理再打五折;在 claude.ai 的免费档直接可用。若工作负载需要落在美国境内推理,价格是输入输出的 1.1 倍。这套结构决定了 Haiku 的服务对象是高并发、低延迟、成本敏感的生产流水线,而不是需要极致深度的分析任务。
-
开发者社区对 Haiku 4.5 的好评集中在「性价比」三个字上:很多人提到它在编码基准上接近 Sonnet 4.5,却只要三分之一的成本、两倍的速度,特别适合 agent 和工具调用场景。Hacker News 上的用户评价它「细腻的编码任务表现出色」,但也指出「某些情况下偏慢,需要严格的规则约束才能避免跑偏」。也有 YouTube 评测发现,在非编码场景下它相比 GPT-5 略显失望。免费用户普遍的体感是「日常问答明显更快」——因为它就是 claude.ai 免费档背后的主力引擎之一。
-
行业媒体普遍把 Haiku 4.5 看作把「速度档」和「推理档」拉平的转折点。AI NewsCycle 在报道 Sonnet 5 时明确写道,第五代体系里「Haiku 和 Opus 仍在等待各自的更新」,侧面印证 Haiku 5 尚未到来。放到横向对比里,Haiku 4.5 的对手是 OpenAI 的 GPT-5.4 nano(约 0.15/0.60 美元)和 Gemini 2.5 Flash(0.30/2.50 美元)。评测一致的结论是:Haiku 4.5 在指令遵循、结构化输出和长对话连贯性上更稳,但单价远高于 nano 系列;如果你的工作负载需要绝对最低成本,nano 更划算,若质量与可靠性敏感,Haiku 更可靠。
-
第一是安全定位。Anthropic 文档与社区都反复提示,Haiku 对提示词注入的防护最弱,处理不可信用户输入时要格外谨慎,官方更建议把它当「低成本的只读 worker」来用。第二是命名混乱。daily 速递里把这一档标成「Claude Haiku 5」,但官方既没发布也没预告,选型时容易误以为有更强的型号可用。第三是出口管制余波,6 月 12 日 Fable 5 与 Mythos 5 曾被暂停(现已恢复),虽然不影响 Haiku,但提醒用户顶级能力在合规上仍有不确定性。第四是时效性,知识截止 2025 年 2 月,对需要最新信息的场景偏弱。
-
适合用 Haiku 4.5 的:高并发的分类、抽取、路由任务,实时客服,轻量子智能体,成本敏感的生产流水线。不适合的:需要最新知识(截止 2025 年 2 月)、处理不可信用户输入且要求强安全防护、以及超过 20 万 token 的超长文档。替代方案上,要更便宜可以看 GPT-5.4 nano 或 Gemini 2.5 Flash,要更强推理上 Sonnet 5,最难的长程任务交给 Opus 4.8。常见的落地套路是 nano 做意图分类、Haiku 做中等执行、Sonnet/Opus 兜底复杂查询,用模型路由把整体成本压下来。
-
Claude Haiku 4.5 是 Anthropic「速度—成本」档的标杆,把近前沿能力压到最低单价,是生产环境里最该被用好的「廉价劳动力」。但要记住,「Claude Haiku 5」截至 2026 年 7 月尚未发布,日常选型请以 Haiku 4.5 为准,并在把它接进处理不可信输入的链路时,对提示词注入风险保持警惕。
用户评论
-
MrNellyPedraza_2024—整体评价:它不是完美的,但是市场现在最需要的那种模型——够强(接近半年前的顶级)、够快(实时可用)、够便宜(能规模化)。别盲目把所有任务都迁过去,按用例分层才是正解。我们算过账,把合适的服务从 Sonnet 降到 Haiku,单位经济直接转盈。 -
calja—「Claude Haiku 5」?官方根本没发,现在能用的就是 4.5,别被名字带偏了。 -
NathanRoberts00709—品牌心智是真问题,用户都觉得非 Opus 不行,明明很多活 Haiku 就够了,可一提到小模型就本能不信任,推广起来比技术本身还难。 -
Bobby_JohnsonK—跟 GPT-5.4 nano、Gemini 2.5 Flash 比过一轮:nano 便宜到离谱($0.05/$0.40),但 Haiku 在指令遵循和复杂 JSON 结构化输出上明显更稳,我们做数据抽取宁可多花点也选它。纯路由分类类才丢给 nano。 -
Philip_Taylor68—安全那块要注意,Haiku 对提示词注入几乎零防护,凡是处理用户不可信输入的链路别直接用它,当只读 worker 最稳。 -
姜贞军—知识截止 2025 年 2 月,问最新消息会胡说,生产环境记得加搜索。 -
anKRI—比较意外的是 Haiku 4.5 比 3.5 更敢接活、更配合,以前版本会绕开的内容现在能处理,说明对齐确实改了,只是对话深度还是欠点。 -
Philip.ThompsonJr—我们用「Sonnet 规划、一堆 Haiku 并行执行子任务」的编排模式,体感就像架构师带着一群工程师干活,成本、效率、质量都兼顾了。不过这变相逼我们上了多模型架构,对单一厂商的依赖反而更深了,这点想清楚再上。 -
Michael_Edwards_2021—性价比之王,没毛病。 -
PLnie—xitu 那篇说别拿 Haiku 做客户对话和需求收集,我是同意的,它适合「知道要做什么」的执行型任务,模糊需求还是交给大模型吧。 -
Abigail_GrayQ—实测有个坑得提醒:agent 改写代码时它偶尔不读全相关文件,会凭空造 helper 函数,我在长链任务里踩过两次。后来按函数粒度拆任务、在 claude.md 里写「重构前先搜现有 helper」才压住错误率。小模型当 worker 没问题,但得有人盯着。 -
ALhol—提示词缓存那事挺坑,前缀不稳定就命中不了,调 prompt 真是门玄学。 -
realByronWood_pro—非编码场景确实一般,我拿它写文案对比 GPT-5 差点意思,但做分类和抽取这种脏活累活它是真便宜。 -
EHall520—HN 上那条「73% 的 SWE-Bench 对我够用了,我甚至愿意为 Haiku 4.5 比 Sonnet 多付钱,因为速度太值了」我是真认同。我们团队把 PR 流水线里的代码评审子任务全拆给 Haiku 跑,单次输出经常冲到 200 token/秒以上,开发者等反馈的焦躁感一下没了。 -
BruceRolers—用 Claude Code 配 Haiku 4.5 写小功能确实爽,半小时搓出一个内部工具,迭代快得飞起,就是复杂重构还是得切回 Sonnet。 -
trueAaronTenold_pro—我把客服路由全换成 Haiku 了,成本直接砍到三分之一。 -
Eugene.Phillips_Max—免费档就能用,日常问答明显比之前快一截,真香。 -
Ashley.Wood_Pro—回不去了,太快了。