Claude Haiku 5

Anthropic 最快最便宜的模型(当前实为 Haiku 4.5),以接近旗舰的编码能力把成本和延迟压到最低

詳細レポート

  • Anthropic の現在の最速かつ最も安価なモデルは、2025 年 10 月にリリースされた Claude Haiku 4.5 で、価格は 100 万トークンあたり 1 ドル (入力) / 5 ドル (出力) で、コストと遅延を最小限に抑えながらソネット レベルに近いコーディング機能を維持します。前もって言っておく必要があります。2026 年 7 月 17 日の時点で、Anthropic は「Claude Haiku 5」という名前のモデルを正式にリリースしていません。第 5 世代システムは現在、Fable 5、Sonnet 5、Opus 4.8 のみを実装していますが、Haiku は依然として 4.5 のままです。このレポートでは、現在検証可能な Haiku 4.5 をベンチマークとして使用し、「高スループットの軽量デバイス」である Haiku の位置付け、機能の境界、トレードオフを明確にしています。また、「Claude Haiku 5」はリリースされた製品ではなく、正式に期待されているものであることを思い出させます。

  • Anthropic のモデル システムは常に、エントリーレベルの Haiku、ミッドレンジの Sonnet、およびハイエンドの Opus の 3 つのレベルに分かれています。 2026 年 4 月、同社は Opus を超える 2 つのモデル、Fable 5 と Mythos 5 を追加し、機能の上限を引き上げました。両方の旗艦は米国の輸出規制により 6 月 12 日に一時的にオフラインになり、世界的なアクセスは 7 月 1 日まで回復しませんでしたが、Haiku 4.5 とは何の関係もありません。 Haiku 4.5 自体は、2025 年 10 月 15 日にリリースされました。これは、拡張思考、コンピューター制御、およびコンテキスト認識を備えた初の Haiku モデルであり、スピード ギアと推論ギアの間のギャップを直接狭めます。 Anthropic の最高製品責任者である Mike Krieger 氏は、リリース中に分業を強調しました。Sonnet が複雑な計画を担当し、Haiku がサブエージェントの高速実行を推進します。この 2 つの協力により、エージェント エコシステム全体がよりスムーズに実行されます。

  • Haiku 4.5 の仕様は非常に制限されていますが、十分です。200,000 トークンのコンテキスト ウィンドウ、最大出力 64,000 トークン。テキストと画像の入力、テキストと音声の出力をサポートします。拡張思考はデフォルトで有効になっており、Haiku ファミリーが推論を備えたのはこれが初めてです。また、ツール呼び出し、コンピュータ制御、視覚機能も備えています。速度に関しては、実測速度は約98.9トークン/秒、最初のトークン遅延は0.68秒とクロードシリーズ全体で最速の速度となっています。 能力ベンチマークに関しては、SWE ベンチ Verified は 73.3% を獲得しました。これは Sonnet 4 の 72.7% とほぼ同じですが、コストはその 3 分の 1 に過ぎません。 Terminal-Bench 41%、OSWorld 50.7% (Sonnet 4 の 42.2% を上回り、人間によるコンピュータ操作のシミュレーションにおいてより安定していることを示しています)。 Python ツールの助けを借りて、数学タスクは 96.3% に達しました。ナレッジの期限は 2025 年 2 月で、トレーニング データは 2025 年 7 月までです。これは、軽量ファイルの鮮度とコストの間の妥協点です。

  • API の価格は入力トークン 100 万あたり 1 米ドル、出力トークン 100 万あたり 5 米ドルで、Anthropic の最も安価なモデルになります。プロンプトワードキャッシュの費用は書き込みに 1.25 米ドル、読み取りに 0.10 米ドルです。バッチバッチ処理はさらに 50% 割引されます。これは、claude.ai の無料ファイルから直接入手できます。ワークロードが米国内での推論を必要とする場合、価格は入出力の 1.1 倍になります。この構造により、Haiku のサービスのターゲットは、極端な深さを必要とする分析タスクではなく、同時実行性が高く、レイテンシが低く、コスト重視の運用パイプラインであることがわかります。

  • Haiku 4.5 に対する開発者コミュニティの賞賛は、「費用対効果」という言葉に焦点を当てています。多くの人が、コーディング ベンチマークの点では Sonnet 4.5 に近いものの、コストは 3 分の 1 で、速度は 2 倍であると述べています。これは、エージェントおよびツール呼び出しのシナリオに特に適しています。 Hacker News のユーザーは、「繊細なコーディング作業ではうまく機能する」とコメントしましたが、「場合によっては遅く、逸脱を避けるために厳格なルール制約が必要である」とも指摘しました。一部の YouTube レビューでは、非エンコード シナリオでは GPT-5 と比較してわずかに期待外れであることがわかりました。無料ユーザーに共通する感覚は、「毎日の質問と回答が大幅に高速になった」ということです。これは、claude.ai の無料ファイルの背後にある主要なエンジンの 1 つであるためです。

  • 業界メディアは一般に、Haiku 4.5 を「速度の歯車」と「推論の歯車」を水平にするターニングポイントであるとみなしています。 AI NewsCycle は Sonnet 5 について報道した際に、第 5 世代システムでの「Haiku と Opus はまだそれぞれのアップデートを待っている」と明確に書きましたが、これは Haiku 5 がまだ到着していないことを裏付けています。水平比較すると、Haiku 4.5 の対抗馬は OpenAI の GPT-5.4 nano (約 0.15 ドル/0.60 ドル) と Gemini 2.5 Flash (0.30 ドル/2.50 ドル) です。レビューの満場一致の結論は、コマンドへの準拠性、構造化された出力、および長い会話の一貫性の点で Haiku 4.5 の方が安定しているということですが、単価は nano シリーズよりもはるかに高いです。ワークロードで絶対的な最低コストが必要な場合は、nano の方がコスト効率が高く、品質と信頼性が重視される場合は、Haiku の方が信頼性が高くなります。

  • 1つ目は安全な位置決めです。人間関係の文書やコミュニティは、Haiku のプロンプトワードインジェクションに対する保護が最も弱いことを繰り返し指摘してきました。信頼できないユーザー入力を処理する場合は、特に注意する必要があります。公式も「低コストの読み取り専用ワーカー」としての利用を推奨している。 2つ目はネーミングの混乱です。この機種はデイリーエクスプレスでは「クロードハイク5」と表記されていますが、公式からの発表や予告はないため、機種を選ぶ際にもっと強力な機種があると誤解されやすいです。 3つ目は輸出規制の余波です。 Fable 5 と Mythos 5 は 6 月 12 日に一時停止されました (現在は復旧しています)。 Haiku には影響しませんが、トップレベルの機能への準拠にはまだ不確実性があることをユーザーに思い出させます。 4つ目は適時性です。知識は 2025 年 2 月時点のものであり、最新の情報が必要なシナリオには弱いです。

  • Haiku 4.5 に最適: 高度に同時実行される分類、抽出、およびルーティングのタスク、リアルタイムの顧客サービス、軽量の量子エージェント、およびコスト重視の生産ライン。最新の知識 (2025 年 2 月時点) が必要な場合、信頼できないユーザー入力の処理と強力なセキュリティ保護が必要な場合、および 200,000 トークンを超える非常に長いドキュメントには適していません。代わりに、より安価なオプションとして、GPT-5.4 nano または Gemini 2.5 Flash を検討することもできます。より強力な推論については、Sonnet 5 に進みます。最も困難な長距離タスクについては、Opus 4.8 に進みます。一般的な実装ルーチンは、意図の分類には nano、中程度の実行には Haiku、複雑なクエリには Sonnet/Opus、そして全体のコストを削減するためのモデル ルーティングです。

  • Claude Haiku 4.5 は、Anthropic の「速度とコスト」範囲のベンチマークです。これは、最先端に近い機能を最低の単価まで引き下げるものであり、生産環境で最大限に活用されるべき「安価な労働力」です。ただし、2026 年 7 月の時点では「Claude Haiku 5」はリリースされていないことに注意してください。毎日の選択については Haiku 4.5 を参照し、信頼できない入力を処理するリンクに接続する場合は、プロンプトワードインジェクションのリスクに注意してください。

ユーザーレビュー

  • 头像
    MrNellyPedraza_2024
    整体评价:它不是完美的,但是市场现在最需要的那种模型——够强(接近半年前的顶级)、够快(实时可用)、够便宜(能规模化)。别盲目把所有任务都迁过去,按用例分层才是正解。我们算过账,把合适的服务从 Sonnet 降到 Haiku,单位经济直接转盈。

  • 头像
    calja
    「Claude Haiku 5」?官方根本没发,现在能用的就是 4.5,别被名字带偏了。

  • 头像
    NathanRoberts00709
    品牌心智是真问题,用户都觉得非 Opus 不行,明明很多活 Haiku 就够了,可一提到小模型就本能不信任,推广起来比技术本身还难。

  • 头像
    Bobby_JohnsonK
    跟 GPT-5.4 nano、Gemini 2.5 Flash 比过一轮:nano 便宜到离谱($0.05/$0.40),但 Haiku 在指令遵循和复杂 JSON 结构化输出上明显更稳,我们做数据抽取宁可多花点也选它。纯路由分类类才丢给 nano。

  • 头像
    Philip_Taylor68
    安全那块要注意,Haiku 对提示词注入几乎零防护,凡是处理用户不可信输入的链路别直接用它,当只读 worker 最稳。

  • 头像
    姜贞军
    知识截止 2025 年 2 月,问最新消息会胡说,生产环境记得加搜索。

  • 头像
    anKRI
    比较意外的是 Haiku 4.5 比 3.5 更敢接活、更配合,以前版本会绕开的内容现在能处理,说明对齐确实改了,只是对话深度还是欠点。

  • 头像
    Philip.ThompsonJr
    我们用「Sonnet 规划、一堆 Haiku 并行执行子任务」的编排模式,体感就像架构师带着一群工程师干活,成本、效率、质量都兼顾了。不过这变相逼我们上了多模型架构,对单一厂商的依赖反而更深了,这点想清楚再上。

  • 头像
    Michael_Edwards_2021
    性价比之王,没毛病。

  • 头像
    PLnie
    xitu 那篇说别拿 Haiku 做客户对话和需求收集,我是同意的,它适合「知道要做什么」的执行型任务,模糊需求还是交给大模型吧。

  • 头像
    Abigail_GrayQ
    实测有个坑得提醒:agent 改写代码时它偶尔不读全相关文件,会凭空造 helper 函数,我在长链任务里踩过两次。后来按函数粒度拆任务、在 claude.md 里写「重构前先搜现有 helper」才压住错误率。小模型当 worker 没问题,但得有人盯着。

  • 头像
    ALhol
    提示词缓存那事挺坑,前缀不稳定就命中不了,调 prompt 真是门玄学。

  • 头像
    realByronWood_pro
    非编码场景确实一般,我拿它写文案对比 GPT-5 差点意思,但做分类和抽取这种脏活累活它是真便宜。

  • 头像
    EHall520
    HN 上那条「73% 的 SWE-Bench 对我够用了,我甚至愿意为 Haiku 4.5 比 Sonnet 多付钱,因为速度太值了」我是真认同。我们团队把 PR 流水线里的代码评审子任务全拆给 Haiku 跑,单次输出经常冲到 200 token/秒以上,开发者等反馈的焦躁感一下没了。

  • 头像
    BruceRolers
    用 Claude Code 配 Haiku 4.5 写小功能确实爽,半小时搓出一个内部工具,迭代快得飞起,就是复杂重构还是得切回 Sonnet。

  • 头像
    trueAaronTenold_pro
    我把客服路由全换成 Haiku 了,成本直接砍到三分之一。

  • 头像
    Eugene.Phillips_Max
    免费档就能用,日常问答明显比之前快一截,真香。

  • 头像
    Ashley.Wood_Pro
    回不去了,太快了。