Anthropicが小型モデルの新作「Claude Haiku 5.5」を公開しました。前世代のHaiku 4.5より動かすコストが平均で約75%下がり、10万トークン以下のリクエストなら単価は10分の1になります*1。Haikuとして初めて、effort(考える深さ)も選べるようになりました。
価格と速度を両立した決定版、というのが私の印象です。先に結論を言うと、大量処理・サブエージェント・速度が要る仕事はHaiku 5.5、複雑で長いコーディングはSonnet 5.5かOpus 5.5という使い分けになります。
今なら、生成AIの基礎知識から社内導入の6ステップ・定着のポイントまでを1冊にまとめた「はじめての生成AI社内導入ガイド」を無料で配布中!何から始めればいいか分からない方でも、これ1冊で導入の流れがつかめます。
目次
Claude Haiku 5.5とは|最速・最安の小型モデル

Claude Haiku 5.5は、Haiku 4.5の後継にあたる小型モデルです。米国時間2026年10月7日(日本時間10月8日)に公開され、Claude API(モデルIDは claude-haiku-5-5)のほか、AWS・Google Cloud・Microsoft Azureでも公開当日から使えます。
Anthropicがこれまで出した小型モデルの中で、最も安く、最も速く、最も高性能という位置づけです。ここでいう「最速」は標準の速度どうしで比べた場合で、Fast modeで動かすOpusよりは遅くなります。
Haiku 4.5からの主な変更点は次のとおりです*2。
| 項目 | Haiku 5.5(カッコ内はHaiku 4.5) |
|---|---|
| コンテキスト | 100万トークン(20万トークン) |
| 最大出力 | 12.8万トークン(6.4万トークン)。Batch APIではベータで最大30万トークン |
| effort(考える深さ) | low〜maxの5段階から選べる(なし) |
| 知識のカットオフ | 2026年6月 |
| 速度 | 現行のClaudeで最速(Sonnet 5.5は「速い」、Opus 5.5は「中程度」) |
| 入出力 | テキスト・画像を入力し、テキストを出力 |
Haiku 4.5は旧モデルの扱いに移りましたが、引き続き使えます。Haiku 5.5は、2027年10月7日より前には提供を終了しない予定です。
料金|10万トークン以下なら単価は10分の1

APIの料金は、1回のリクエストのプロンプトが10万トークン以下か、それを超えるかで2段階に分かれます。100万トークンあたりの単価を、Haiku 4.5・Sonnet 5.5と並べました。
| 項目(100万トークンあたり) | Haiku 5.5(10万以下) | Haiku 5.5(10万超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 入力 | $0.10 | $0.50 | $1.00 | $2.00 |
| 出力 | $0.50 | $2.50 | $5.00 | $10.00 |
| キャッシュ読み込み | $0.01 | $0.05 | $0.10 | $0.10 |
| キャッシュ書き込み | $0.125 | $0.625 | $1.25 | $2.50 |
Sonnet 5.5のキャッシュ読み込み$0.10は、同時に発表された値下げ後の値です。ほかに、1時間保持のキャッシュ書き込みは$0.20(10万トークン超は$1)で、Batch APIを使えば入出力が半額になります。
「平均75%減」と「単価90%減」は別の数字
リードの「平均で約75%安い」は、単価の下げ幅そのものではありません。次の4つを合わせた結果です。
- 10万トークン以下のリクエスト — 単価はHaiku 4.5の10分の1(90%安い)
- 10万トークンを超えるリクエスト — 単価は半額(50%安い)
- Haiku 4.5での使われ方 — リクエストの約90%が10万トークン以下だった
- トークナイザーの変更 — 同じ文章でもトークン数が約30%増える(増え方は中身によって変わる)*3
4つ目は、1つの仕事に使うトークンが増える方向に働きます。平均75%減は、この増加分も計算に入れたうえでの数字です。長いプロンプトを投げることが多い使い方なら、下がり幅は75%より小さくなると見ておくのが安全です。
同時発表|Sonnet 5.5のキャッシュ半額、MaxとTeamにAPIクレジット
Haiku 5.5と同時に、2つの発表がありました。
- Sonnet 5.5のキャッシュ読み込みが半額 — 100万トークンあたり$0.20から$0.10へ。キャッシュ読み込みはトークン消費の大きな割合を占めるため、ほとんどのエージェント作業でSonnet 5.5のコストが約20%下がる
- MaxとTeamに毎月のAPIクレジット — 発表の週から順次展開。Claude PlatformでAPIを呼ぶツール・アプリ・エージェントづくりを試すためのもので、どのモデルにも使える
| プラン | 毎月のAPIクレジット |
|---|---|
| Claude Max 5x | $100 |
| Claude Max 20x | $200 |
| Claude Team | 最大$500(ユーザー間で共有) |
ここまで読んで「Haiku 5.5を自社のシステムや業務フローに組み込みたい」と感じた方へ。法人向けAI研修の導入社数No.1*の弊社デジライズが、AIコンサルティング&開発のサービス資料を無料でお送りしています。既製のAIサービスでは要件が満たせず、自社に合わせたシステム構築や環境の検討が必要な場合の進め方をまとめています。
※出典:株式会社東京商工リサーチ「法人向けリスキリングサービスに関する調査」(2026年5月/調査期間:2026年3月26日〜4月17日/調査方法:デスクリサーチおよびヒアリング/2026年3月末時点)
性能|Haiku 4.5から大幅アップ、比較6項目でGPT-6 Lunaも上回る

Anthropicが公開したベンチマークでは、Haiku 5.5はHaiku 4.5から大きく伸び、OpenAIの小型モデルGPT-6 Lunaも、比較がある6項目すべてで上回りました。
| 項目 | 何を測るか | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5(参考) |
|---|---|---|---|---|---|
| GDPval-AA v2.1 | 44職種の実務(Elo) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | ナレッジワーク | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1(オフラインのサブセット) | パソコン操作 | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam(ツールなし) | 分野横断の推論 | 45.9% | 10.2% | — | 56.9% |
| Humanity’s Last Exam(ツールあり) | 分野横断の推論 | 57.4% | 18.7% | — | 64.5% |
| Terminal-Bench 4.0 | コマンドライン作業 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1(Main) | エージェント型コーディング | 46.4% | — | 42.4% | 52.1% |
| Chartography(ツールなし) | 図表の読み取り | 46.4% | 6.4% | 29.1% | 61.6% |
Sonnet 5.5は参考として載せています。FrontierCodeのSonnet 5.5はxhighでの値、「—」は公式の表に掲載がない項目です。
伸びが大きいのは、パソコン操作のOSWorld 2.1(15.7%→72.4%)と、コマンドライン作業のTerminal-Bench 4.0(0.0%→39.2%)です。図表の読み取りや分野横断の推論でも、Haiku 4.5の数倍のスコアになっています。
ただし、Sonnet 5.5との差はまだ大きく、Terminal-Bench 4.0では39.2%対70.6%です。Anthropicも、こうした複雑なエージェント型コーディングにはSonnet 5.5やOpus 5.5が引き続き良い選択だとしています。Haiku 5.5が最も向くのは、会話の圧縮・要約・サブエージェントのように範囲が絞られ、これまでコストが見合わなかった作業です。
比較相手のGPT-6 Lunaがどんなモデルかは、以下の記事で解説しています。
GPT-6 Sol・Lunaとは?API料金は半額に。Astraとの違いと使い分け
早期導入企業の評価
早期導入企業の評価も出ています。数字はどれも、各社が自社の用途で測ったものです。
- Asana — AIエージェント製品の評価で、今使っているモデルよりタスク完了までのレイテンシが30%以上減り、エージェントの1ターンあたりの推論は最大2.5倍速くなった
- HubSpot — 商談レポートなどのCRMタスクで、この評価で見た中の最高スコア(3回平均92.8%)。古く曖昧なレコードを探す監査タスクでは、試した全モデルの中で最速・最高ヒット率・最低誤検知率だった
- Box — 初期テストで、Haiku 4.5より11ポイント高いスコアを約半分のレイテンシで出した
- Cognition — Devin Fusionの補助役にHaiku 5.5を入れても、FrontierCodeのスコア66.2を保ったままコストとレイテンシを削減。リード役はOpus 5.5
effort|Haikuで初めて「考える深さ」を選べる

Haiku 5.5は、Haikuとして初めてeffort(考える深さ)を調整できるようになりました。コストを優先するか、賢さを優先するかを、仕事ごとに選べます。
- 段階 — low・medium・high・xhigh・maxの5段階
- 既定 — medium(APIでもClaude Codeでも同じ)
- 適応型思考(Adaptive thinking) — 既定でオン。effortがhigh以下なら、thinkingをオフにもできる
- 調整のしかた — 品質と速度・コストのバランスは、thinkingのオンオフではなくeffortで調整するのが推奨
effortを上げれば考える量が増え、そのぶんコストもかかります。精度との兼ね合いは、パソコン操作(OSWorld 2.1)・実務タスク(GDPval-AA v2.1)・推論(HLE)の3つで、段階ごとに公開されています。
使い分けの目安です*4。
| 場面 | effort |
|---|---|
| チャット・短いツール作業・単純で大量のリクエスト | low(最も安く速い) |
| ふだんの処理・エージェント型コーディング・迷ったとき | medium(既定のまま) |
| ナレッジワーク・長めのエージェント作業・指示を厳密に守らせたいとき | high |
| 上げた効果をあなたの用途で測れた仕事 | xhigh・max(Sonnet 5.5と性能・コスト・速度を比べたうえで) |
なお、長いエージェント用のプロンプトをlowで動かすと、検索を飛ばしたり、確認を省いたり、早めに止まったりしやすくなります。
大量に回す処理ほど、effortの差が請求額に積み上がります。まずは既定のmediumで結果を見てから、下げるか上げるかを決めてください。
使いどころ|大量処理・サブエージェント・リアルタイム対応

Haiku 5.5が向くのは、決まった処理を素早く何度も繰り返す仕事と、速度が要る仕事です。用途ごとに、Sonnet 5.5・Opus 5.5との使い分けを表にしました。
| やりたいこと | おすすめ | 理由 |
|---|---|---|
| 要約・会話の圧縮・分類・抽出・振り分けを大量に回す | Haiku 5.5 | 素早く繰り返す処理を、安く安定してこなせる |
| データベースへの問い合わせ | Haiku 5.5 | 同上 |
| コーディング作業のサブエージェント | Haiku 5.5 | Opus 5.5・Sonnet 5.5と組み合わせやすい |
| ライブの顧客対応・ブラウザ操作 | Haiku 5.5 | 現行のClaudeで最速 |
| 複雑なエージェント型コーディング | Sonnet 5.5・Opus 5.5 | Terminal-Bench 4.0ではSonnet 5.5が70.6%、Haiku 5.5は39.2% |
| 長い作業を指揮するリード役 | Opus 5.5 | Haiku 5.5を補助役にして、コストと待ち時間を抑えられる |
サブエージェントの使い方は、Rogoの例が分かりやすいです。大きいモデルが資料を作っている間に、Haiku 5.5のサブエージェントが10-K(米国企業の年次報告書)からセグメント別の売上を拾ってきます。
あわせて、ClaudeのPython・TypeScript SDKがcomputer useとbrowser useにベータ対応しました。Haiku 5.5は速度・能力・価格のバランスから、こうしたパソコン操作やブラウザ操作に特に向いています。browser useツールは、Claude APIとGoogle Cloudで使えます。
リード役に向くOpus 5.5の料金・性能・effortの選び方は、以下の記事にまとめています。
Claude Opus 5.5とは?料金・性能・effortの選び方と4モデル実機比較
Haiku 4.5から乗り換えるときの注意
Haiku 4.5向けのコードをモデルIDだけ差し替えると、エラーになる指定があります。次の7点を確認してください。
- トークン数が増える — 新しいトークナイザーで、同じ文章でも約30%増える。プロンプトの長さ、
max_tokens、コストの見積もりを見直す - サンプリングの指定はエラーになる —
temperature・top_p・top_kを既定以外にすると400エラー。指定を外す - prefillは使えない — assistantメッセージで応答の書き出しを指定するとエラー。messagesはuserで終える
- 手動の拡張思考は使えない —
budget_tokensを指定するとエラー。適応型思考に置き換える - thinkingも
max_tokensに数えられる — 上限が小さいと考えるだけで止まることがある。応答がthinkingブロックから始まることもあるので、先頭のブロックを答えとして読まず、typeで選ぶ - 安全分類器が断ることがある —
stop_reasonが"refusal"で返る場合があるので、クライアント側で処理を用意する - computer useのツール指定が変わる — Claude APIとGoogle Cloudでは、
computer_20250124をcomputer_toolset_20260801に置き換える
安全性
安全面の変更は次の2つです。
- アラインメント — Haiku 4.5に比べ、ほぼすべての評価で大きく改善。意図に沿わない振る舞いの事例がはるかに少なく、悪用に協力する傾向も低い
- サイバー — Haiku 4.5より制限が厳しく、ほかの最近のモデルよりはやや緩い。防御側のタスクはSonnet 5.5より広く許可し、ペネトレーションテストのような攻撃に使いやすい手法は引き続きブロックする
「Claudeをチームの開発や業務で使いこなせる状態にしたい」といった情報収集段階でのご相談も大歓迎です。導入の流れや具体的な支援内容をまとめた資料を以下よりご覧いただけますので、ぜひお気軽にご活用ください。
まとめ

Claude Haiku 5.5のポイントをまとめます。
- コスト — Haiku 4.5より平均約75%安い。10万トークン以下なら単価は10分の1、超えると半額
- 仕様 — コンテキストは100万トークン、最大出力は12.8万トークンに拡大。現行のClaudeで最速
- 性能 — Haiku 4.5から大きく伸び、GPT-6 Lunaとの比較がある6項目すべてで上回る。ただし複雑なエージェント型コーディングはSonnet 5.5・Opus 5.5が上
- effort — Haikuで初めて考える深さを選べる。まずは既定のmediumから
要約や分類のような大量処理から置き換えていくのが、私のおすすめです。Haiku 4.5で動かしている処理があれば、乗り換えの注意点を確認したうえで、ぜひ試してみてください。
