Claude Haiku 5.5とは?
Claude Haiku 5.5は、AnthropicのClaude 5.5系列で最も小さく、標準速度では同社最速とされるモデルです。モデルIDは claude-haiku-5-5。Claude APIのほか、Amazon Web Services、Google Cloud、Microsoft Azureから利用できます。[1]
用途として挙げられているのは、文書の要約や圧縮、データベース問い合わせ、分類、カスタマーサポート、ブラウザー操作、上位モデルを支えるサブエージェントです。人が都度考える難しい判断を丸ごと任せるより、入力と正解条件を定義でき、回数が多い処理に向きます。
| 項目 | Claude Haiku 5.5 |
|---|---|
| モデルID | claude-haiku-5-5 |
| コンテキスト | 100万トークン |
| 最大出力 | 12万8000トークン |
| 思考量 | effortで調整、既定はmedium |
| 短いプロンプトの入力単価 | 100万トークン当たり0.10ドル |
| 短いプロンプトの出力単価 | 100万トークン当たり0.50ドル |
| 主な用途 | 分類、抽出、要約、検索補助、サブエージェント |

料金は10万トークンで5倍に分かれる
Haiku 5.5の料金表で重要なのは、1カ月の総利用量ではなく、ひとつのリクエストに含まれるプロンプトの長さで単価が分かれる点です。10万トークン以下と10万トークン超では、入力、出力、キャッシュの各単価が5倍違います。[1]
| 100万トークン当たり | プロンプト10万以下 | プロンプト10万超 | Haiku 4.5 |
|---|---|---|---|
| 入力 | 0.10ドル | 0.50ドル | 1.00ドル |
| 出力 | 0.50ドル | 2.50ドル | 5.00ドル |
| キャッシュ読み出し | 0.01ドル | 0.05ドル | 0.10ドル |
| キャッシュ書き込み | 0.125ドル | 0.625ドル | 1.25ドル |
例えば、短い分類リクエストを多数送る処理なら最低価格帯を使いやすい一方、巨大な資料を一度に渡すRAGや長い会話履歴では高い側の単価になります。入力500万トークン、出力100万トークンという同じ月間量でも、すべてのプロンプトが10万以下なら単純計算は1.00ドル、10万超なら5.00ドルです。実際の請求はキャッシュ、バッチ処理、思考トークンなどでも変わるため、この例は二段階料金の差を示す試算です。
Anthropicは平均で約75%安くなると説明していますが、短いプロンプトの表示単価はHaiku 4.5比で90%低く、長いプロンプトでは50%低いという混合結果です。旧版のリクエストの約90%が10万トークン以下だったことに加え、新しいトークナイザーで処理量が変わる点も織り込まれています。したがって、自社のログからプロンプト長の分布を出さずに「コストが4分の1になる」と決め打ちするのは早計です。
Haiku 4.5から何が変わった?
価格以外では、Haikuとして初めて effort で思考量を調整できるようになった点が大きな変更です。単純な分類はlow、複数段階の照合はmediumやhighというように、精度とコストの配分をタスクごとに変えられます。
Anthropic公表のベンチマークでは、デスクトップ操作を測るOSWorld 2.1でHaiku 5.5が72.4%、Haiku 4.5が15.7%。端末上の課題を測るTerminal-Bench 4.0では39.2%と0.0%でした。ただし、いずれも開発元が選んだ設定と評価条件による数字です。実務の正答率や安全性を保証するものではありません。詳しい評価条件はシステムカードで確認できます。[2]
移行はモデル名の置換だけでは終わりません。公式移行ガイドは、同じ文章でもトークン数が旧版よりおおむね30%増えるとして、上限と費用の再計算を求めています。また、手動の budget_tokens はadaptive thinkingへ、回答を最初のcontent blockとみなす実装はblock typeを見る方式へ変更が必要です。任意の temperature、top_p、top_k、assistant prefillもそのままではエラーになり得ます。[3]

Sonnet 5.5との使い分けは?
Haiku 5.5は「小さいSonnet」ではなく、狭く定義した処理を大量に回すための選択肢です。複雑なエージェント型コーディングでは、Anthropic公表のTerminal-Bench 4.0でSonnet 5.5が70.6%、Haiku 5.5が39.2%と差が残ります。設計、例外判断、最終レビューまでHaikuへ一括移行すると、単価は下がっても再処理や人の確認が増える可能性があります。[1]
実務では、次のように役割を分けると検証しやすくなります。
- Haiku 5.5:問い合わせの分類、項目抽出、長文の要約、検索結果の整形、定型的なサブタスク
- Sonnet 5.5:複数条件の計画、難しいコード変更、曖昧な例外の判断、最終成果物の評価
- 人:許認可、支払い、採用、公開など、誤りの影響が大きい最終決定
関連する小型モデルの選び方は、TechCreateの「GPT-6 SolとLunaの違いは?料金・速度・用途を比較」でも整理しています。価格表だけでなく、自社タスクの正答率、再試行率、応答時間を同じデータで比較することが重要です。
API料金と公開条件を切り分けて読む方法は「Mistral Large 4とは?料金と公開条件を整理」も参考になります。どのモデルでも、発表時の割引や試用クレジットと、継続運用時の単価を混同しないことが必要です。
第三者テストは何を示した?
第三者による初期テストはまだ限られます。DataCampは、請求書、発注書、納品記録を照合して24件を「支払う・保留・差し戻す」に分類するテストを実施しました。Haiku 5.5とHaiku 4.5はいずれも24件すべて正解し、Haiku 5.5の実行費は0.0098ドル、Haiku 4.5は0.25ドルだったと報告しています。[4]
ただし、これは1種類の課題を各モデル1設定で比べた小規模な実測です。Haiku 4.5側は1万6000トークンの思考予算、Haiku 5.5側はhigh effortで、単価だけでなく出力トークン数も結果に影響しています。「すべての業務で25倍安い」と一般化はできません。むしろ、正答率が同じタスクを見つけ、その範囲だけ置き換える手順の参考になります。
導入試験では、過去データから少なくとも正常例、境界例、例外例を分け、次の5項目を同時に記録すると判断しやすくなります。
- 業務上の正解とモデル回答の一致率
- 誤判定のうち、人や顧客への影響が大きい件数
- 1件当たりの入力・出力・思考トークン
- 95パーセンタイルの応答時間
- 再試行、人手確認、上位モデルへの引き上げを含む総費用
導入前に確認したい移行条件
Claude API、Bedrock、Google Cloud、Microsoft FoundryではモデルIDの表記が異なります。データ所在、監査ログ、権限管理、請求契約を既存クラウドに寄せたい場合は、API単価だけでなく提供経路も選定条件です。AWSはBedrockとClaude Platform on AWSでの提供に加え、IAM、CloudTrail、CloudWatch、Bedrock Guardrailsなどとの組み合わせを案内しています。[5]
既存のHaiku 4.5実装から移す前に、次を確認してください。
- 本番ログで10万トークンを超えるプロンプトの比率を測る
- 新しいトークナイザーで入力と
max_tokensを数え直す - thinking、sampling parameter、prefill、computer useの互換性をテストする
refusalとmodel_context_window_exceededの終了理由を処理する- タスク別の正答率と総費用をHaiku 4.5、Sonnet 5.5と同じ条件で比べる
- 誤判定の影響が大きい処理には人または上位モデルの確認を残す
Anthropicが同時に案内したMaxとTeam向け月次APIクレジットは、モデルの従量料金そのものを変更するものではありません。Max 5xは月100ドル、Max 20xは月200ドル、Teamは組織で最大500ドルのクレジットですが、恒久的な本番コストを試用枠だけで見積もらない方が安全です。[1]
まとめ
- Claude Haiku 5.5は、大量で狭く定義できる分類・抽出・要約を低コストで回すためのモデルです。難しい計画や最終判断まで一律に置き換える製品ではありません。
- 料金はプロンプト10万トークンを境に5倍変わります。新しいトークナイザーもあるため、自社ログを新モデルで数え直すことが見積もりの出発点です。
- 移行はモデルIDの変更だけでは完了しません。思考設定、sampling parameter、prefill、終了理由を含む互換性テストと、業務データでの正答率・総費用の比較が必要です。
出典・参考
- Anthropic「Claude Haiku 5.5」(2026年10月7日)
- Anthropic「Claude Haiku 5.5 System Card」(2026年10月7日)
- Anthropic「Claude Haiku 5.5 migration guide」(確認日:2026年10月9日)
- DataCamp「Claude Haiku 5.5: Features, Pricing, and a Hands-On Test」(2026年10月7日)
- Amazon Web Services「Introducing Claude Haiku 5.5 on AWS」(2026年10月7日)






