Claude Haiku 4.5の料金と仕様 — レガシー化した今も使える条件
Claude Haiku 4.5は200Kコンテキスト・$1/$5・extended thinkingのみ。Haiku 5.5の登場でレガシーになった今、モデルID・退役日・5.5との差を示します。
Claude Haiku 4.5は、2025年10月15日に公開されたAnthropicの小型モデルです。コンテキストウィンドウは200K、最大出力は64K、料金は入力$1・出力$5(100万トークンあたり)。thinkingはbudget_tokensを指定する従来型のextended thinkingだけに対応します。
2026年10月7日にClaude Haiku 5.5が出たため、公式ドキュメントはHaiku 4.5を「Legacy」に分類しています。ただしステータスは「Active (legacy)」で、まだ呼び出せます。この記事は、4.5の仕様・料金・モデルID・退役日をまとめ、5.5へ移るときに壊れる箇所を示します。
Claude Haiku 4.5の主な数字
コンテキスト
200K
最大出力は64K
料金(入力 / 出力)
$1 / $5
Batch APIは50%引き
thinking
Extended
adaptive thinkingは非対応
知識カットオフ
2025年2月
信頼できる範囲
Haiku 4.5はいま何の位置にあるか
Haiku 4.5は、Haiku 5.5が出るまで最新のHaikuでした。公式のモデル概要ページは冒頭で「Legacy」と明記し、性能向上のためにHaiku 5.5への移行を検討するよう案内しています。節目の日付は次の3つです。
Haiku 4.5のライフサイクル
- 2025-10-15Claude Haiku 4.5を公開
モデルID
claude-haiku-4-5-20251001として提供が始まりました。 - 2026-10-07Claude Haiku 5.5を公開
Haikuの最新モデルが5.5に替わり、4.5はレガシーになりました。
- 2026-10-15退役の下限日
モデル廃止の表で、退役は「Not sooner than October 15, 2026」とされています。
Haikuの5.5は、公式の比較表でレイテンシが「Fastest」に分類されています。4.5の時代に「最速」と呼ばれた席は、すでに5.5に移っています。4.5を最速モデルとして紹介する古い記述を見かけたら、Haiku 5.5のほうが新しいと読み替えてください。Haiku 5.5の側から見た整理はClaude Haiku 5.5の記事にあります。
仕様を一覧で確認する
公式の仕様表から、選定に効く項目を抜き出します。
| 項目 | Claude Haiku 4.5 |
|---|---|
| コンテキストウィンドウ | Claude Haiku 4.5200Kトークン |
| 最大出力 | Claude Haiku 4.564Kトークン(同期のMessages API) |
| thinking | Claude Haiku 4.5Extended(手動のbudget_tokens方式) |
| effortパラメータ | Claude Haiku 4.5非対応 |
| 入出力 | Claude Haiku 4.5テキストと画像を入力、テキストを出力 |
| 信頼できる知識カットオフ | Claude Haiku 4.52025年2月 |
| 学習データのカットオフ | Claude Haiku 4.52025年7月 |
知識カットオフには2種類あります。「信頼できる」範囲は2025年2月、学習データそのものは2025年7月までです。2025年3月以降の出来事を聞くと、答えが不安定になる可能性があります。最新の製品名やバージョンを尋ねる用途では、検索やプロンプトで情報を渡す前提で設計するのが無難です。
コンテキストの感覚も押さえておきます。公式の換算では、200Kトークンはおよそ15万語です。現行のトークナイザーを使うモデルは1Mトークンを持つため、長い資料を丸ごと入れる用途では4.5が先に上限に達します。1Mコンテキストの扱いはClaude 1Mコンテキストの実務活用で扱っています。
モデルIDはプラットフォームごとに違う
同じHaiku 4.5でも、呼び出す面によって書くIDが変わります。
| プラットフォーム | モデルID |
|---|---|
| Claude API | モデルIDclaude-haiku-4-5-20251001 |
| Claude APIのエイリアス | モデルIDclaude-haiku-4-5 |
| Amazon Bedrock | モデルIDanthropic.claude-haiku-4-5 |
| Amazon Bedrock(InvokeModel) | モデルIDanthropic.claude-haiku-4-5-20251001-v1:0 |
| Google Cloud | モデルIDclaude-haiku-4-5@20251001 |
| Microsoft Foundry | モデルIDclaude-haiku-4-5 |
| Claude Platform on AWS | モデルIDclaude-haiku-4-5 |
エイリアスclaude-haiku-4-5は、固定スナップショットclaude-haiku-4-5-20251001に解決される便宜上の名前です。再現性が必要な本番では、日付付きのIDを書いておくと、参照先が意図せず動きません。Bedrockには2系統のIDがあり、InvokeModel経由で使う場合は後者の形式になります。
モデルIDの命名規則そのものはClaudeモデルのid命名規則で解説しています。
料金はHaiku 5.5と何が違うか
Haiku 4.5の料金表は、すべて100万トークン(MTok)あたりです。
| 項目 | 料金 |
|---|---|
| 入力 | 料金$1 |
| 出力 | 料金$5 |
| 5分キャッシュ書き込み | 料金$1.25 |
| 1時間キャッシュ書き込み | 料金$2 |
| キャッシュ読み取り | 料金$0.10 |
| Batch API | 料金入出力とも50%引き |
キャッシュ読み取りは入力単価の10%です。同じプロンプトを繰り返し送る処理では、ここで差が出ます。
Haiku 5.5の価格は、プロンプトの長さで2段階に分かれます。10万トークン以下は入力$0.10・出力$0.50、10万トークンを超えると入力$0.50・出力$2.50です。単価だけ見ると5.5は4.5の10分の1ですが、そのまま比べるのは危うい点があります。
5.5は新しいトークナイザーを使い、同じ文章が4.5より約30%多いトークンになります(増え方は内容で変わります)。目安として、4.5で入力$1かかっていた文章を5.5で送ると、トークンが1.3倍になるので、10万トークン以下の枠なら$0.10×1.3=約$0.13です。出力側は$0.50×1.3=約$0.65で、4.5の$5に対してやはり大幅に低くなります。
価格差は大きくても、見積もりは5.5のトークン数で作り直す必要があります。max_tokensの上限も4.5向けの値のままでは足りなくなることがあります。
extended thinkingのみとは何を意味するか
Haiku 4.5のthinkingは手動方式です。リクエストでthinking.typeをenabledにし、budget_tokensでthinkingに使うトークン数の予算を渡します。モデルが考える量を自分で決める「adaptive thinking」は使えません。
4.5向けのリクエストは、次の形になります(公式の移行ガイドにある4.5側の例です)。
{
"model": "claude-haiku-4-5",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "..." }]
}budget_tokensには守る条件が2つあります。
- 1,024トークン以上にする。これより小さい値はAPIが拒否します
max_tokensより小さくする。thinkingのトークンもmax_tokensに数えられるため、最終回答の分を残す必要があります
小さな課題では1,024に近い値から始めて増やし、複雑な課題では16,000トークン以上から調整する、という出発点が示されています。
もう1つの制約が、interleaved thinking(ツール呼び出しの合間に考える動き)です。Haiku 4.5は対応しておらず、Claude APIでは対応用のベータヘッダーを付けても受け付けるだけで無視されます。ツールを何度も呼ぶエージェント処理で、結果ごとに考え直させたい場合は、この点が5.5との差になります。
type: "adaptive"を4.5に送ると400エラーです。逆に、5.5へenabledとbudget_tokensを送っても400になります。モデルを切り替えるときは、thinkingの指定を書き換える作業が必ず発生します。
両方式の違いはExtended thinkingとAdaptive thinkingの違いに対応表があります。
退役日は「下限」であって確定日ではない
モデル廃止の表で、claude-haiku-4-5-20251001のステータスは「Active」、退役日の欄は「Not sooner than October 15, 2026」です。
これは「2026年10月15日より早くは退役しない」という最低保証で、その日に止まるという意味ではありません。同じ表の他のモデルを見ると、Sonnet 4.5は非推奨の発表(2026年9月30日)から退役(2026年11月30日)までの日付が確定しています。Haiku 4.5には、そうした非推奨の発表日がまだ付いていません。
実務で効くのは、IDの固定の仕方です。エイリアスを使っていると、公式がエイリアスの向き先を替えたときに挙動が変わる可能性があります。退役が発表されてから慌てて直すより、日付付きIDで固定したうえで、移行先の検証を並行して進めるほうが余裕が出ます。固定とエイリアスの使い分けはClaudeモデルの退役に備えるピン留めとエイリアスが詳しく扱っています。
Haiku 5.5へ移るときに壊れる箇所
4.5のまま使い続けても、公式の案内上は問題ありません。移行を検討する場合は、次の変更点が実装に当たるかを確認します。
| 変更点 | 4.5での扱い | 5.5での扱い |
|---|---|---|
| thinking | 4.5での扱いenabled + budget_tokens | 5.5での扱いadaptiveのみ。enabledは400 |
| サンプリング | 4.5での扱いtemperature / top_p / top_kを受け付ける | 5.5での扱い省略が前提。temperatureは1、top_pは0.99以外だと400 |
| assistantプリフィル | 4.5での扱いthinkingオフなら可 | 5.5での扱い400エラー |
| トークナイザー | 4.5での扱い旧方式 | 5.5での扱い同じ文が約30%多いトークンになる |
| 画像 | 4.5での扱い長辺1,568ピクセル超で縮小 | 5.5での扱い長辺2,576ピクセルまで処理する高解像度枠 |
| Priority Tier | 4.5での扱い対応 | 5.5での扱い非対応 |
| computer use | 4.5での扱いcomputer_20250124 | 5.5での扱いcomputer_toolset_20260801のツールセットのみ(Claude APIとGoogle Cloud) |
このうち、コードを触らずに済まないのは、thinking、サンプリング、プリフィルの3つです。いずれも400エラーで失敗するため、モデルIDだけ差し替えると動きません。
Priority Tierの契約をHaiku 4.5で結んでいる組織は、容量の計画を別に立てる必要があります。5.5ではPriority Tierが使えないためです。
移行作業を機械的に進めたい場合は、Claude Codeで/claude-api migrateを実行できます。モデルIDの置換と、破壊的なパラメータ変更への対応、チェックリストの出力までを、編集前に範囲を確認したうえで行うスキルです。移行ガイドには次の呼び出し例が載っています。
/claude-api migrate this project to claude-haiku-5-54.5を使い続けてもよい場面
Haiku 4.5が合うのは、次のような条件がそろうときです。
- thinkingの量をリクエストごとに固定したい。
budget_tokensは予測しやすいレイテンシや精密なコスト制御に向く、と公式も位置づけています - 既存のプロンプトが
temperatureの調整やプリフィルに依存していて、検証の工数をまだ割けない - Priority Tierで容量を確保している
反対に、200Kを超える入力を扱いたい、64Kを超える出力が必要、価格を下げたい、といった場合は5.5側の仕様が合います。サブエージェントにどのモデルを割り当てるかという観点はClaude Codeサブエージェントのモデル配分設計にまとめています。
軽量枠を超えて推論力を求めるなら、Claude Sonnet 5.5のような上位のラインが候補です。
まとめ
Haiku 4.5は200Kコンテキスト・$1/$5・extended thinkingのみという仕様のまま、レガシーとして提供が続いています。退役日は2026年10月15日を下限とする未確定の日付で、固定IDで使いつつ、5.5の検証を並行して進める余地があります。移行で手間になるのは、thinking・サンプリング・プリフィルの3点と、トークン数が約30%増える見積もりの作り直しです。