Claude Opus 5の使い方と仕様 — 料金$5/$25・1Mコンテキスト・fast modeまで
Claude Opus 5は入力$5 / 出力$25、1Mコンテキスト・最大出力128Kのモデルです。thinkingが既定でオンになった変更、effortとfast mode、Claude CodeやAPIでの使い方をまとめます。
Claude Opus 5は、2026年7月24日に提供が始まったOpusクラスの最新モデルです。モデルIDは claude-opus-5、料金は入力$5 / 出力$25(100万トークンあたり)でOpus 4.8から据え置き、コンテキストウィンドウは1Mトークン、最大出力は128Kトークン。単価も機能表も4.8と同じなので「IDを差し替えるだけ」に見えますが、thinkingの既定が変わった点だけは実装に影響します。仕様と料金、利用面ごとの使い方、そしてFable 5との分け方を順に追います。
Claude Opus 5とは — Fable 5の半額で、その手前まで届くOpus
Claude Opus 5は、Opus 4.8の後継にあたる汎用の最上位モデルです。MythosクラスのClaude Fable 5($10 / $50)に対して単価はちょうど半分で、能力の頂点はFable 5に残しつつ、日常的に回す最上位ワークをOpusの単価帯に引き戻す枠として置かれています。
いちばん実務に効くのは、値段が上がらなかったことです。Opus 4.8を主力にしていたなら、料金の再試算なしにIDを差し替えられます。発表当日の内容やベンチマークの詳細はClaude Opus 5が登場 — Fable 5の知性に半額で迫る新最上位にまとめてあるので、ここでは仕様と使い方を掘ります。
2026年7月時点のモデル階層に置くと、Opus 5は次の場所に入ります。
| クラス | 代表モデル | 料金(入力 / 出力、per MTok) | 主な用途 |
|---|---|---|---|
| Mythos | 代表モデルFable 5 | 料金(入力 / 出力、per MTok)$10 / $50 | 主な用途能力の上限が要る長時間の自律タスク |
| Opus | 代表モデルOpus 5 | 料金(入力 / 出力、per MTok)$5 / $25 | 主な用途エージェント / コーディング / 深い推論の主力 |
| Opus | 代表モデルOpus 4.8 | 料金(入力 / 出力、per MTok)$5 / $25 | 主な用途前世代。Opus 5のフォールバック先 |
| Sonnet | 代表モデルSonnet 5 | 料金(入力 / 出力、per MTok)$3 / $15 | 主な用途日常の実装・調査 |
| Haiku | 代表モデルHaiku 4.5 | 料金(入力 / 出力、per MTok)$1 / $5 | 主な用途分類・抽出・大量バッチ |
Anthropicの開発者向けドキュメントは、モデルを明示的に指定しない限り claude-opus-5 を使う前提で書かれています。Fable 5を選ぶのは「Fable 5でなければ」という要件があるときだけ、という順序です。
仕様リファレンス — 1Mコンテキスト・128K出力・thinking既定オン
主要スペックは次のとおりです。1Mトークンのコンテキストウィンドウは既定値であると同時に上限値でもあり、長いコンテキストに対する追加料金はありません。
| 項目 | Claude Opus 5 |
|---|---|
| モデルID | Claude Opus 5claude-opus-5(日付サフィックスなし) |
| コンテキストウィンドウ | Claude Opus 51Mトークン(既定かつ最大) |
| 最大出力 | Claude Opus 5128Kトークン |
| thinking | Claude Opus 5adaptive。指定を省略するとオンで動く |
| effort | Claude Opus 5low / medium / high / xhigh / max(既定high) |
| トークナイザー | Claude Opus 5Opus 4.7世代(Opus 4.8と同じ) |
| プロンプトキャッシュの最小長 | Claude Opus 5512トークン |
| fast mode | Claude Opus 5対応($10 / $50、Claude APIのみ) |
表のうち3行は、Opus 4.8から実際に変わった箇所です。thinkingの既定、キャッシュの最小長、そしてfast modeの単価。それぞれ後の節で扱います。
thinkingが既定でオンになった — Opus 4.8から実装が変わる唯一の点
Opus 4.8では thinking を省略したリクエストは思考なしで走りましたが、Opus 5では同じリクエストがadaptive thinkingで走ります。{"type": "adaptive"} を明示した場合と同じ挙動です。
これがコストと出力長の両方に効きます。max_tokens は思考と応答テキストの合計に掛かる上限なので、思考ゼロを前提に max_tokens を答えの長さギリギリに詰めていた経路は、Opus 5では応答が途中で切れます。thinking を一度も設定していないコードほど影響を受けます。
思考をオフにしたい場合の制約が、もうひとつあります。
# 400 になる組み合わせ:thinking 無効化 + effort xhigh / max
thinking = {"type": "disabled"}
output_config = {"effort": "xhigh"}thinking: {"type": "disabled"} が受け付けられるのはeffortがhigh以下のときだけで、xhighとmaxに組み合わせると400が返ります。しかもこの検証はリクエスト単位です。会話の途中でeffortをxhighへ上げると、それまで通っていた同じ会話の続きが弾かれます。
思考をオフにする運用そのものにも副作用があります。thinkingを無効化したOpus 5は、ツール呼び出しを tool_use ブロックではなく本文のテキストとして書いてしまうことがあります。ターンは正常終了し、エラーも出ず、ツールだけが実行されません。エージェントループではその偽の呼び出しが履歴に残り、後続のターンを歪めます。<thinking> タグが応答本文に漏れる事例も報告されています。
対策はシンプルです。thinkingはオンのまま、effortをlowかmediumへ落とす。トークンと待ち時間の節約という目的はこれでほぼ達成でき、上の2つの不具合も踏みません。どうしてもオフが必要なら、「ツールを使う前に一言添えてよい」と伝える指示が有効で、逆に「考えるな」「推論するな」系の指示はタグ漏れを悪化させます。
effortはxhighから始めて、下へ振る
Opus 5のeffortは5段階すべてに対応し、ベータヘッダーは不要です。既定はhighです。
出発点の推奨は用途で分かれます。コーディングとエージェントはxhigh、それ以外の判断の質が要る仕事はhigh。ここまではOpus 4.8と同じ考え方です。違うのは、そこから下げたときの粘りです。Opus 5はlowとmediumでも素性がよく、トークンと待ち時間を大きく削っても品質が保たれる領域が前世代より広くなっています。
| effort | 想定用途 | 補足 |
|---|---|---|
| max | 想定用途正しさがコストより重い最難問 | 補足単純なタスクでは考えすぎになりやすい |
| xhigh | 想定用途コーディング / エージェント | 補足出発点として推奨。max_tokens は64K以上を確保 |
| high | 想定用途判断の質が要る一般業務 | 補足API既定値 |
| medium | 想定用途定型寄りの処理 | 補足品質が保てる範囲を実測で探す |
| low | 想定用途短く閉じたタスク / 待ち時間優先 | 補足サブエージェント用途にも |
xhighとmaxで走らせるときは max_tokens に64K以上を取っておきます。思考とツール呼び出しが同じ予算を食うため、切り詰めると答えの手前で止まります。
前世代の設定値をそのまま持ち込まないことが、Opus 5でいちばん効くチューニングです。Opus 4.8向けに固めたeffortが最適とは限らず、自前の評価セットでmedium / high / xhighを一度掃いてから決める価値があります。
fast modeは何が速くなり、どこで使えないか
fast modeは、同じモデルのまま出力トークンの生成を最大2.5倍まで速くするリサーチプレビュー機能です。Opus 5での単価は入力$10 / 出力$50(100万トークンあたり)で、通常単価のちょうど2倍にあたります。
使える面が限られる点に注意が要ります。
| 利用面 | fast modeの可否 |
|---|---|
| Claude API | fast modeの可否○(speed: "fast" + ベータフラグ) |
| Managed Agents | fast modeの可否○ |
| Claude Code CLI | fast modeの可否○(/fast コマンド) |
| Amazon Bedrock / Google Cloud / Microsoft Foundry | fast modeの可否× |
| Batch API / Priority Tier | fast modeの可否× |
APIから使うには3つが同時に必要です。ベータ版のmessagesエンドポイントを叩くこと、ベータフラグ fast-mode-2026-02-01 を渡すこと、そして speed: "fast" をトップレベルのリクエストパラメータとして置くこと。ヘッダーでも extra_body でもありません。
client.beta.messages.create(
model="claude-opus-5",
max_tokens=4096,
speed="fast",
betas=["fast-mode-2026-02-01"],
messages=[...],
)fast modeは通常のOpus枠とは別のレート上限を持ちます。429が返ったら retry-after に従って待つか、speed を外して通常速度に落とす形になりますが、速度を切り替えるとプロンプトキャッシュは無効化されます。キャッシュヒット率を稼いでいるワークロードでは、この切り替えコストが速度の利得を食う場面があります。
Claude Code側では、v2.1.219で /fast の対象がOpus 5とOpus 4.8に絞られ、Opus 4.7は高速モードから外れました。切り替えはCLIの /fast から行います。この更新でClaude Code側の高速モード単価も$10/$50に揃っています。
利用面ごとの使い方
Claude Code — v2.1.219以降でOpusを選べばOpus 5
Claude Codeでは、v2.1.219から /model でOpusを選んだときに起動するモデルがOpus 5になりました。既定のOpusモデルが差し替わった形で、セッション全体の既定モデルが変わったわけではありません。
/model opus
/effort xhigh
/fast同じ更新で /model ピッカーの表示が「Opus (1M context)」になり、コンテキスト長がその場で分かるようになりました。更新に含まれる変更の全体はClaude Code v2.1.219のリリースノートにまとめてあります。
claude.ai — Maxは既定、Proは選択
Claude Maxでは既定モデルがOpus 4.8からOpus 5に切り替わりました。モデルを明示せずに使っている構成なら、何もしなくてもOpus 5が走ります。ProではSonnet 5が既定のまま、最上位の選択肢としてOpus 5を選べます。FreeはSonnet 5のみです。
API — IDを差し替えるだけ
Messages APIでは model に claude-opus-5 を渡します。日付サフィックスは付けません。付けると404になります。
response = client.messages.create(
model="claude-opus-5",
max_tokens=16000,
output_config={"effort": "xhigh"},
messages=[{"role": "user", "content": "..."}],
)Opus 4.8からの差し替えでコードを直す必要があるのは、前述のthinking関連だけです。Opus 4.7以前から上げてくる場合は、budget_tokens や temperature の除去といった別の作業が加わります。手順はClaudeモデルの移行ガイドに分けてあります。
クラウド経由 — IDの前置きが分かれる
Amazon Bedrockでは anthropic.claude-opus-5 とプレフィックスが付き、Google CloudとClaude Platform on AWSではプレフィックスなしの claude-opus-5 をそのまま使います。Microsoft Foundryも提供対象です。ただしfast modeとBatch APIはこれらの経由では使えないため、その2つに依存した設計はClaude API側に寄せることになります。
Opus 5だけの新機能 — キャッシュ最小長とツール差し替え
プロンプトキャッシュの最小長が、Opus 4.8の1024トークンから512トークンへ下がりました。「短すぎてキャッシュに乗らない」と諦めていたシステムプロンプトが、コードを1行も変えずにキャッシュ対象になる可能性があります。移行のついでに cache_read_input_tokens を見直す価値がある変更です。
もう1つがベータ提供の会話途中のツール差し替えです。従来は tools を編集するとプロンプトの先頭が変わり、会話全体のキャッシュが飛びました。ベータヘッダー mid-conversation-tool-changes-2026-07-01 を付けると、{"role": "system"} のメッセージに tool_addition / tool_removal ブロックを載せてツールを出し入れでき、キャッシュされたプレフィックスが生き残ります。追加する側のツールは、あらかじめ tools に "defer_loading": true 付きで宣言しておく必要があります。
権限が変わるとツールが増減する業務エージェント、段階的にツールを開放するオンボーディング型のエージェントで、キャッシュコストの構造がそのまま改善します。
安全分類器で拒否されたときに何が起きるか
Opus 5にはサイバーセキュリティ領域を対象とする強めの分類器が入っており、これに引っかかったリクエストはエラーではなく正常応答として返ります。HTTPは200、stop_reason が "refusal"、stop_details に分類のカテゴリーが入る形です。
つまり response.content[0] を無条件に読むコードは壊れます。stop_reason を先に見る分岐が要ります。
拒否を実際に回復させたいなら、サーバー側のフォールバックを既定で入れておく組み方があります。ベータヘッダー server-side-fallback-2026-07-01 と fallbacks: "default" を渡すと、拒否のカテゴリーに応じてAnthropic側が推奨のフォールバック先へ回してくれます。サイバー分類のリクエストはOpus 4.8へ回るため、拒否が「別ラベルの失敗」に変わるのではなく実際に結果が返ります。フォールバック先をモデル名で固定するより、"default" に任せるほうが将来の非推奨化に追随しなくて済みます。
なお、Opus 5では生の思考過程が返らない設計になっています。thinking.display の既定は "omitted" で、"summarized" を指定すると要約された思考過程を取得できます。
Fable 5とOpus 5をどう分けるか
Opus 5から始めて、足りなければFable 5へ上げる。これが素直な順序です。単価が半分で、Fable 5に固有の制約もかからないためです。
| 判断軸 | Opus 5 | Fable 5 |
|---|---|---|
| 料金(入力 / 出力、per MTok) | Opus 5$5 / $25 | Fable 5$10 / $50 |
| thinking無効化 | Opus 5effort high以下でのみ可 | Fable 5不可(常時オン) |
| データ保持要件 | Opus 5なし | Fable 530日保持が必須(ZDR組織は利用不可) |
| fast mode | Opus 5対応 | Fable 5非対応 |
| Priority Tier | Opus 5非対応 | Fable 5対応 |
制約の欄が分岐点になります。ゼロデータ保持(ZDR)を敷いている組織はFable 5を選べないため、実質的にOpus 5が上限です。逆にPriority Tierで安定した処理量を確保している構成では、Opus 5がその対象外という逆転が起きます。この2つは能力の話ではなく契約と運用の話なので、性能比較より先に確認する項目です。
能力面では、CursorBench 3.2の最大effortでOpus 5がFable 5のピークまで0.5ポイント差に迫り、それを半額で出しています。差が0.5ポイントなら、多くのワークロードでは単価差のほうが大きくなります。一方で、数時間規模の自律実行や、曖昧で大きな問題を丸ごと預ける使い方では、Fable 5の頂点がまだ効きます。モデル全体の選び分けはClaudeモデル比較(使い分けと組み合わせ)が広く扱っています。
よくある質問
Opus 4.8のコードはそのまま動きますか
料金体系もパラメータの形も同じなので、IDの差し替えだけで動きます。ただし thinking を一度も指定していないコードは、Opus 5では思考がオンで走ります。max_tokens を応答の長さぴったりに詰めていた場合、途中で切れることがあります。
Opus 5とOpus 4.8で料金は変わりますか
単価は同じ$5 / $25です。ただしthinkingが既定でオンになった分、同じプロンプトでも出力トークンが増える場合があります。実請求で比べるなら、effortを一段下げた条件も含めて測るのが実態に近くなります。
日付付きのモデルIDはありますか
ありません。claude-opus-5 が正式なIDで、日付サフィックスを足すと404になります。日付なしのIDですが挙動が固定されたスナップショットとして扱われるため、バージョンを固定したい運用でもこのIDのまま使えます。
fast modeはどのプランで使えますか
Claude APIとManaged Agents、そしてClaude CodeのCLIから使えます。Amazon Bedrock / Google Cloud / Microsoft Foundry経由では利用できません。Batch APIとPriority Tierとの併用も対象外です。
effortはどこから試すのがよいですか
コーディングとエージェント処理はxhigh、それ以外はhighが出発点です。Opus 5はlowとmediumでも品質が落ちにくいので、そこから下げて自分の評価セットで品質が保てる下限を探すと、待ち時間とコストを削れます。
thinkingをオフにしても大丈夫ですか
effortがhigh以下なら設定自体は通ります。ただしツール呼び出しが本文テキストとして出力され実行されない事象や、<thinking> タグが応答に漏れる事象が知られています。thinkingはオンのまま、effortをlowかmediumに落とす形のほうが安全です。
まとめ
Claude Opus 5は、Opus 4.8と同じ$5 / $25、同じ1Mコンテキスト・128K出力のまま中身が上がったモデルです。移行で手を入れる必要があるのは、thinkingが既定でオンになった一点と、それに伴う max_tokens の見直しだけ。fast modeは$10 / $50でClaude APIとClaude Code CLIから、effortは5段階すべてが使えます。
副次的な変更のほうが効く場面もあります。プロンプトキャッシュの最小長が512トークンへ下がったことで、これまでキャッシュに乗らなかった短いシステムプロンプトが対象に入ります。レート上限がOpus 4.x系と別枠である点だけは、トラフィックを移す前に確認しておく項目です。Opus 4.7以前から一気に上げる場合は破壊的変更をまとめて踏むため、Claudeモデルの移行ガイドの経路別の手順が判断材料になります。
関連する記事
Claude をもっと見る →Claudeとは — Opus 4.8/Sonnet 5/Haiku 4.5の違いと料金・使い方
Claude Fable 5とは — 1Mコンテキスト・$10/$50のMythosクラスを仕様から使い方まで整理
Claudeモデル比較 — Fable / Opus / Sonnet / Haikuの使い分けと組み合わせ方
Claude 1Mコンテキストの実務活用 — 対応モデル・入る分量の目安・コスト設計
Fable 5とOpus 5の違い — 料金・データ保持・fast mode対応と用途別の選び分け
Claudeモデルの移行ガイド — Opus 4.xからClaude 5世代へ、model IDとコスト影響