Claude Media
Claude Sonnet 5.5の使い分け — 開発者ブログが示すOpus 5.5との線引き

Claude Sonnet 5.5の使い分け — 開発者ブログが示すOpus 5.5との線引き

開発者ブログのPlaybooksがSonnet 5.5の実装ガイドを公開。Opus 5.5との使い分け、料金表、Claude Codeでの扱い、Sonnet 5からの移行と調整点を読み解きます。

要点

Claudeの開発者向けブログ(claude.dev/blog)のPlaybooksに、2026年9月28日付で「Building with Claude Sonnet 5.5」が載りました。著者はAddy Osmaniです。モデルの発表文ではなく、Opus 5.5とどう使い分け、いくらかかり、どう調整するかを書いた実装ガイドです。

ガイドの骨子

  • Sonnet 5.5はClaude 5.5ファミリーの2番目のモデルで、Sonnet 5より賢く効率的で、30%速い
  • 単価はSonnet 5と同じ(ただし料金ページではキャッシュ読み取りが半額の$0.10)。同じ仕事に使うトークンが減るため、多くの作業で最大30%安くなる
  • 明確な仕様と確認手段がある仕事はSonnet 5.5、判断を長く持続させる仕事はOpus 5.5から始める
  • Claude Code v2.1.284以降では、Claude API経由の sonnet エイリアスがSonnet 5.5を指す。既定モデルはOpus 5.5のまま
  • Sonnet 5からの移行は、モデルIDの変更に加えて5つの破壊的変更と応答形式の変化が1つある

モデルの仕様と破壊的変更の全体像はClaude Sonnet 5.5とはにまとめています。この記事は、ガイドが「何を基準に選ばせようとしているか」に絞って読みます。

あなたの選択肢はどう変わるか

Sonnet 5.5とOpus 5.5、どちらから始めるか

仕事の性質ごとの出発点は、次の表のとおりです。

仕事の性質最初に試すモデル
バグ修正や機能の素早い反復など、範囲が明確な日常のコーディング最初に試すモデルSonnet 5.5
大量に回す日常の開発作業最初に試すモデルSonnet 5.5
1枚資料、図、要約スライド、文書の修正、表の整理など、デザイン感覚が効く成果物最初に試すモデルSonnet 5.5
調査・レビュー・下書きのように、定型化した繰り返しのエージェント作業最初に試すモデルSonnet 5.5
慎重な判断が要る複雑な仕事。長丁場のエージェント的コーディングや知的作業を含む最初に試すモデルOpus 5.5
最も難しい問題で、最大の知能が要る場合最初に試すモデルOpus 5.5

判断基準は一文で書かれています。仕様がはっきりしていて、結果を確かめる手段がある仕事はSonnet 5.5が合う、という線引きです。プロンプトガイドからの引用として、最も難しい長期の仕事ではOpusのほうが適するとも添えています。

Epic GamesのCOOであるDaniel Vogelのコメントも載っています。早期テストでSonnet 5.5が上位モデル並みの水準に届き、ゲームプレイ構成の設計で数万行のコードを扱い、数時間のタスクも少ない指示でこなした、という内容です。

料金表の読みどころ

100万トークンあたりの単価は次のとおりです。

項目Sonnet 5.5Opus 5.5
入力Sonnet 5.5$2Opus 5.5$4
出力Sonnet 5.5$10Opus 5.5$20
キャッシュ書き込み(5分)Sonnet 5.5$2.50Opus 5.5$5
キャッシュ書き込み(1時間)Sonnet 5.5$4Opus 5.5$8
キャッシュ読み取りSonnet 5.5$0.10Opus 5.5$0.20

キャッシュ読み取りを除いて、Sonnet 5.5の単価はSonnet 5と同じです。読み取りだけは、Sonnet 5の$0.20から半額の$0.10になります。

表の5項目すべてで、Opus 5.5がSonnet 5.5のちょうど2倍です。単価が一律2倍でも、実際にかかる費用は作業ごとのトークン量で決まります。タスク単価で比べる手順はClaudeのモデル選びはタスク単価で比べるが詳しいです。

なお、ブログ本文の表はキャッシュ読み取りを$0.20としていますが、料金ページとSonnet 5.5のモデル概要ページはどちらも$0.10(入力単価の0.05倍)です。

表の外に、ガイドは3つの注意を書いています。

  • 米国限定の推論(inference_geo: "us")は標準価格の1.1倍
  • 高解像度の画像ティアを使い、長辺は最大2576ピクセル。2000×1500の画像は、Sonnet 4.6・Sonnet 4.5・Haiku 4.5のおよそ2.5倍のトークンを使う。細部が要らなければ送信前に縮小する
  • 既定のeffortは使う場所で違う。Claude Platformでは high、Claude Codeでは medium

Claude Codeで使うとき

Claude Code v2.1.284(Agent SDK for TypeScriptはv0.3.284以降)から、Claude APIでは sonnet エイリアスがSonnet 5.5に解決されます。既定のeffortは medium で、1Mコンテキストはそのまま使えます。

Claude Codeでは、Sonnet 5.5のthinkingをオフにできません。effortが思考量を決めます。fast modeもありません。既定モデルはOpus 5.5のまま(Microsoft Foundryの既定はSonnet 4.5)なので、範囲の明確な作業で切り替えて使う形になります。

# 起動時に指定する
claude --model sonnet
 
# セッション中に切り替える(Claude Code内)
/model sonnet

エイリアスの解決先はプロバイダーで違います。Claude Codeのモデル設定ページの表では、sonnet は次のように解決されます。

プロバイダーsonnet の解決先
Anthropic APIsonnet の解決先Sonnet 5.5
Claude Platform on AWSsonnet の解決先Sonnet 4.6
Amazon Bedrock、Google CloudのAgent Platformsonnet の解決先Sonnet 4.5
Microsoft Foundrysonnet の解決先Sonnet 4.5

ガイドが「Claude APIで解決される」と限定して書くのは、この差を踏まえているためと読めます。クラウド経由で使うチームは、フルのモデル名か ANTHROPIC_DEFAULT_SONNET_MODEL で固定する選択肢があります。Amazon BedrockでのモデルIDは anthropic.claude-sonnet-5-5、Microsoft FoundryではGlobal Standardデプロイのみで使えます。

同ページによれば、Sonnet 5.5にはClaude Code v2.1.284以降が必要です。古いバージョンで要求が失敗するときは、更新が先になります。リリース側の変更はClaude Code v2.1.284にあります。

Sonnet 5からの移行と運用で押さえること

Sonnet 5からの移行で変わる6点

ガイドは、モデルIDを claude-sonnet-5-5 に替えたうえで、5つの破壊的変更と応答形式の変更が1つあると整理しています。

変更内容
thinkingの無効化内容{"type": "disabled"} は400。最初の応答前の思考だけを省くなら between_tools
強制の tool_choice内容any と tool は400。auto と strict: true に替える
thinkingブロックの紐づけ内容Sonnet 5.5のブロックを読めるのは、Claude APIとGoogle CloudのOpus 5.5だけ
computer use内容Claude APIとGoogle Cloudでは computer_toolset_20260801 のみ。旧ツールは400(Bedrockは旧ツールも可)
advisorの組み合わせ内容Sonnet 5.5が実行側のとき、一部のOpusとSonnet 5はadvisorに使えない
ツール間の文章(形式の変化)内容1〜2文を超える注釈はthinkingブロックで返り、既定では空

between_tools が使えるeffortは low・medium・high までで、xhigh と max は400です。そのほかの併用制約はClaude Sonnet 5.5とはにあります。

Sonnet 5.5はSonnet 5のthinkingブロックを読めるので、会話の途中でSonnet 5から切り替えても推論は引き継がれます。逆方向は限られ、ほかのモデルへ切り替えると、それ以降のターンは推論なしで進みます(読めないブロックはAPIが落とし、リクエストは成功します)。

表の3行目の紐づけで見落としやすいのが、履歴を追記のみに保つ条件です。2026年8月31日以降に作られたアカウントでは、system・tools・過去のメッセージを編集してからthinkingブロックを送り直すと400になります。Sonnet 5.5とHaiku 5.5のブロックは、生成したアカウントか、それに紐づくアカウントでしか使えません。

ブログ本文には「ほかのどのモデルも読めない」とありますが、What's newとPreserved thinkingのページでは、Claude APIとGoogle CloudのOpus 5.5は読めると書かれています。

移行そのものはClaude Codeに任せられます。ガイドが挙げる呼び出しは次の1行です。

/claude-api migrate this project to claude-sonnet-5-5

同梱のClaude APIスキルが、モデルIDの置き換えと、破壊的なパラメータ変更をコードベース全体に適用します。

調整は「足す」より「外す」から

調整パートの中身は、実質的に4つの作業です。

手順

Sonnet 5.5へ移したあとの調整順

  1. 1

    effortを測り直す

    effortの水準は再較正されており、Sonnet 5と同じ設定が同じ思考量になるとは限りません。迷ったら high から始めます。エージェント的なコーディングや複数ステップのツール利用で、仕様がはっきりした作業なら medium、難しい作業や長い作業は high です。チャットや遅延に敏感な用途は medium か low。xhigh と max は、評価で品質の向上が見えた場面に限ります。

  2. 2

    Sonnet 5用の回避策を外す

    拒否の誘導、ツール呼び出しの再試行処理、「怠けるな」といった指示は、外してから評価を回します。

  3. 3

    検査の指示を足す

    低いeffortでは、変更を動かす検査を省くことがあります。その場合は、実行可能なコードを変えたらテスト・型検査・ビルドなどで実際に確かめてから完了を報告させる段落をシステムプロンプトに足します。文面はガイドに全文があり、Sonnet 5.5のプロンプトガイドでも扱っています。

  4. 4

    進捗は思考の要約で受ける

    推論をそのまま応答に書かせると、reasoning_extraction の拒否を招きます。進捗を見せたいなら thinking.display を summarized にします。ツール間の短い更新だけなら、ベータの updates です。

思考量を減らしたいときも、システムプロンプトで「あまり考えないで」と頼むだけでは確実に減りません。ガイドは、思考量を減らす手段としてeffortを下げる方法を示しています。max_tokens には思考分も数えられるので、エージェント的なコーディングでは上限の128,000にしてストリーミングを使います。

キャッシュについては2点あります。最小のキャッシュ対象は512トークンに下がりました(Sonnet 5は1,024)。短いシステムプロンプトやツール定義も対象になります。一方、リクエスト全体に指定するeffort(トップレベル)をリクエスト間で変えるとキャッシュが無効になります。ターンごとに水準を変えたいときは、キャッシュを保つper-message effort(ベータ、mid-conversation-output-config-2026-07-01 ヘッダー)を使います。Sonnet 5.5で使えるのはClaude APIとGoogle Cloudで、Amazon BedrockのSonnet 5.5では使えません。ただし between_tools を使っている場合は会話の途中でeffortを変えられず、異なる水準のper-message effortは400になります。

Claude API、Amazon Bedrock、Google Cloudでは、Sonnet 5.5で会話途中のシステムメッセージと会話途中のツール変更(ベータ)も使えます。既存のsystemやtoolsを書き換えるのではなく、会話の途中に追加する形なので、追記のみの条件とは両立します。

拒否とフォールバック

Sonnet 5.5は、最も高性能なモデルと同種のサイバーセキュリティ向け安全対策(safeguard)を備えた、最初のSonnetです。通常のソフトウェア開発の大半は影響を受けないとガイドは述べています。

拒否はHTTP 200で返り、stop_reason: "refusal" と、stop_details のカテゴリ(cyber・bio・frontier_llm・reasoning_extraction・general_harms)が付きます。サーバー側のフォールバック(fallbacks: "default"、Claude APIのベータ)でSonnet 5へ再試行されるのは、cyber と frontier_llm だけです。再試行はSDKのミドルウェアや自前の処理でも組めます。正当なセキュリティ業務向けのCyber Verification ProgramがSonnet 5.5にも広がる予定とも書かれています。

Haiku 5.5の位置

Haiku 5.5は「今後数週間」で5.5ファミリーに加わると、ガイドは予告していました。そのHaiku 5.5は10月7日にリリースされています。用途は大量・低遅延の処理です。

Claude Codeのモデル設定ページでは、すでに haiku エイリアスがAnthropic APIでHaiku 5.5に解決され、利用にはv2.1.293以降が要ると書かれています。料金ページとモデル概要ページにも、Haiku 5.5は価格つきで載っています。100,000トークンまでのプロンプトなら入力$0.10、出力$0.50(100万トークンあたり)です。Sonnet 5.5を中心に据えるときの下位の選択肢は、Anthropic API経由のClaude Codeでは、すでに選べる状態です。

Sonnet 5.5を使い分ける鍵はeffortの決め方にある

分量で見ると、ガイドの中心はモデルの比較ではありません。使い分けの表は短く、移行と調整のパートが大半を占めます。どちらのパートも、最後に行き着くのはeffortです。

根拠はガイドが示す順序にあります。最初に出す水準は high です。上げる場合は評価で裏づけを取ります。そして xhigh や max に手が伸びる場面では、課題によってSonnetの持ち味の一部を失うことがあるとして、Opus 5.5を検討するよう促しています。

そこから一歩進めると、Sonnet 5.5を max で回す前に、Opus 5.5を medium や high で試す比較が成り立ちます。ただしガイドの表は仕事の性質で線を引いているので、境目が思考量だけで決まるわけではありません。

注意したい点もあります。「最大30%安い」は、同じ仕事に使うトークンが「通常」減ることを前提にした一般論です。減る量は作業で決まり、ガイドに特定の作業での測定値は載っていません。自分の作業で、Sonnet 5と並べて測るのが前提になります。

同じブログには、9月25日付で「What a task costs on Opus 5.5」と「Using Claude Code: Spending your effort」が並んでいます。Opus 5.5の側はClaude Opus 5.5とはで扱っています。タイトルから見ると、3本はタスク単価とeffortを軸に並んでいます。

まとめ

移行で最初に止まるのは、thinking: disabled と強制の tool_choice が返す400です。ここを先に潰さないと、effortの比較まで進めません。effortを自分の作業で測り直したうえで、Opusの低めのeffortと並べて測ると、どちらが安く済むかが見えてきます。

この記事を共有:XはてブLinkedIn