目次
2026年9月28日、Anthropic が Claude Sonnet 5.5 を公開した。発表によれば、6日前の Opus 5.5 に続く「Claude 5.5 ファミリーの2つ目のモデル」で、前の Sonnet 5(2026年6月30日公開)は Legacy(旧モデル・引き続き利用可)に移った。公式のモデル一覧での説明は「速さと知能の組み合わせが最もよいモデル」だ。
結論から言う。料金は Sonnet 5 とまったく同じ(100万トークンあたり入力 $2・出力 $10・キャッシュ読み取り $0.20)で、Anthropic の比較表では多くの行で Sonnet 5 から大きく伸びている。一方で API の扱いは変わり、Sonnet 5 で動いていたコードが 400 エラーになる変更が5つある。とくに 思考を切る thinking: {"type": "disabled"} が使えなくなり、代わりの between_tools は effort が high 以下でしか通らない。本記事は、公式ドキュメントと発表を原文で突き合わせ、何が変わったか・移行で何が壊れるか・Opus 5.5 とどう使い分けるかを実務の順に整理する。
2026年9月29日時点の情報:公開の翌日に、Claude Platform の公式ドキュメント(モデル一覧・Sonnet 5.5 のページ・What's new・移行ガイド・料金・thinking・effort・プロンプトキャッシュ)、Anthropic の発表、Claude Code のドキュメントと CHANGELOG、GitHub の changelog を原文で確認して書いています。発表が「数週間のうちに」と予告している Claude Haiku 5.5 は、この時点では公開されていません。
値段は据え置き、壊れる変更は5つ
— 公式の位置づけは「速さと知能の組み合わせが最もよいモデル」
1. Sonnet 5.5 の要点——性能・料金・移行の注意
Anthropic の比較表では、どの行も Sonnet 5 を上回り、GDPval-AA では Opus 5.5 に2点差まで迫る。ただし発表自身が「複雑で答えの決まっていない仕事では、Opus 5.5 がはっきり強いまま」と書いている。
単価は Sonnet 5 と全項目で同じ。変わったのはキャッシュできる最小の長さで、1,024 から 512 トークンに下がった。発表は「1タスクあたり最大3割安い」とするが、これは Anthropic 自身の測定だ。
思考の無効化は between_tools へ/強制ツール使用が 400/思考ブロックがモデルと会話に紐づく/旧 computer use ツール不可/advisor の組み合わせの5つ。加えて、ツール呼び出しの合間の文章が thinking ブロックで返る。
ひとことでまとめれば、「値段そのままで一段上がった Sonnet を、Opus 5.5 とほぼ同じ作法で扱う」のが Sonnet 5.5 だ。壊れる5つのうち3つ(強制ツール使用・思考ブロックの紐づけ・旧 computer use ツール)は、Opus 5.5 と Fable 5.1 にもある変更だ。Sonnet 5.5 だけの事情は、思考を切る手段が between_tools という別の値として残ったことと、advisor ツールの組み合わせの制限の2つになる。
2. 基本スペックと提供先
比較の相手は、置き換えられる Sonnet 5、上位の Opus 5.5、下位の Haiku 4.5 の3つにした。
| 項目 | Sonnet 5.5 | Sonnet 5(Legacy) | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| API モデルID | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
claude-haiku-4-5-20251001 |
| 料金(入力/出力) | $2 / $10 | $2 / $10 | $4 / $20 | $1 / $5 |
| コンテキスト / 最大出力 | 100万 / 12.8万 | 100万 / 12.8万 | 100万 / 12.8万 | 20万 / 6.4万 |
| 思考(thinking) | 適応的思考が既定(最小は between_tools) |
適応的思考が既定(disabled で切れる) |
適応的思考が常時オン(切れない) | 拡張思考(予算指定) |
| API の既定の effort | high | high | medium | 非対応 |
| 知識の信頼カットオフ | 2026年6月 | 2026年1月 | 2026年6月 | 2025年2月 |
| キャッシュできる最小の長さ | 512 トークン | 1,024 トークン | 512 トークン | 4,096 トークン |
| 速さ(公式の相対表記) | 速い | — | 中程度 | 最速 |
| 提供終了 | 2027年9月28日より前ではない | 2027年6月30日より前ではない | 2027年9月22日より前ではない | 2026年10月15日より前ではない |
出典:Anthropic「Models overview」、「Claude Sonnet 5.5」、「Claude Sonnet 5」、「Prompt caching」(2026年9月29日に確認)。速さは現行ラインナップ内の相対表記で、Legacy の Sonnet 5 には載っていない。提供終了日は Anthropic が運営するプラットフォームでの約束で、Amazon Bedrock と Google Cloud は各社が独自に決める。
表で Sonnet 5 と食い違うのは、「思考」「知識カットオフ」「キャッシュできる最小の長さ」の3行だけだ。コンテキストと最大出力、API の既定の effort は同じで、トークナイザーも Sonnet 5 と同じなので、同じ文章は同じトークン数になる(What's new)。Message Batches API では、ベータヘッダ output-300k-2026-03-24 を付けると出力の上限が30万トークンまで広がる(Sonnet 5 と同じ)。なお、temperature・top_p・top_k に既定以外の値を送ると 400 になる。これは Sonnet 5 でも同じで、Sonnet 4.6 以前から直接移る場合にだけ関係する。
提供先
Claude API(claude-sonnet-5-5)、Amazon Bedrock(anthropic.claude-sonnet-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry。公開日から全プラットフォームに出た。
claude.ai と Claude アプリ(公式は Sonnet 5.5 用のシステムプロンプトを公開している)、Claude Code(v2.1.284 以降)、GitHub Copilot(Pro・Pro+・Max・Business・Enterprise)。
fast mode(高速版)は料金ページの対象が Opus 5.5・Opus 5・Opus 4.8 だけで、Sonnet 5.5 には無い。Bedrock では構造化出力(strict tool use を含む)が Sonnet 5.5 で使えない(移行ガイド)。
3. 料金——Sonnet 5 と同額、変わるのはキャッシュの下限
公式の What's new は「Sonnet 5 と同じ料金で、プロンプトキャッシュとバッチ処理の料金も同じ」と書いている。細かい単価を並べると次のとおり。
| 100万トークンあたり | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| 入力 | $2 | $2 | $4 | $1 |
| 出力 | $10 | $10 | $20 | $5 |
| キャッシュ書き込み(5分) | $2.50 | $2.50 | $5 | $1.25 |
| キャッシュ書き込み(1時間) | $4 | $4 | $8 | $2 |
| キャッシュ読み取り | $0.20 | $0.20 | $0.20 | $0.10 |
| Batch API(入力/出力) | $1 / $5 | $1 / $5 | $2 / $10 | $0.50 / $2.50 |
出典:Anthropic「Pricing」(2026年9月29日に確認)。Batch API は入出力とも通常の50%引き。
「同額」の中で変わる2つのこと
単価が同じでも、請求額が同じになるとは限らない。変わりうる要素が2つある。
1つ目は、キャッシュできる最小の長さ。Sonnet 5 では 1,024 トークンに満たないプロンプトは、cache_control を付けてもキャッシュされなかった。Sonnet 5.5 はこの下限が 512 トークンに下がった。たとえば 800 トークンの system プロンプトとツール定義を毎回送っている処理は、Sonnet 5 ではキャッシュの対象外だったが、Sonnet 5.5 ではキャッシュされる。キャッシュされたかどうかは応答の usage で分かり、cache_creation_input_tokens と cache_read_input_tokens が両方 0 ならキャッシュされていない(公式の Prompt caching のページ)。下限に届かなくてもエラーは出ないので、黙ってキャッシュが効いていなかった処理がないか、移行のついでに見直す価値がある。
2つ目は、1タスクあたりのトークン数。発表は「同じ仕事に必要なトークンがずっと少なく、Anthropic のテストでは1タスクあたり最大3割安い」「出力の生成が Sonnet 5 より3割以上速い」と書いている。これは Anthropic 自身の測定だ。一方で公式ドキュメントは、effort の段が「較正し直された」ので、同じ段でも Sonnet 5 と同じ量だけ考えるとは限らないと書いている。思考のトークンは、表示されなくても出力トークンとして課金される。移行したら usage を実測して、自分の作業で比べ直すしかない。
試算:キャッシュ読み取り1,000万・入力50万・出力30万トークンのタスクを1回(トークン数は本記事の仮定。書き込み料金は省略)
- Sonnet 5.5:$2.00 + $1.00 + $3.00 = $6.00(Sonnet 5 も同じ)
- Opus 5.5:$2.00 + $2.00 + $6.00 = $10.00(Sonnet 5.5 の約1.7倍で、2倍ではない)
- Haiku 4.5:$1.00 + $0.50 + $1.50 = $3.00(Sonnet 5.5 のちょうど半分)
同じトークン数で比べた単価の計算で、実際にはモデルごとに使うトークン数が違う。単価は Anthropic「Pricing」による。
Opus 5.5 との差が「2倍」にならないのは、キャッシュ読み取りだけは Opus 5.5 も $0.20 で同額だからだ。キャッシュの比率が高いエージェント作業ほど、Sonnet 5.5 を選んで浮く額は小さくなる。Claude のモデル全体の料金はOpus・Sonnet・Haiku の料金比較にまとめている。
4. ベンチマーク——Anthropic の表の中で読む
発表の比較表は、Sonnet 5.5・Sonnet 5・Opus 5.5・GPT-6 Sol の4列だ。表の条件を先に書いておく。
- 表は Anthropic の発表に載ったもので、多くの行は Anthropic が測った値だ。例外として、GDPval-AA v2.1 と AA-Briefcase v1.1 は Artificial Analysis が実行した(表の注記3)。
- その Artificial Analysis の測定は公開前の環境で行われ、構造化出力を使うリクエストの応答を劣化させうる不具合があった。Anthropic は「影響があっても小さく、スコアを低く見せる方向」と注記し、不具合は修正済みとしている。
- Opus 5.5 の Terminal-Bench 4.0 は xhigh での値で、Opus 5.5 の最高スコア(注記1)。Sonnet 5.5 の FrontierCode は max で 46.2%、xhigh で 52.1% と2つ載っている(注記2)。
- GPT-6 Sol の GDPval-AA・AA-Briefcase・Chartography には、OpenAI が画像理解の不具合を直す前の値かもしれないという注記がある(注記4)。
| ベンチマーク | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 端末でのエージェント型コーディング |
70.6% | 10.3% | 66.4%(xhigh) | — |
| FrontierCode 1.1(Main) 変更がマージされるか |
52.1%(xhigh) 46.2%(max) |
42.4% | 54.4% | 49.3% |
| CursorBench 4.0 曖昧な複数ファイルの課題 |
55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1(Elo) 44職種の実務(Artificial Analysis が実行) |
1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1(Elo) 長時間の知識労働(Artificial Analysis が実行) |
1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam 分野横断の推論(ツールあり) |
64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1 PC操作(表の注記は「partial」) |
80.1% | 57.0% | 81.8% | — |
| Chartography グラフの読み取り(ツールなし) |
61.6% | 15.6% | 64.4% | 53.6% |
出典:Anthropic「Introducing Claude Sonnet 5.5」の比較表と注記(2026年9月28日、9月29日に確認)。太字はその行の最高値。「—」は表に値がないもの。測定方法の詳細は同じ発表が案内する Sonnet 5.5 のシステムカードにある。
読み取れることは3つある。
- Sonnet 5 からの伸びが大きい。Terminal-Bench 4.0 は 10.3% から 70.6%、Chartography(ツールなし)は 15.6% から 61.6% と、同じ表の中で数倍になった。GDPval-AA では約400点上がっている。
- Opus 5.5 との差は、多くの行で数ポイント以内だ。GDPval-AA は2点差、CursorBench は2.3ポイント差、OSWorld 2.1 は1.7ポイント差。Terminal-Bench 4.0 では Opus 5.5 の最高値(xhigh の 66.4%)を上回っている。
- それでも Anthropic は Opus 5.5 を上に置いている。発表は「ベンチマークは能力の一面しか捉えない。社内でも外部のテスターでも、判断を持続させる複雑で答えの決まっていない仕事では Opus 5.5 がはっきり強いまま」と書いている。
effort ごとのコスト——発表のグラフの説明文から
発表には、effort の段ごとのスコアとタスクあたりコストを並べたグラフもある。その説明文に書かれていることを並べる。
Claude のアプリの既定である medium で、Sonnet 5 の最高スコアを大きく上回り、タスクあたりのコストは10分の1未満。
Claude Platform の既定である high で、GPT-6 Sol の最高スコアに並び、タスクあたりのコストは約5分の1。同じ high の Sonnet 5 より10ポイント高く、コストは約15分の1。
最も低い low で、Sonnet 5 の最高スコアを上回り、タスクあたりのコストは10分の1未満。
medium で、Sonnet 5 の最高スコアを上回り、タスクあたりのコストは約9分の1。
出典:Anthropic「Introducing Claude Sonnet 5.5」のグラフの説明文。Terminal-Bench と CursorBench のグラフは、GPT-6 Sol の値が公開されていないため GPT-5.6 Sol を載せている(同ページの注記)。
ここで注目したいのは FrontierCode の2つの値だ。Sonnet 5.5 は max(46.2%)のほうが xhigh(52.1%)より低い。Anthropic の発表の注記によれば、max では Claude Code のコードレビュー用スキルを走らせることが増え、多数のサブエージェントに分けた結果、時間切れや作業範囲外の編集につながった例があったという。effort を上げれば必ず伸びるわけではないので、段は自分の作業で比べて決めたい(7章)。GPT-6 Sol 側の数字はGPT-6 Sol・Luna のリリース解説で扱っている。
Opus 5.5 の発表の表と混ぜないこと:同じ Opus 5.5 でも、Chartography は Opus 5.5 の発表では「ツールあり」で 89.0%、今回の表では「ツールなし」で 64.4% と、条件が違う値が載っている。2つの発表から数字を拾って並べると、条件の違う値どうしを比べることになる。比べるなら、同じ表の中の列どうしにとどめたい。
5. Sonnet 5 から移すと壊れる5つと直し方
公式の What's new in Claude Sonnet 5.5 は、Sonnet 5 で動いているコードに影響する破壊的変更を5つ挙げている。どれもエラーは 400 invalid_request_error だ。
① 思考を切るには disabled ではなく between_tools
Sonnet 5 は thinking: {"type": "disabled"} で、どの effort でも思考を切れた。Sonnet 5.5 では disabled が 400 になり、返るメッセージは次のとおり。
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
代わりに使うのが thinking: {"type": "between_tools"} で、回答の前にまとめて考える「前置きの思考」を止める、このモデルで最も低い思考の設定だ。ツールを使わないリクエストなら、Sonnet 5 の disabled と同じく応答は本文だけになる。ベータヘッダは要らず、Sonnet 5.5 を出しているどのプラットフォームでも使える。ただし disabled と同じつもりで置き換えると、次の3点でつまずく。
- effort が xhigh と max では 400 になる。
between_toolsが通るのは low・medium・high だけだ。Sonnet 5 で「xhigh + 思考オフ」にしていた処理は、effort を high 以下に下げるか、思考を切るのをやめるかを選ぶことになる。 - ほかの項目を一緒に送れない。
display・budget_tokens・block_bindingをbetween_toolsと一緒に送ると 400 になる。 - 会話の途中で effort を変えられない。メッセージごとの effort(ベータ)で今と違う段を送ると 400 になる。ターンごとに段を変えたいなら、適応的思考(
thinkingを省くか{"type": "adaptive"})を使う。
移行ガイドの前後の例を Python で示す。前の例が xhigh なので、後の例では high に下げている点に注意したい。
# Before:Sonnet 5 では通る。Sonnet 5.5 では 400 client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "disabled"}, output_config={"effort": "xhigh"}, messages=[{"role": "user", "content": "..."}], ) # After:前置きの思考を止める。effort は high 以下 client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, thinking={"type": "between_tools"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )
between_tools でも、ツール呼び出しの合間に書く短い進捗メモは、要約の文つきの thinking ブロックで返る。これを捨てずに、アシスタントのターンの残りと一緒にそのまま送り返す。送り返したブロックからは、モデルが書いたメモの全文がモデルに渡る(What's new)。手動の予算指定 {"type": "enabled", "budget_tokens": N} は、Sonnet 5 と同じく 400 のままだ。
② 強制ツール使用がエラーになる
tool_choice を {"type": "any"} や {"type": "tool", "name": "..."} にすると 400 になる。トークン数を数える API も同じ判定だ。使えるのは auto(既定)と none だけ。
tool_choice: type "tool" and "any" are not supported for this model.
対処:tool_choice は auto のまま、ツール定義に strict: true を付ける(strict tool use)か、スキーマを構造化出力に移す。auto ではモデルがツールを呼ばずに文章で答えることもあるので、「どういうときにそのツールを使うか」をプロンプトに書く。strict tool use が受け付けるのは JSON Schema の一部だけで、スキーマ内のすべての object に additionalProperties: false が要る。1リクエストで strict にできるツールは20個までで、MCP・computer use・browser use のツールセットには strict を付けられない。
# Before:Sonnet 5 では通る。Sonnet 5.5 では 400 client.messages.create( model="claude-sonnet-5", max_tokens=1024, tools=tools, tool_choice={"type": "tool", "name": "get_weather"}, messages=[{"role": "user", "content": "What's the weather in Paris?"}], ) # After:auto + strict。いつ使うかは文章で伝える client.messages.create( model="claude-sonnet-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
Amazon Bedrock では事情が違う。Bedrock の Sonnet 5.5 では構造化出力(strict tool use を含む)が使えないので、strict を付けずに auto を送り、いつツールを呼ぶかをプロンプトに書き、ツールの入力は自分のコードで検証する(移行ガイド)。
③ 思考ブロックがモデルと会話に紐づく
thinking ブロックには、どのモデルが作ったかが記録されている。Sonnet 5.5 は Sonnet 5・Opus 4.8・Haiku 4.5 とそれ以前のモデルの思考ブロックは読めるが、Opus 5・Opus 5.5・Fable・Mythos のものは読めない。そして、Sonnet 5.5 の思考ブロックを読めるほかのモデルは無い。
- Sonnet 5 → Sonnet 5.5 への切り替えは、それまでの推論を引き継ぐ。
- Sonnet 5.5 → ほかのどのモデルへの切り替えも、切り替え後のターンは Sonnet 5.5 の推論なしで動く。リクエスト自体は成功し、落とされたブロックは課金されない。
Opus 5.5 の思考ブロックは Fable 5.1 と Mythos 5.1 が読めるが、Sonnet 5.5 のものは誰も読めない。「難しいところだけ Sonnet 5.5 から Opus 5.5 に上げる」振り分けを組んでいるなら、上げた先では Sonnet 5.5 の推論が消える前提で確かめる必要がある。
もう一つ、Sonnet 5.5 の思考ブロックより前にあるもの(system、tools、それ以前のメッセージ)が、ブロックを作った後に変わっていないかも検査される。2026年8月31日 0時(UTC)以降に作られたアカウントでは、Claude API・Amazon Bedrock・Google Cloud で既定で強制され、途中で書き換えた履歴にブロックを載せて送ると 400 になる。
対処:会話を追記だけで進める。指示やツールを変えたいときは、履歴を書き換えずに会話途中の system メッセージを使う(Sonnet 5.5 で新たに使えるようになった機能で、Sonnet 5 には無い)。書き換えが避けられない場合は、ベータヘッダ thinking-binding-controls-2026-08-01 を付けて thinking.block_binding.prefix_mismatch_behavior を "drop_block" にすれば、エラーの代わりに該当ブロックを捨てさせられる。ただし block_binding は適応的思考でしか使えないので、between_tools のときは、追記だけにするか、書き換えたターン以降の thinking ブロックを自分で取り除く。
④ Claude API と Google Cloud では旧 computer use ツールが使えない
Sonnet 5 は PC 操作(computer use)を、ベータヘッダ付きの旧ツール computer_20251124 でも受け付けた。Claude API と Google Cloud の Sonnet 5.5 は、ツールセット computer_toolset_20260801 だけで、旧ツールを宣言すると 400 になる。Claude API でのメッセージは次の文から始まる。
'claude-sonnet-5-5' does not support tool types: computer_20251124.
対処:ベータヘッダを外し、tools を [{"type": "computer_toolset_20260801"}] に置き換え、エージェントのループをツールセットの形(メンバーの tool_use ブロック・一度に複数の操作・結果の toolset_name)に合わせて直す。fine-grained-tool-streaming-2025-05-14 のベータヘッダを送っているなら外す。ツールセットと一緒に送ると 400 になるので、必要なツールごとに eager_input_streaming: true を付ける。Amazon Bedrock では旧ツールがそのまま動くので、変更は要らない。
⑤ advisor ツールで使えない組み合わせがある
advisor ツール(ベータ)は、実行役のモデルが、より強いモデルに助言を求める仕組みだ。Sonnet 5.5 が実行役のとき、助言役に Opus 4.8・Opus 4.7・Opus 4.6・Sonnet 5・Sonnet 4.6 を指定すると 400 になる。使えるのは Opus 5・Opus 5.5・Sonnet 5.5・Fable 5・Fable 5.1・Mythos 5・Mythos 5.1 のどれかだ。
加えて、Sonnet 5.5 が受け付けるどの助言役も、助言を暗号化した advisor_redacted_result ブロックで返すので、クライアント側で助言の文面は読めない。助言の中身をログに残したり画面に出したりしていた処理は、作り直しが要る。「Sonnet 5 を実行役、Opus 4.8 を助言役」のような安い組み合わせは、Sonnet 5.5 ではそのまま使えない。
6. エラーにならずに変わること
5つの破壊的変更は 400 が出るので気づける。やっかいなのは、エラーにならずに振る舞いだけが変わるものだ。
| 変化 | 起きること・対処 |
|---|---|
| ツール呼び出しの合間の文章が thinking ブロックに入る | Sonnet 5 では text ブロックだった「これから◯◯を確認します」のような1〜2文より長いメモが、進捗用の thinking ブロックで返る(短い一言は text のまま)。既定の display: "omitted" では中身が空なので、途中経過をユーザーに流していた画面は、ツール呼び出しの間だけ黙る。適応的思考なら display を "updates"(ベータ、ヘッダ thinking-display-updates-2026-08-18)か "summarized" にし、空でない thinking ブロックを後に続く tool_use の前に表示する。between_tools なら設定なしで文章が返る。 |
| effort の段が較正し直された | 同じ段でも Sonnet 5 と同じ量だけ考えるとは限らない。公式は「設定を持ち越さず、effort を振り直せ」としている(7章)。 |
| 拒否のカテゴリが5つになった | cyber・bio・frontier_llm・reasoning_extraction・general_harms。断られると HTTP 200 で stop_reason: "refusal" が返るので、stop_details を読んで処理する。サーバー側のフォールバック(fallbacks: "default"、ベータ、Claude API のみ)は cyber と frontier_llm だけを Sonnet 5 で再試行する。 |
| 思考ブロックが作ったアカウントに紐づく | Sonnet 5.5 の思考ブロックは、作ったアカウントか、それとつながったアカウントでしか使えない。別のアカウントから送ると、ブロックは落とされてリクエストは成功する。発表は「Claude Code でセッションの途中にアカウントを切り替える場合も含む」と書いている。 |
| キャッシュの下限が下がった | 512〜1,023 トークンのプロンプトが新たにキャッシュされる。書き込みの料金(5分なら入力の1.25倍)がかかるようになる一方、2回目からは読み取りの料金で済む(3章)。 |
出典:What's new in Claude Sonnet 5.5、Migrating to Claude Sonnet 5.5、Anthropic の発表
安全対策についても、発表は変化を書いている。Sonnet 5.5 は、サイバー攻撃に使える能力が Opus 5 並みになったため、サイバーの安全対策とフォールバックを付けて出た最初の Sonnet で、リスクの高いサイバーセキュリティの作業は Sonnet 5 に目に見える形で切り替わる。ふだんの開発でのバグの発見と修正は影響を受けない。生物学の安全対策は Sonnet 5 と同じだ。
逆に、増えた機能もある。メッセージごとの effort(ベータ。プロンプトキャッシュを保ったまま段を変えられる)、会話途中の system メッセージ、会話途中のツールの変更(ベータ)は、どれも Sonnet 5 には無かった。ほかに、好きなときに会話を要約させるコンパクション(ベータ、ヘッダ compact-2026-09-04)と、メッセージの中でツールを定義する機能(ベータ、ヘッダ inline-tools-2026-09-15)も What's new に載っている。
7. effort の既定は API が high、Claude Code が medium
Opus 5.5 は API でも既定の effort が medium に下がったが、Sonnet 5.5 は API の既定が high のままだ。一方で発表は「Claude Code とアプリでは既定を medium にした」と書いている。同じ Sonnet 5.5 でも、API と Claude Code で、何も指定しないときの深さが1段違う。
公式の effort のページは、Sonnet 5.5 の出発点を次のように勧めている。
| 作業の種類 | 始める段(公式の推奨) | メモ |
|---|---|---|
| 一般の作業(下の2つ以外) | high | API の既定と同じ |
| エージェント型コーディング・多段のツール使用 | medium から | 仕様がはっきりした作業は medium、難しい・長い作業は high へ |
| チャットなど待ち時間に敏感な作業 | medium か low | 速さを優先 |
| xhigh・max | 評価で品質が上がるときだけ | between_tools とは併用できない |
出典:Anthropic「Effort」の「Recommended effort levels for Claude Sonnet 5.5」、移行ガイド
同じページは、max_tokens を思考と本文の両方が入る大きさにすること、エージェント型コーディングでは max_tokens をこのモデルの上限の 128,000 にしてストリーミングで受けることも勧めている。思考の中身が返らない設定でも、思考のトークンは max_tokens に数えられる。effort の仕組みそのものは工数(effort)設定の解説、適応的思考は適応的思考と拡張思考の違いに詳しく書いた。
8. Opus 5.5・Haiku とどう使い分けるか
公式のモデル一覧の案内は「迷ったら Opus 5.5 から」のままで、Sonnet 5.5 が出発点になったわけではない。そのうえで、発表は Sonnet 5.5 の得意分野を「範囲のはっきりした日々の作業、バグ修正、文書・スライド・表計算の作成」、Opus 5.5 を「慎重な判断が要る複雑な仕事」と書き分けている。さらに、「Sonnet 5.5 は effort を低めにしたときに Opus 5.5 を最もよく補う。高い段では、同じくらいのコストで同じくらいの性能になりうる」とも書いている。つまり、xhigh や max で回すなら Sonnet 5.5 を選んでもコストの利点は薄い。
- 仕様がはっきりした実装やバグ修正を、low〜high で速く回したい。
- 文書・スライド・表計算の作成が多い。
- 前置きの思考を切って待ち時間を縮めたい(
between_tools)。 - Sonnet 5 を使っている(同額で置き換えられる)。
- 答えの決まっていない設計や調査で、判断を持続させる必要がある。
- どちらにするか決めかねている(公式の出発点)。
- 高い effort で回す予定で、Sonnet 5.5 とのコスト差が縮む。
- fast mode(Opus だけ)を使いたい。
- 量が多く、1件あたりの単価を最優先したい(Haiku 4.5 は Sonnet 5.5 の半額)。
- 20万トークンのコンテキストで足りる。
- Haiku 5.5 は発表で「数週間のうちに」と予告されている。
- Haiku 4.5 の提供終了は「2026年10月15日より前ではない」なので、先の予定を確認しておく。
判断に迷ったときの順番は、① Sonnet 5.5 を medium と high で自分の作業にかける → ② 足りなければ Opus 5.5 の medium と比べる → ③ Sonnet 5.5 の xhigh と Opus 5.5 のコストが並ぶなら Opus 5.5 を選ぶ。Opus 5.5 の詳細はOpus 5.5 のリリース解説、その時点の全モデルの一覧は主要AIモデルの一覧と知識カットオフにある。
9. Claude Code・GitHub Copilot で使う
Claude Code は v2.1.284 の CHANGELOG(2026年9月28日)で Sonnet 5.5 を追加し、Anthropic API での既定の Sonnet にした。
default は Pro・Max・Team・Enterprise と API で Opus 5.5 のままだ。Sonnet 5.5 を使うには /model sonnet(起動時なら claude --model sonnet)を選ぶ。v2.1.284 より古いと使えないので claude update を。
sonnet の行き先は提供元で違うSonnet 5.5 になるのは Anthropic API だけ。Claude Platform on AWS では Sonnet 4.6、Bedrock と Google Cloud の Agent Platform、Microsoft Foundry では Sonnet 4.5 を指す。そこで使うなら完全なモデル名を選ぶか、ANTHROPIC_DEFAULT_SONNET_MODEL を設定する。
Sonnet 5.5 は medium から始まる。ユーザー設定の最上位にある古い形の effortLevel は、Opus 5.5 以降のモデルには効かない。思考の切り替え、alwaysThinkingEnabled、MAX_THINKING_TOKENS=0 も Sonnet 5.5 では効果がない。
安全対策の分類器が反応すると、サイバーセキュリティは Sonnet 5 で再実行され、セッションはそのモデルのまま続く(戻すには /model)。生物学は Sonnet 5.5 に代わりのモデルが無く、拒否で終わる。
出典:Claude Code「Model configuration」と CHANGELOG(v2.1.284、2026年9月29日に確認)
コンテキストは、Anthropic API では Sonnet 5.5 も常に100万トークンで、[1m] の指定も追加の料金も要らない。自動の要約(auto-compact)は既定で約96.7万トークンで走る。LLM ゲートウェイ経由(ANTHROPIC_BASE_URL を設定)のときは20万トークンとして扱われるので、モデル選択画面の「Sonnet 5.5 (1M context)」(sonnet[1m])を選ぶ。
計画を Opus、実行を Sonnet で分ける opusplan は、Anthropic API ではそれぞれ Opus 5.5 と Sonnet 5.5 で動く。使い方はopusplan の解説にまとめた。Claude Code 自体は追記だけで会話を進めるので、5章③の履歴の検査で困ることはない(Opus 5.5 の移行ガイドの記述)。
GitHub Copilot
GitHub は同じ9月28日の changelog で、Sonnet 5.5 の一般提供を告げた。対象は Copilot Pro・Pro+・Max・Business・Enterprise で、VS Code・Visual Studio・Copilot CLI・Copilot coding agent・github.com・JetBrains IDE・Xcode などのモデル選択画面から選べる。順次の提供なので、すぐに出ないこともある。料金は利用量に応じた課金で、提供元の定価が適用される。Business と Enterprise では、管理者が Copilot の設定のモデルポリシーで使えるかどうかを決める。
10. 移行の手順(API 利用者向け)
移行ガイドのチェックリストのうち、Sonnet 5 から移る人に当てはまる項目を作業順に並べた。Claude Code には、この作業を手伝う /claude-api migrate もある(移行ガイドで案内されている同梱のスキル。編集の前に対象範囲を確認してくる)。
- モデルIDを
claude-sonnet-5からclaude-sonnet-5-5に変える(Bedrock はanthropic.claude-sonnet-5-5)。 thinking: {"type": "disabled"}を{"type": "between_tools"}に置き換え、effort を high 以下にする。tool_choiceのanyとtoolを、auto+ strict tool use に置き換える(Bedrock はautoだけにして入力を自前で検証)。- 途中で
system・tools・過去のメッセージを書き換えているなら、追記だけの形に直す。 - Claude API か Google Cloud で computer use を使っているなら、
computer_toolset_20260801に移し、ループを直す。 - advisor ツールの助言役が Opus 4.8・Opus 4.7・Sonnet 5 などなら、Sonnet 5.5 が受け付ける助言役に替え、助言が暗号化されて返る前提にする。
- 途中経過を画面に出しているなら、
displayを"updates"か"summarized"にする(between_toolsなら不要)。 stop_reason: "refusal"を処理し、フォールバックを設定する。- 他のモデルへ振り分ける仕組みがあるなら、Sonnet 5.5 の推論が引き継がれない前提で確かめる。
- effort を振り直し、コストと待ち時間を測り直す。1,024 トークン未満のプロンプトのキャッシュも確かめる。
出典:Anthropic「Migrating to Claude Sonnet 5.5」の「Every starting model」と「Migrating to Claude Sonnet 5.5 from Claude Sonnet 5」を作業順に並べ替えたもの
Sonnet 4.6 以前から直接来る場合は、思考を指定していなかった処理にも思考が走ること、予算指定と temperature などの 400、同じ文章で約3割トークンが増えることへの対応が加わる。Claude Managed Agents で使っているなら、モデル名を替える以外の変更は要らない(移行ガイドの注記)。
まとめ
Claude Sonnet 5.5 は、値段を据え置いたまま性能を大きく上げ、そのかわり API の作法を Opus 5.5 側に寄せたリリースだ。Anthropic 自身の表では Sonnet 5 からどの行も伸び、多くの行で Opus 5.5 との差は数ポイント以内になった。一方で、disabled・強制ツール使用・旧 computer use ツール・履歴の書き換え・一部の advisor の組み合わせが 400 の原因になった。
いちばん見落としやすいのは、思考を切る代わりの between_tools が high 以下でしか通らないことと、既定の effort が API では high、Claude Code では medium という食い違いだ。API では effort を明示し、Claude Code では /model sonnet で選んだうえで工数を確かめる。安くなったかどうかは、単価ではなく usage で測る。
最後に、ベンチマークの数字はその表・その条件で測った値だ。Anthropic 自身も「複雑で答えの決まっていない仕事では Opus 5.5 がはっきり強い」と書いている。まずは自分の作業で、Sonnet 5.5 の medium と high を比べるところから始めたい。
FAQ
Q. Sonnet 5.5 は Sonnet 5 より高いですか?
A. 単価はすべての項目で同じです(入力 $2・出力 $10・キャッシュ読み取り $0.20、Batch API は半額)。Anthropic は「1タスクあたり最大3割安い」としていますが、これは自社の測定です。effort の段が較正し直されているので、移行後に usage で確かめてください。
Q. 思考(thinking)をオフにする方法はありますか?
A. API では thinking: {"type": "between_tools"} で前置きの思考を止められます。ツールを使わないリクエストなら、応答は本文だけになります。ただし effort が xhigh と max では 400 になり、ツールの合間の進捗メモは thinking ブロックで返ります。Claude Code では、Sonnet 5.5 の思考を切る設定は効きません。
Q. モデルIDを変えたら 400 エラーが出ました。
A. エラーメッセージで見分けられます。"thinking.type.disabled" なら思考の指定、tool_choice: type "tool" and "any" なら強制ツール使用、computer_20251124 なら旧 computer use ツールです。between_tools を使っていて出たなら、effort が xhigh 以上か、display などを一緒に送っていないかを見ます。advisor ツールを使っているなら助言役のモデルを、会話の途中で履歴を書き換えているなら思考ブロックの検査(5章③)を疑ってください。
Q. Claude Code で Sonnet 5.5 になっていません。
A. 既定のモデルは Opus 5.5 なので、/model sonnet で選びます。それでも Sonnet 5 のままなら v2.1.284 より古いので claude update を実行してください。Bedrock・Google Cloud・Claude Platform on AWS・Microsoft Foundry では sonnet が古い Sonnet を指すので、完全なモデル名を選ぶか ANTHROPIC_DEFAULT_SONNET_MODEL を設定します。
Q. Opus 5.5 と Sonnet 5.5、どちらを既定にすべきですか?
A. 公式の出発点は Opus 5.5 です。範囲のはっきりした実装・バグ修正・文書作成が中心で、effort を low〜high で回すなら、Sonnet 5.5 のほうが入出力の単価が半分で済みます。xhigh や max で回すなら、発表のとおりコストの差は縮むので、自分の作業で両方を比べてください。
※ 本記事の数値は、Anthropic 公式発表「Introducing Claude Sonnet 5.5」(ベンチマークは同ページの比較表とグラフの説明文)、公式ドキュメント「Models overview」「Claude Sonnet 5.5」「What's new in Claude Sonnet 5.5」「Migrating to Claude Sonnet 5.5」「Pricing」「Thinking」「Effort」「Prompt caching」、Claude Code の「Model configuration」と CHANGELOG、GitHub の changelog に基づく(いずれも2026年9月29日に確認)。仕様・価格は変更されることがあるため、最終的な確認は公式ドキュメントで行ってほしい。
関連記事: Claude Opus 5.5 リリース解説, Claude Fable 5.1 の破壊的変更と移行, Claude の料金比較.