目次
2026年9月22日、Anthropic が Claude Opus 5.5 を公開した。発表によれば「Claude 5.5 ファミリーの最初のモデル」で、前の Opus 5(7月24日公開)からわずか2か月。公式ドキュメントのモデル一覧では、「どれを使うか迷ったら、ほとんどの用途は Opus 5.5 から始めよ」という位置に置かれ、Opus 5 は Legacy(旧モデル・引き続き利用可)に下がった。
結論から言う。料金は Opus 5 より下がった(入力 $4 / 出力 $20。Opus 5 は $5 / $25)。一方で API の扱いは大きく変わり、Opus 5 で動いていたコードが 400 エラーになる変更が4つある。さらに、effort(Claude Code の日本語表示では「工数」)を指定しないときの既定値が high から medium に下がった。値段だけ見て載せ替えると、エラーか、気づかないうちの品質の変化に当たりうる。本記事は、公式ドキュメントと発表を原文で突き合わせ、何が変わったか・いくら変わるか・移行で何が壊れるかを実務の順に整理する。
2026年9月24日時点の情報:公開から2日後に、Claude Platform の公式ドキュメント(モデル一覧・Opus 5.5 のページ・What's new・移行ガイド・料金)、Anthropic の発表、Claude Code のドキュメントと CHANGELOG を原文で確認して書いています。発表が「数週間以内」と予告している Claude Sonnet 5.5 と Claude Haiku 5.5 は、この時点では公開されていません。
値下げと、壊れる変更4つが同時に来た
— 公式の位置づけは「長時間のエージェント型コーディングと知識労働のためのモデル」
1. 3行でわかる Opus 5.5
Anthropic の比較表では、エージェント型コーディング・知識労働・PC操作で Fable 5.1 を上回る値が並ぶ。発表の言い方は「たいていの仕事で Fable 5.1 と同じ水準」。同じ発表が「この水準ではベンチマークの差は実務の差の目安として当てにならなくなった」とも書いている。
入力・出力は Opus 5 より2割安い $4 / $20、キャッシュ読み取りは6割安い $0.20。ただし Sonnet 5 と比べると入出力は2倍で、キャッシュ読み取りは同額。「安い」は比べる相手で意味が変わる。
思考を切れない/強制ツール使用が 400/思考ブロックがモデルと会話に紐づく/旧 computer use ツール不可の4つ。加えて既定の effort が medium に下がり、ツール呼び出しの合間の文章が thinking ブロックに移る。
ひとことでまとめれば、「安くなった Opus を、Fable 5.1 と同じ作法で扱う」のが Opus 5.5 だ。壊れる4つのうち3つは、公式ドキュメント自身が「Claude Fable 5.1 にも当てはまる」と書いている。Fable 5.1 への移行を済ませたコードなら、残る作業はかなり少ない。
2. 基本スペックと提供形態
まず数字で押さえる。比較の相手は、置き換えられる Opus 5、上位の Fable 5.1、下位の Sonnet 5 の3つにした。
| 項目 | Opus 5.5 | Opus 5(Legacy) | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| API モデルID | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
claude-sonnet-5 |
| 料金(入力/出力) | $4 / $20 | $5 / $25 | $10 / $50 | $2 / $10 |
| コンテキスト / 最大出力 | 100万 / 12.8万 | 100万 / 12.8万 | 100万 / 12.8万 | 100万 / 12.8万 |
| 思考(thinking) | 常時オン(切れない) | 既定オン。effort high 以下なら切れる | 常時オン(切れない) | 既定オン。どの effort でも切れる |
| 既定の effort | medium | high | high | high |
| 知識の信頼カットオフ | 2026年6月 | 2026年5月 | 2026年6月 | 2026年1月 |
| 速さ(公式の相対表記) | 中程度 | — | 遅め | 速い |
| 提供終了 | 2027年9月22日より前ではない | 2027年7月24日より前ではない | 2027年9月1日より前ではない | 2027年6月30日より前ではない |
出典:Anthropic「Models overview」、「Claude Opus 5.5」、「Claude Opus 5」、「Migrating to Claude Opus 5.5」(2026年9月24日に確認)。速さは現行ラインナップ内の相対表記で、Legacy の Opus 5 には載っていない。提供終了日は Anthropic が運営するプラットフォームでの約束で、Amazon Bedrock と Google Cloud は各社が独自に決める。
表で目立つのは、「思考」と「既定の effort」の2行だけが Opus 5 と食い違うことだ。コンテキストと最大出力は同じで、知識カットオフも1か月進んだだけ。スペック表の上で Opus 5 と違うのは「扱い方」と「値段」で、性能の差は4章の表で見る。なお、Message Batches API ではベータヘッダ output-300k-2026-03-24 を付けると出力の上限が30万トークンまで広がる(Opus 5 と同じ)。
提供プラットフォーム
Claude API(claude-opus-5-5)、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry。初日から全プラットフォームに出た。
claude.ai と iOS・Android アプリ、Claude Code。Claude Code では v2.1.280 から Pro を含む主要プランの既定モデルになった(9章)。
高速版はリサーチプレビューで、公式ドキュメントでは Claude API 限定。Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundry では使えない。
3. 料金——Opus 5 より安いが、比べる相手で話が変わる
公式の What's new は料金を「$4 / $20 で、Opus 5 の $5 / $25 を下回る」と書いている。Opus の値下げは、Opus 4.5 から Opus 5 まで $5 / $25 が続いた後の初めての変更だ(公式の料金ページの表で確認)。細かい単価は次のとおり。
| 100万トークンあたり | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| 入力 | $4 | $5 | $10 | $2 |
| 出力 | $20 | $25 | $50 | $10 |
| キャッシュ書き込み(5分) | $5 | $6.25 | $12.50 | $2.50 |
| キャッシュ書き込み(1時間) | $8 | $10 | $20 | $4 |
| キャッシュ読み取り | $0.20 入力の5% |
$0.50 入力の10% |
$0.25 入力の2.5% |
$0.20 入力の10% |
| Batch API(入力/出力) | $2 / $10 | $2.50 / $12.50 | $5 / $25 | $1 / $5 |
| fast mode(入力/出力) | $8 / $40 | $10 / $50 | — | — |
出典:Anthropic「Pricing」(2026年9月24日に確認)。fast mode の欄は料金ページの fast mode の表に載っているモデルだけ。Sonnet 5 の $2 / $10 は、発売時に8月31日までの導入価格とされていたものが、そのまま標準価格になった(同じページの注記)。
「安くなった」の中身は、比べる相手ごとに違う
Opus 5 と比べれば全項目で安い。ところが Fable 5.1 や Sonnet 5 と比べると、項目ごとの差の開き方がそろわない。下の図は、各モデルの単価を100としたときの Opus 5.5 の単価だ。
相手の単価を100としたときの Opus 5.5 の単価
出典:Anthropic「Pricing」の単価から本記事が計算(バーの長さは200を満幅にしている)
読み取れることは3つある。
- Opus 5 からなら、キャッシュを多く使う処理ほど得をする。入出力は2割引、キャッシュ読み取りは6割引だ。発表も「キャッシュ読み取りはエージェント作業とコーディング作業のコストの大半を占める」と書いている。
- Fable 5.1 との差は、キャッシュ読み取りでは小さい。入出力は Fable 5.1 の4割の値段だが、キャッシュ読み取りは $0.20 対 $0.25 で2割しか違わない。
- Sonnet 5 とは、キャッシュ読み取りだけ同額。入出力は2倍だが、キャッシュ読み取りは両方 $0.20 なので、キャッシュの比率が高い作業ほど価格差は縮む。
試算:キャッシュ読み取り1,000万・入力50万・出力30万トークンのタスクを1回(トークン数は本記事の仮定。書き込み料金は省略)
- Opus 5.5:$2.00 + $2.00 + $6.00 = $10.00
- Opus 5:$5.00 + $2.50 + $7.50 = $15.00(Opus 5.5 はこの3分の2)
- Fable 5.1:$2.50 + $5.00 + $15.00 = $22.50
- Sonnet 5:$2.00 + $1.00 + $3.00 = $6.00(Opus 5.5 は2倍ではなく約1.7倍)
同じトークン数で比べた単価の計算で、実際にはモデルごとに使うトークン数が違う。単価は Anthropic「Pricing」による。
もう一つ、単価と請求額は別物だ。Anthropic の発表は「既定の設定では、典型的な作業で Opus 5 より4割安くなる」と書き、理由を「トークン単価が安いうえ、1タスクあたりのトークンも少ない」と説明している。これは Anthropic 自身の測定だ。一方で公式ドキュメントは、同じ effort なら Opus 5.5 は Opus 5 より1ターンあたり多く考える傾向があり、xhigh と max でとくにそうだとも書いている。思考のトークンは、表示されなくても出力トークンとして課金される。Opus 5 で思考を切って安く回していた処理は、Opus 5.5 では切れないぶん出力トークンが増えうる。移行したら usage を実測して、自分の作業で比べ直すしかない。Claude のモデル全体の料金はOpus・Sonnet・Haiku の料金比較にまとめている。
4. ベンチマーク——Anthropic の表の中だけで比べる
Opus 5 の発表では比較表が画像だったが、今回の発表の表はページ上の文字の表だ。列は Opus 5.5・Fable 5.1・Opus 5・GPT-6 Astra・GPT-5.6 Sol の5つ。表の条件を先に書いておく。
- Opus 5.5 の値は、注記がない限り最大の effort(max)で測ったもの。Terminal-Bench 4.0 だけは Opus 5.5 が xhigh、GPT-6 Astra が high(OpenAI の報告値)で、それぞれの最高スコア
- Terminal-Bench 4.0 の GPT-6 Astra と GPT-5.6 Sol、Terminal-Bench-Science 0.1 の GPT-6 Astra は、OpenAI が報告した値。ほかの行の GPT の値を誰が測ったかの注記はない
- AutomationBench は Zapier が実行・報告した値(Opus 5.5 は Zapier の早期アクセスでの評価、Opus 5 と GPT の2つは Zapier の公開リーダーボード)。第三者が測ったと表に明記されているのはこの行だけ
- Opus 5.5 は本番と同じ安全対策を有効にして測った。安全対策が介入した問題は、サイバーセキュリティは Opus 4.8、生物学と先端 LLM 開発は Opus 5 が代わりに解いた。Anthropic は「Opus 5.5 のスコアを下げている可能性が高い」と注記している
| ベンチマーク | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 端末でのエージェント型コーディング |
66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1(Main) 変更がマージされるか |
54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 曖昧な複数ファイルの課題 |
57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1(Elo) 44職種の実務 |
1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench 業務フロー(Zapier が測定) |
40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam 分野横断の推論(ツールあり) |
67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 エージェントによる科学研究 |
58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0 PC操作(表の注記は「partial」) |
81.8% | 80.7% | 74.0% | — | — |
| Chartography グラフの読み取り(ツールあり) |
89.0% | 88.4% | 83.4% | — | — |
出典:Anthropic「Introducing Claude Opus 5.5」の比較表(2026年9月22日、9月24日に確認)。緑はその行で Opus 5.5 が最高、赤は Opus 5.5 より高い値が同じ表にある行。「—」は表に値がないもの。
9行のうち7行で Opus 5.5 が表の最高値だ。とくに差が大きいのは Terminal-Bench 4.0(Fable 5.1 に10.6ポイント差)と GDPval-AA v2.1(Fable 5.1 に111点差)。前の Opus 5 と比べると、Terminal-Bench-Science 0.1 は 29.0% から 58.7% へ、約2倍になっている。
effort ごとの値——発表のグラフの説明文から
表の値は max(Terminal-Bench 4.0 は xhigh)だが、発表にはeffort ごとのスコアとタスクあたりコストを並べたグラフもあり、その説明文に既定の medium での値が書かれている。
medium で 54.6%。GPT-6 Astra の最高値(53.3%)を、タスクあたり約5分の1のコストで上回る。表の max の値(54.4%)より medium のほうが高い。
medium で 52.5%。Fable 5.1(max)の 51.8%、Opus 5(max)の 46.6% を上回り、GPT-5.6 Sol の最高値(41.7%)を約3分の1のコストで11ポイント上回る。
既定の effort で、Opus 5 の max を約5分の1のコストで上回る。GPT-6 Astra には約4割のコストで並ぶ。
medium で、GPT-6 Astra の max をタスクあたり約5分の1のコストで上回る。
出典:Anthropic「Introducing Claude Opus 5.5」のグラフの説明文(いずれも Anthropic 自身の測定と比較)
ここで注目したいのは FrontierCode だ。同じ発表の中で、medium(54.6%)が max(54.4%)をわずかに上回っている。effort を上げれば必ず伸びるわけではない、という Opus 5 の頃からの傾向は、Opus 5.5 でも続いている(6章)。GPT-6 Astra 側の発表と数字についてはGPT-6 Astra のリリース解説で扱っている。
5. 勝てていない領域と、表の読み方の注意
リリース記事は勝った行だけ並べがちなので、逆側を書く。どれも Anthropic 自身の発表とドキュメントに書かれていることだ。
Anthropic 自身の表で、AutomationBench は 40.0% 対 41.4%、Terminal-Bench-Science 0.1 は 58.7% 対 64.6% と GPT-6 Astra が上回る。なお AutomationBench は代替モデルなしで測られ、安全対策の介入は失敗として数えられた(表の注記)。
発表は「サイバー能力がきわめて高い」として Fable 5.1 に近い安全対策をかけ、ほとんどのサイバーセキュリティ作業は Opus 4.8 に回すと書いている。ふだんの開発でのバグの発見と修正はそのまま使える。
生物学でも Fable 5.1 と同じ安全対策がかかる。研究開発で使うには、審査を受けた組織向けの Life Sciences Verification Program に申し込む必要がある。
表の読み方で気をつけたい2点:1つ目に、発表自身が「この性能の水準では、ベンチマークの差は実務の差の目安として当てにならなくなってきた。社内で使った感覚では、Fable 5.1 との差は数字が示すより小さい」と書いている。表の「Fable 5.1 に10ポイント差」を、そのまま実務の差と読まないほうがよい。2つ目に、Opus 5 の発表の表とはテストの版が違う(CursorBench 3.2 → 4.0、GDPval-AA v2 → v2.1 など)。7月の表と今回の表から数字を拾って並べると、条件の違う値どうしを比べることになる。
6. 既定の effort が medium になった意味
今回いちばん見落とされやすい変更がこれだ。effort を指定しないリクエストは、Opus 5 では high、Opus 5.5 では medium で動く。同じコードのまま、考える深さが1段下がる。
公式の effort のページは「既定値(Opus 5.5 では medium)を明示するのと、effort を省くのはまったく同じ動作」と書いている。Opus 5 と同じ深さで動かしたいなら、high を明示する。
同じ effort なら、Opus 5.5 は Opus 5 より1ターンあたり多く考える傾向があり、xhigh と max でとくにそうだ(What's new)。Opus 5 の high をそのまま持ち込めば同じになる、とは限らない。
思考を切れないので、考える量とコストを動かせるのは effort だけ。Opus 5 で思考を切っていた場所は、effort を下げて代わりにする。
では、どの段を使えばよいか。公式ドキュメントの説明を Opus 5.5 向けにまとめると次のようになる。
| effort | 向く用途(公式の説明) | Opus 5.5 でのメモ |
|---|---|---|
| low | 速さと安さが最優先の単純な作業。サブエージェントなど | Opus 5 で思考を切っていた処理の置き換え先の候補 |
| medium(既定) | 速さ・コスト・性能の釣り合いが要るエージェント作業 | 発表のグラフでは FrontierCode と CursorBench で他社の最高値を上回った段 |
| high | 複雑な推論、難しいコーディング、エージェント作業 | Opus 5 の既定。移行直後の比較の基準にしやすい |
| xhigh | 長時間のエージェント・コーディング作業 | max_tokens は6.4万トークンから始めて調整(移行ガイド) |
| max | もっとも深い推論が要る難問 | Claude Code のドキュメントは「伸びが頭打ちになりやすく、考えすぎる傾向がある。広く使う前に試せ」と書く |
出典:Anthropic「Effort」、移行ガイド、Claude Code「Model configuration」
公式の推奨は一貫していて、前のモデルの設定を持ち越さず、自分の評価セットで effort を振り直せというものだ。発表には、早期テスターの企業の声として「最も低い effort でも、Opus 5 の high より多くの既知のバグを見つけた」(Deloitte)といった報告も並ぶが、これは各社が自社の作業で測った結果を Anthropic が掲載したもので、あなたの作業で同じになる保証はない。medium で品質が保てるか、high に上げて何が伸びるかを、自分の作業で確かめたい。Opus 5.5 では会話の途中でメッセージごとに effort を変えても、プロンプトキャッシュが保たれる(ベータ)。
7. Opus 5 から移すと壊れる4つと対処
公式の What's new in Claude Opus 5.5 は、Opus 5 で動いているコードに影響する破壊的変更を4つ挙げている。どれもエラーは 400 invalid_request_error だ。
① 思考を無効にできない
Opus 5 は、effort が high 以下なら thinking: {"type": "disabled"} を受け付けた。Opus 5.5 は思考が常時オンで、disabled も、手動の予算指定 {"type": "enabled", "budget_tokens": N} も、どの effort でもエラーになる。返るメッセージは次のとおり。
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
対処:thinking の指定を消す({"type": "adaptive"} と同じ扱いになる)。思考を切って節約していた場所は、effort を下げて代わりにする。
# Before:Opus 5 では通る。Opus 5.5 では 400 client.messages.create( model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, messages=[...], ) # After:思考は常時オン。effort で量を決める client.messages.create( model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...], )
思考が必ず走るので、応答の先頭に thinking ブロックが来ることがある。content[0].text のように位置で読むコードは壊れるので、type が "text" のブロックを選んで読む。ツールを使うループでは、thinking ブロックを中身が空でも、手を加えずにそのまま送り返す(編集・並べ替え・一部の削除は 400 になる)。max_tokens は思考と本文の合計の上限なので、思考を切っていた処理は見直しが要る。
② 強制ツール使用がエラーになる
tool_choice を {"type": "any"} や {"type": "tool", "name": "..."} にすると 400 になる。トークン数を数える API も同じ判定だ。使えるのは auto(既定)と none だけ。
tool_choice: type "tool" and "any" are not supported for this model.
対処:tool_choice は auto のまま、ツール定義に strict: true を付ける(strict tool use)か、スキーマを構造化出力に移す。そのうえで「どういうときにそのツールを使うか」をプロンプトに書く。強制ツール使用を「JSON を確実に返させる」ために使っていたなら、構造化出力に移すほうが素直だ。注意点として、strict tool use が受け付けるのは JSON Schema の一部だけで、スキーマ内のすべての object に additionalProperties: false が要る。
# After:auto + strict。いつ使うかは文章で伝える client.messages.create( model="claude-opus-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
③ 思考ブロックがモデルと会話に紐づく
thinking ブロックには、どのモデルが作ったかが記録されている。Opus 5.5 は Opus 5 以前の Opus・Sonnet・Haiku の思考ブロックは読めるが、Fable と Mythos のものは読めない。逆に Opus 5.5 の思考ブロックを読めるのは、Claude API 上の Fable 5.1 と Mythos 5.1 だけだ。
- Opus 5 → Opus 5.5、Opus 5.5 → Fable 5.1(Claude API)への切り替えは、それまでの推論を引き継ぐ
- それ以外への切り替え(たとえば Opus 5.5 → Sonnet 5)は、切り替え後のターンが前のモデルの推論なしで動く。リクエスト自体は成功し、落とされたブロックは課金されない
もう一つ、Opus 5.5 の思考ブロックより前にあるもの(system、tools、それ以前のメッセージ)が、ブロックを作った後に変わっていないかも検査される。2026年8月31日 0時(UTC)以降に作られたアカウントでは既定で強制され、途中で書き換えた履歴にブロックを載せて送ると 400 になる。
対処:会話を追記だけで進める。指示やツールを変えたいときは、履歴を書き換えずに会話途中の system メッセージを使う。移行ガイドによれば、Claude Code・claude.ai・Claude Managed Agents・Claude Agent SDK はもともと追記だけで動いているので、それらの上で作っているなら手を入れる必要はない。書き換えが避けられない場合は、ベータヘッダ thinking-binding-controls-2026-08-01 を付けて thinking.block_binding.prefix_mismatch_behavior を "drop_block" にすれば、エラーの代わりに該当ブロックを捨てさせられる。この仕組みは Fable 5.1 と同じで、詳しくはFable 5.1 の破壊的変更の記事で扱った。
④ Claude API と Google Cloud では旧 computer use ツールが使えない
Opus 5 は PC 操作(computer use)を、新しいツールセット computer_toolset_20260801 と、ベータヘッダ付きの旧ツール computer_20251124 の両方で受け付けた。Claude API と Google Cloud の Opus 5.5 はツールセットだけで、旧ツールを宣言すると 400 になる。メッセージは次の文から始まる。
'claude-opus-5-5' does not support tool types: computer_20251124.
対処:ベータヘッダを外し、tools を [{"type": "computer_toolset_20260801"}] に置き換える(名前も画面サイズも書かない)。エージェントのループ側も直す必要があり、操作の種類は input.action ではなくブロックの name に入ること、1ターンに複数の操作が来ること、結果には毎回 toolset_name を付けて返すことの3点に対応する。Amazon Bedrock では旧ツールが Opus 5.5 でもそのまま動くので、変更は要らない。
8. エラーにならずに変わること
4つの破壊的変更は 400 が出るので気づける。やっかいなのは、エラーにならずに振る舞いだけが変わるものだ。
| 変化 | 起きること・対処 |
|---|---|
| ツール呼び出しの合間の文章が thinking ブロックに入る | Opus 5 では text ブロックだった「これから◯◯を確認します」のような短い文が、進捗用の thinking ブロックで返る。既定の表示設定(display: "omitted")では中身が空なので、途中経過をユーザーに流していた画面は、ツール呼び出しの間だけ黙る。display を "updates"(ベータ、ヘッダ thinking-display-updates-2026-08-18。進捗だけ返り推論は隠れたまま)か "summarized"(推論の要約と進捗が混ざって返る)にし、空でない thinking ブロックを、それに続く tool_use の前に表示する |
| 拒否のカテゴリが増えた | サイバーに加えて生物学の分類器が動き、応答本文に内部の推論を書き出させようとする依頼は reasoning_extraction として断られることがある。断られると HTTP 200 で stop_reason: "refusal" が返るので、stop_details を読んで処理する。サーバー側のフォールバック(fallbacks: "default"、ベータ)は、reasoning_extraction では再試行しない |
| グラフや図の読み取りが正確になった | 細かいグラフやレイアウトに依存する画像を、ツールなしでも正確に読めるようになった。旧モデル向けに入れていたプロンプト側の工夫は要らなくなっている可能性がある(ただし最も細かい入力ではツールを足すと精度が上がる) |
| Opus 4.8 から来る場合:Priority Tier 非対応 | Opus 4.8 は Priority Tier を使えるが、Opus 5.5 は対応していない。契約がある組織は容量の計画を別に立てる |
出典:What's new in Claude Opus 5.5、Migrating to Claude Opus 5.5
9. Claude Code・claude.ai ではどうなるか
API を直接使わない人に関係するのはこちらだ。Claude Code は v2.1.280 の CHANGELOG で Opus 5.5 に対応した。
default は Pro・Max・Team・Enterprise と API で Opus 5.5 になった。Pro と Team Standard はこれまで Sonnet 5 が既定だったので、ここは Sonnet から Opus への変更になる。opus の別名も、Claude API・Claude Platform on AWS・Bedrock・Google Cloud で Opus 5.5 を指す。v2.1.280 より古いと使えないので claude update を。
Opus 5.5 は medium から始まる。Opus 5 のころ /effort で保存した工数は引き継がれない(モデル別の保存も、ユーザー設定の最上位にある古い形の effortLevel も Opus 5.5 には効かない)。/effort か /model の画面で選び直すまで medium で動く。環境変数 CLAUDE_CODE_EFFORT_LEVEL や、プロジェクト・管理設定に書いた effortLevel は全モデルに効く。
Alt+T(macOS は Option+T)、alwaysThinkingEnabled、MAX_THINKING_TOKENS=0 のどれも、Opus 5.5 と Fable では効果がない。v2.1.281 で、切れないモデルでは切り替えの代わりに理由を1行表示するよう直った。
分類器が反応すると、生物学は Opus 5、サイバーセキュリティは Opus 4.8 で再実行され、セッションはそのモデルのまま続く。戻すには /model。侵入テストや CTF、生物学寄りのコードベースでは最初の依頼から起きることも多い、と公式は書いている。
出典:Claude Code「Model configuration」と CHANGELOG(v2.1.280・v2.1.281、2026年9月24日に確認)
Claude Code の effort の保存の仕組みは工数(effort)設定の解説、思考の仕組みそのものは適応的思考と拡張思考の違いに詳しく書いた。Anthropic の発表によれば、fast mode(最大2.5倍速・入力 $8 / 出力 $40)は Claude Code でも使える。
claude.ai とアプリ
claude.ai と iOS・Android アプリでも、公開日から Opus 5.5 を選べる(Anthropic は同日付の Opus 5.5 用システムプロンプトを公開している)。発表は、料金の引き下げに合わせて Pro・Max・Team・席単位の Enterprise の「5時間の利用上限」を引き上げること、そしてサブスクリプション利用者に利用上限のリセットを1回ぶん配り、好きなときに使えるようにすることも告げている。引き上げ幅の数字は発表に書かれていない。プランごとの料金はClaude と ChatGPT の料金比較で整理している。
10. Opus 5.5・Fable 5.1・Sonnet 5・Opus 5 の選び方
公式のモデル一覧の案内は短い。「迷ったら Opus 5.5 から。要求の厳しい推論と長時間のエージェント作業、または Opus 5.5 を高い effort で評価してもまだ足りないときは Fable 5.1」。これに料金と API の制約を重ねると、次のように分けられる。
- まず1つ決めたい(公式の出発点)
- 長時間のエージェント型コーディング、知識労働
- Opus 5 を使っている(全単価で安い)
- Fable 5.1 の費用が重く、Opus 5.5 で足りるか試したい
- Opus 5.5 を high 以上で評価しても品質が足りない
- 要求の厳しい推論、とても長いエージェント作業
- キャッシュ中心の作業なら、単価差は入出力ほど開かない($0.25 対 $0.20)
- 速さが要る・量が多い(公式の速さの表記は「速い」)
- 思考を切りたい、強制ツール使用を使い続けたい
- 入出力が Opus 5.5 の半額(キャッシュ読み取りは同額)
- 後継の Sonnet 5.5 は「数週間以内」と予告済み
- 7章の4つを直し終えるまでのつなぎ
- Legacy だが利用可能で、提供終了は2027年7月24日より前ではない
- 単価はどの項目も Opus 5.5 より高いので、長居する理由は少ない
判断に迷ったときの順番は単純で、① Opus 5.5 を medium と high で自分の作業にかける → ② 足りなければ xhigh → ③ それでも足りなければ Fable 5.1 → 逆に medium で十分なら low か Sonnet 5 でも足りるか試す。effort を上げるのもモデルを上げるのも、品質のために費用を払う操作で、どちらが安く効くかは作業によって違う。
11. 移行の手順(API 利用者向け)
移行ガイドのチェックリストのうち、Opus 5 から移る人に当てはまる項目を作業順に並べた。Claude Code には、この作業を手伝う /claude-api migrate もある(移行ガイドで案内されている同梱のスキル。編集の前に対象範囲を確認してくる)。
- モデルIDを
claude-opus-5→claude-opus-5-5に変える(Bedrock はanthropic.claude-opus-5-5) thinkingのdisabledとenabled(予算指定)を消し、代わりに effort を選ぶ- effort を明示する(省くと medium。Opus 5 と同じ深さなら
high) tool_choiceのanyとtoolを、auto+ strict tool use か構造化出力に置き換える- Claude API か Google Cloud で computer use を使っているなら、
computer_toolset_20260801に移し、ループを直す - 応答は
typeでブロックを選んで読み、ツールのループでは thinking ブロックを手を加えずに返す - 途中経過を画面に出しているなら、
displayを"updates"か"summarized"にする - 途中で
system・tools・過去のメッセージを書き換えているなら、追記だけの形に直す - 他のモデルへ振り分ける仕組みがあるなら、Opus 5.5 の推論が引き継がれない前提で確かめる
stop_reason: "refusal"を処理し、フォールバックを設定する- 思考を切っていた処理は
max_tokensを見直す(xhigh・max なら6.4万から) - 選んだ effort で、コストと待ち時間を測り直す
出典:Anthropic「Migrating to Claude Opus 5.5」の「Every starting model」の項目を作業順に並べ替えたもの
Opus 4.8 以前から直接来る場合は、思考を指定していなかった処理にも思考が走ることへの対応が加わる。Opus 5 のリリース解説の移行手順もあわせて確認したい。
まとめ
Claude Opus 5.5 は、「値下げ」と「扱い方の変更」が同時に来たリリースだ。単価は入出力で2割、キャッシュ読み取りで6割下がり、Anthropic 自身の比較表では多くの行で Fable 5.1 を上回る。一方で、思考は切れなくなり、強制ツール使用・旧 computer use ツール・履歴の書き換えが 400 の原因になった。
そして、既定の effort が medium に下がったことは、エラーにならないぶん気づきにくい。API では effort を明示し、Claude Code では Opus 5 の頃の設定が引き継がれていないことを確かめる。安くなったかどうかも、単価ではなく usage で測る。
最後に、ベンチマークの数字はその表・その条件で測った値だ。AutomationBench と Terminal-Bench-Science では同じ表の中で GPT-6 Astra が上にあり、Anthropic 自身も「Fable 5.1 との差は数字より小さい」と書いている。自分の作業で、medium と high を比べるところから始めたい。
FAQ
Q. Opus 5.5 は Opus 5 より安いですか?
A. 単価はすべての項目で安いです(入力 $4・出力 $20・キャッシュ読み取り $0.20。Opus 5 は $5・$25・$0.50)。Anthropic は「既定の設定なら典型的な作業で4割安い」としていますが、これは自社の測定です。思考を切って使っていた処理では出力トークンが増えることもあるので、移行後に usage で確かめてください。
Q. 思考(thinking)をオフにする方法はありますか?
A. ありません。API では disabled を送ると 400 になり、Claude Code の Alt+T なども効きません。考える量を減らしたいときは effort を low にします。思考を切ること自体が必要なら、どの effort でも思考を切れる Sonnet 5 が選択肢になります。
Q. モデルIDを変えたら 400 エラーが出ました。
A. エラーメッセージで見分けられます。"thinking.type.disabled" か "thinking.type.enabled" なら思考の指定、tool_choice: type "tool" and "any" なら強制ツール使用、computer_20251124 なら旧 computer use ツールです。どれにも当たらず、会話の途中で履歴を書き換えているなら、思考ブロックの検査(7章③)を疑ってください。
Q. Claude Code で、Opus 5 のときの工数(effort)設定が効いていないようです。
A. 仕様です。/effort で保存した工数はモデルごとに分かれていて、Opus 5 用の設定も、ユーザー設定の最上位にある古い形の effortLevel も Opus 5.5 には適用されません。Opus 5.5 は medium から始まります。/effort で選び直すと、Opus 5.5 用の設定としてモデル別に保存されます。
Q. 自作のエージェントで、作業中の途中経過が表示されなくなりました。
A. Opus 5.5 では、ツール呼び出しの合間の文章が thinking ブロックで返り、既定の表示設定では中身が空になります。thinking.display を "updates"(ベータ)か "summarized" にして、空でない thinking ブロックを表示してください。
※ 本記事の数値は、Anthropic 公式発表「Introducing Claude Opus 5.5」(ベンチマークは同ページの比較表とグラフの説明文)、公式ドキュメント「Models overview」「Claude Opus 5.5」「What's new in Claude Opus 5.5」「Migrating to Claude Opus 5.5」「Pricing」、Claude Code の「Model configuration」と CHANGELOG に基づく(いずれも2026年9月24日に確認)。仕様・価格は変更されることがあるため、最終的な確認は公式ドキュメントで行ってほしい。