目录
2026 年 9 月 22 日,Anthropic 发布了 Claude Opus 5.5。公告称它是 Claude 5.5 系列的第一款模型,距离 Opus 5(7 月 24 日发布)仅过去两个月。在官方文档的模型总览中,它现在被定位为拿不准选哪个模型时、适用于大多数场景的推荐起点,而 Opus 5 已被归入 Legacy(旧款,但仍可使用)。
先说结论:价格比 Opus 5 更低(输入 $4 / 输出 $20,Opus 5 为 $5 / $25)。但 API 的行为改动很大,有四处变更会让在 Opus 5 上正常运行的代码直接返回 400 错误。此外,不指定 effort 时的默认值从 high 降到了 medium。如果只看价格就切换过去,要么撞上报错,要么质量悄悄变了却浑然不觉。本文对照官方文档与公告的原文,按实际处理的顺序,梳理改了什么、要花多少钱、迁移时哪里会出问题。
信息截至 2026 年 9 月 24 日:本文写于发布两天后,阅读了 Claude Platform 文档(模型总览、Opus 5.5 页面、What's new、迁移指南与定价)、Anthropic 的公告,以及 Claude Code 文档和 CHANGELOG 的原文。公告称将在数周内推出的 Claude Sonnet 5.5 和 Claude Haiku 5.5,在撰文时尚未发布。
降价与四处破坏性变更同时到来
—— 官方定位:面向长时间运行的智能体编程与知识工作
1. Opus 5.5 要点:性能、价格与迁移风险
在 Anthropic 的对比表中,它在智能体编程、知识工作和计算机操作上得分高于 Fable 5.1。公告本身的说法是在大多数工作上与 Fable 5.1 相当。同一份公告还提到,到了这个水平,基准分差已不再能可靠地反映实际使用中的差距。
输入和输出为 $4 / $20,比 Opus 5 便宜 20%;缓存读取为 $0.20,便宜 60%。但与 Sonnet 5 相比,输入和输出贵一倍,缓存读取则价格相同。“便宜”的含义取决于比较对象。
共四处:无法关闭思考 / 强制工具调用返回 400 / 思考块与模型和对话绑定 / 旧版计算机操作工具不可用。此外,默认 effort 降为 medium,工具调用之间的文字也移进了思考块。
一句话概括,Opus 5.5 就是“按 Fable 5.1 的方式来用的、更便宜的 Opus”。四处破坏性变更中有三处,官方文档本身就注明同样适用于 Claude Fable 5.1。如果你的代码已经做过 Fable 5.1 的迁移,剩下的工作会少得多。
2. 核心规格与可用渠道
先看数字。对比对象有三个:它所取代的 Opus 5、高一档的 Fable 5.1,以及低一档的 Sonnet 5。
| 项目 | Opus 5.5 | Opus 5(Legacy) | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| API 模型 ID | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
claude-sonnet-5 |
| 价格(输入/输出) | $4 / $20 | $5 / $25 | $10 / $50 | $2 / $10 |
| 上下文 / 最大输出 | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
| 思考 | 始终开启(无法关闭) | 默认开启。effort 为 high 及以下时可关闭 | 始终开启(无法关闭) | 默认开启。任何 effort 下都可关闭 |
| 默认 effort | medium | high | high | high |
| 可靠知识截止 | 2026 年 6 月 | 2026 年 5 月 | 2026 年 6 月 | 2026 年 1 月 |
| 速度(官方相对标注) | Moderate | — | Slower | Fast |
| 停止提供 | 不早于 2027 年 9 月 22 日 | 不早于 2027 年 7 月 24 日 | 不早于 2027 年 9 月 1 日 | 不早于 2027 年 6 月 30 日 |
来源:Anthropic“Models overview”、“Claude Opus 5.5”、“Claude Opus 5”、“Migrating to Claude Opus 5.5”(2026 年 9 月 24 日查阅)。速度是当前在售型号之间的相对标注,Opus 5 已属 Legacy,因此未标注。停止提供日期是对 Anthropic 自营平台的承诺,Amazon Bedrock 和 Google Cloud 另行规定。
这张表值得注意的是,与 Opus 5 不同的只有“思考”和“默认 effort”两行。上下文和最大输出完全相同,知识截止也只往后推了一个月。从规格表上看,它与 Opus 5 的区别在于用法和价格;性能差距请看第 4 章的表。另外,使用 Message Batches API 时,加上 beta 请求头 output-300k-2026-03-24 可以把输出上限提高到 300K token(与 Opus 5 相同)。
可用平台
Claude API(claude-opus-5-5)、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry。发布首日即在所有平台上线。
claude.ai、iOS 和 Android 应用,以及 Claude Code。在 Claude Code 中,从 v2.1.280 起,它成为包括 Pro 在内的主要方案的默认模型(第 9 章)。
高速版本属于研究预览,官方文档注明仅限 Claude API。Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 均不可用。
3. 价格:比 Opus 5 便宜,但“便宜多少”取决于跟谁比
官方 What's new 页面给出的价格是 $4 / $20,低于 Opus 5 的 $5 / $25。从 Opus 4.5 到 Opus 5,Opus 的价格一直维持在 $5 / $25,这是首次调整(已在官方定价页的表中确认)。详细费率如下。
| 每百万 token | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| 输入 | $4 | $5 | $10 | $2 |
| 输出 | $20 | $25 | $50 | $10 |
| 缓存写入(5 分钟) | $5 | $6.25 | $12.50 | $2.50 |
| 缓存写入(1 小时) | $8 | $10 | $20 | $4 |
| 缓存读取 | $0.20 输入的 5% |
$0.50 输入的 10% |
$0.25 输入的 2.5% |
$0.20 输入的 10% |
| Batch API(输入/输出) | $2 / $10 | $2.50 / $12.50 | $5 / $25 | $1 / $5 |
| 高速模式(输入/输出) | $8 / $40 | $10 / $50 | — | — |
来源:Anthropic“Pricing”(2026 年 9 月 24 日查阅)。高速模式一行只列出定价页高速模式表中收录的型号。Sonnet 5 的 $2 / $10 在发布时是截至 8 月 31 日的推广价,之后转为正式价格(据同一页面的注释)。
跟不同的模型比,“便宜”的意思不一样
与 Opus 5 相比,它每一项都更便宜。但与 Fable 5.1 或 Sonnet 5 相比,各项之间的差距并不均匀。下图把对方模型的费率设为 100,显示 Opus 5.5 的费率。
以对方模型费率 = 100 时 Opus 5.5 的费率
来源:本文根据 Anthropic“Pricing”中的费率计算(条形长度以 200 为满宽)
可以读出三点:
- 从 Opus 5 迁移过来,缓存用得越多越省钱。输入和输出便宜 20%,缓存读取便宜 60%。公告本身也指出,在智能体和编程工作中,缓存读取占了成本的大头。
- 与 Fable 5.1 相比,缓存读取的差距很小。输入和输出只要 Fable 5.1 的 40%,但缓存读取是 $0.20 对 $0.25,只差 20%。
- 与 Sonnet 5 相比,只有缓存读取价格相同。输入和输出贵一倍,但缓存读取两者都是 $0.20,所以缓存 token 占比越高,价差就越小。
算例:一个任务包含 1000 万缓存读取、50 万输入、30 万输出 token(token 数为本文假设;未计入缓存写入费用)
- Opus 5.5:$2.00 + $2.00 + $6.00 = $10.00
- Opus 5:$5.00 + $2.50 + $7.50 = $15.00(Opus 5.5 是它的三分之二)
- Fable 5.1:$2.50 + $5.00 + $15.00 = $22.50
- Sonnet 5:$2.00 + $1.00 + $3.00 = $6.00(Opus 5.5 约为 1.7 倍,而不是 2 倍)
这里是在 token 数相同的前提下比较费率;实际上各模型消耗的 token 数不同。费率来自 Anthropic“Pricing”。
还有一点:每 token 单价和最终账单是两回事。Anthropic 的公告称,在默认设置下处理典型工作时,它比 Opus 5 便宜 40%,因为单价更低,每个任务用的 token 也更少。这是 Anthropic 自己的测量结果。另一方面,官方文档也写道,在相同 effort 下,Opus 5.5 每轮的思考量往往多于 Opus 5,xhigh 和 max 时尤其明显。思考 token 即使不显示,也按输出 token 计费。在 Opus 5 上关闭思考、以低成本运行的工作负载,到了 Opus 5.5 无法关闭思考,输出 token 可能会增加。迁移之后,唯一的办法是在自己的工作负载上测量 usage 再重新比较。所有 Claude 模型的价格可参见 Opus、Sonnet、Haiku 价格对比。
4. 基准测试:只在 Anthropic 的同一张表内比较
Opus 5 的公告用图片展示对比表,而这次的公告在页面上用的是文字表格。表中有五列:Opus 5.5、Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol。首先是这张表的测量条件:
- 除非另有说明,Opus 5.5 均在最高 effort(max)下测量。唯一的例外是 Terminal-Bench 4.0:Opus 5.5 为 xhigh,GPT-6 Astra 为 high(OpenAI 公布的数值),各取该模型的最佳成绩
- Terminal-Bench 4.0 上的 GPT-6 Astra 与 GPT-5.6 Sol,以及 Terminal-Bench-Science 0.1 上的 GPT-6 Astra,是 OpenAI 公布的数值。其他行的 GPT 数值没有注明由谁测量
- AutomationBench 的数值由 Zapier 测量并公布(Opus 5.5 来自 Zapier 的抢先评测;Opus 5 与两款 GPT 来自 Zapier 的公开排行榜)。这是表中唯一明确注明由第三方测量的一行
- Opus 5.5 在启用了与生产环境相同的安全防护下测量。遇到防护介入的题目时,网络安全类改由 Opus 4.8 作答,生物学和前沿 LLM 开发类改由 Opus 5 作答。Anthropic 注明这很可能拉低了 Opus 5.5 的得分
| 基准测试 | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 终端中的智能体编程 |
66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1 (Main) 改动能否被合并 |
54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 需求模糊的多文件任务 |
57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1 (Elo) 44 种职业的实际工作 |
1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench 业务工作流(Zapier 测量) |
40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam 跨领域推理(使用工具) |
67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 智能体式科学研究 |
58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0 计算机操作(表中标注为 partial) |
81.8% | 80.7% | 74.0% | — | — |
| Chartography 图表解读(使用工具) |
89.0% | 88.4% | 83.4% | — | — |
来源:Anthropic“Introducing Claude Opus 5.5”中的对比表(2026 年 9 月 22 日;9 月 24 日查阅)。绿色表示 Opus 5.5 在该行得分最高;红色表示同一张表中该行有高于 Opus 5.5 的得分。“—”表示表中没有数值。
在 9 行中,Opus 5.5 有 7 行得分最高。领先幅度最大的是 Terminal-Bench 4.0(比 Fable 5.1 高 10.6 个百分点)和 GDPval-AA v2.1(比 Fable 5.1 高 111 分)。与上一代 Opus 5 相比,Terminal-Bench-Science 0.1 从 29.0% 升到 58.7%,大约翻了一倍。
各 effort 档位的成绩(来自公告的图表说明)
表中的数值是 max(Terminal-Bench 4.0 为 xhigh)下的成绩,但公告还附有按 effort 档位绘制的“得分 vs 每任务成本”图表,其说明文字给出了默认 medium 下的数值。
medium 下为 54.6%。以大约五分之一的每任务成本,超过了 GPT-6 Astra 的最佳成绩(53.3%)。medium 的得分高于表中 max 的得分(54.4%)。
medium 下为 52.5%。高于 Fable 5.1(max)的 51.8% 和 Opus 5(max)的 46.6%,并以大约三分之一的成本,比 GPT-5.6 Sol 的最佳成绩(41.7%)高出 11 个百分点。
在默认 effort 下,以大约五分之一的成本超过了 max 下的 Opus 5,并以约 40% 的成本追平 GPT-6 Astra。
在 medium 下,以大约五分之一的每任务成本超过了 max 下的 GPT-6 Astra。
来源:Anthropic“Introducing Claude Opus 5.5”中的图表说明(测量与比较均由 Anthropic 自行完成)
值得停下来看的是 FrontierCode。在同一份公告里,medium(54.6%)略高于 max(54.4%)。自 Opus 5 以来“提高 effort 不一定提高得分”的现象,在 Opus 5.5 上依然存在(第 6 章)。GPT-6 Astra 本身的发布内容与数值,请参见 GPT-6 Astra 发布解析。
5. 没赢的地方,以及读表时的注意点
发布报道往往只列出模型赢的那几行,所以这里补上另一面。以下内容全部来自 Anthropic 自己的公告和文档。
在 Anthropic 自己的表中,AutomationBench 为 40.0% 对 41.4%,Terminal-Bench-Science 0.1 为 58.7% 对 64.6%,都是 GPT-6 Astra 更高。需要注意,AutomationBench 在没有备用模型的情况下运行,安全防护介入时计为失败(据表格注释)。
公告以网络能力非常强为由,采用了接近 Fable 5.1 的安全防护,并把大部分网络安全工作转交给 Opus 4.8。日常开发中查找和修复 bug 仍可照常进行。
生物学领域采用与 Fable 5.1 相同的安全防护。若要用于研发,需要申请面向经审核机构的 Life Sciences Verification Program。
读表时要记住两点:第一,公告本身就说,到了这个性能水平,基准分差正在变得无法可靠反映实际差距;而且在 Anthropic 内部使用中,与 Fable 5.1 的差距感觉比数字显示的要小。最好不要把“比 Fable 5.1 高 10 个百分点”理解为实际使用中也差 10 个百分点。第二,测试版本与 Opus 5 公告的对比表不同(CursorBench 3.2 → 4.0、GDPval-AA v2 → v2.1 等)。把 7 月那张表和这张表的数字拼在一起比较,就等于在比较不同条件下测得的数值。
6. 默认 effort 降为 medium 意味着什么
这是最容易被忽略的变化。不指定 effort 的请求,在 Opus 5 上以 high 运行,在 Opus 5.5 上则以 medium 运行。代码一模一样,模型却少想了一档。
官方 effort 页面写明,显式指定默认值(Opus 5.5 为 medium)与省略 effort 的行为完全相同。想要与 Opus 5 相同的思考深度,就要显式指定 high。
在相同 effort 下,Opus 5.5 每轮的思考量往往多于 Opus 5,xhigh 和 max 时尤其明显(What's new)。沿用 Opus 5 的 high,不一定得到相同的结果。
因为思考无法关闭,能调节思考量和成本的只剩 effort。在 Opus 5 上关闭思考的地方,改为调低 effort。
那么该用哪一档?以下是官方文档的指引,按 Opus 5.5 的情况整理。
| effort | 适用场景(官方说明) | Opus 5.5 的注意点 |
|---|---|---|
| low | 速度和成本优先的简单任务,例如子智能体 | 可作为 Opus 5 上关闭思考的工作负载的替代候选 |
| medium(默认) | 需要平衡速度、成本和性能的智能体工作 | 在公告图表中,就是这一档在 FrontierCode 和 CursorBench 上超过了竞品的最佳成绩 |
| high | 复杂推理、高难度编程和智能体工作 | Opus 5 的默认值。迁移后做对比时,适合作为基准 |
| xhigh | 长时间运行的智能体编程工作 | max_tokens 从 64K token 起步再调整(迁移指南) |
| max | 需要最深推理的难题 | Claude Code 文档提醒,收益容易见顶,且容易想太多,大范围使用前先测试 |
来源:Anthropic“Effort”、迁移指南、Claude Code“Model configuration”
官方的建议始终如一:不要沿用上一代模型的设置,要在自己的评测集上重新调整 effort。公告还引用了抢先测试企业的评价,例如 Deloitte 称即便在最低 effort 下,它找到的已知 bug 也比 high 下的 Opus 5 更多。但这些都是各公司在自己工作上测得、由 Anthropic 选择刊登的结果,不能保证你的工作负载也会如此。请在自己的工作上确认:medium 的质量是否够用,调到 high 又会改善什么。在 Opus 5.5 上,还可以在对话中途逐条消息更改 effort,而不会破坏提示缓存(beta)。
7. 从 Opus 5 迁移时会出错的四处变更及对策
官方的 What's new in Claude Opus 5.5 列出了影响 Opus 5 上运行代码的四处破坏性变更。它们都会返回 400 invalid_request_error。
① 无法关闭思考
Opus 5 在 effort 为 high 及以下时接受 thinking: {"type": "disabled"}。在 Opus 5.5 上,思考始终开启,无论 disabled 还是手动预算 {"type": "enabled", "budget_tokens": N},在任何 effort 下都会报错。返回的消息如下:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
对策:删掉 thinking 参数(此时与 {"type": "adaptive"} 等同)。原本为了省钱而关闭思考的地方,改为调低 effort。
# 修改前:在 Opus 5 上可用,在 Opus 5.5 上返回 400 client.messages.create( model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, messages=[...], ) # 修改后:思考始终开启,用 effort 决定思考量 client.messages.create( model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...], )
由于思考一定会运行,响应可能以思考块开头。像 content[0].text 这样按位置读取的代码会出错,应改为筛选 type 为 "text" 的块。在工具调用循环中,即使思考块为空,也要原样传回(编辑、调换顺序或删掉其中一部分都会返回 400)。max_tokens 是思考和回复的合计上限,所以原本关闭思考的工作负载需要重新评估这个上限。
② 强制工具调用会报错
把 tool_choice 设为 {"type": "any"} 或 {"type": "tool", "name": "..."} 会返回 400。token 计数 API 也做同样的检查。只允许 auto(默认)和 none。
tool_choice: type "tool" and "any" are not supported for this model.
对策:把 tool_choice 保持为 auto,并在工具定义中加上 strict: true(strict tool use),或者把 schema 移到结构化输出。然后在提示词里写明何时应使用该工具。如果你使用强制工具调用只是为了保证输出 JSON,改用结构化输出会更干净。需要注意的是,strict tool use 只接受 JSON Schema 的一个子集,而且schema 中的每个 object 都需要 additionalProperties: false。
# 修改后:auto + strict,用文字说明何时使用工具 client.messages.create( model="claude-opus-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
③ 思考块与模型和对话绑定
每个思考块都记录着生成它的模型。Opus 5.5 可以读取 Opus 5 及以前的 Opus、Sonnet、Haiku 模型的思考块,但不能读取 Fable 或 Mythos 的。反过来,只有 Claude API 上的 Fable 5.1 和 Mythos 5.1 能读取 Opus 5.5 的思考块。
- 从 Opus 5 切到 Opus 5.5,或从 Opus 5.5 切到 Fable 5.1(Claude API)时,之前的推理会被继承
- 其他切换(例如 Opus 5.5 → Sonnet 5)意味着切换之后的轮次不带上一个模型的推理运行。请求本身会成功,被丢弃的块也不计费
此外,API 会检查 Opus 5.5 思考块之前的内容(system、tools、更早的消息)自该块生成以来是否有过改动。对于 2026 年 8 月 31 日 00:00(UTC)及以后创建的账号,这项检查默认强制执行,在对话中途改写过的历史上传回思考块会返回 400。
对策:对话只追加、不改写。想更改指令或工具时,用对话中途的系统消息,而不是改写历史。据迁移指南,Claude Code、claude.ai、Claude Managed Agents 和 Claude Agent SDK 本来就只追加,所以如果你是在它们之上构建的,无需任何修改。如果无法避免改写,可以加上 beta 请求头 thinking-binding-controls-2026-08-01,并把 thinking.block_binding.prefix_mismatch_behavior 设为 "drop_block",让受影响的块被丢弃而不是报错。这一机制与 Fable 5.1 相同,我们在 Fable 5.1 破坏性变更一文中有详细介绍。
④ Claude API 和 Google Cloud 上不能使用旧版计算机操作工具
Opus 5 同时接受新工具集 computer_toolset_20260801 和带 beta 请求头的旧工具 computer_20251124 进行计算机操作。Claude API 和 Google Cloud 上的 Opus 5.5 只接受工具集,声明旧工具会返回 400。消息开头如下:
'claude-opus-5-5' does not support tool types: computer_20251124.
对策:删掉 beta 请求头,把 tools 换成 [{"type": "computer_toolset_20260801"}](不需要名称和屏幕尺寸)。智能体循环也有三处要改:操作类型在块的 name 中,而不在 input.action 中;一轮中可能包含多个操作;每个结果都要连同 toolset_name 一起返回。在 Amazon Bedrock 上,Opus 5.5 仍可使用旧工具,因此无需修改。
8. 不报错却悄悄改变的地方
四处破坏性变更都会返回 400,所以你一定会发现。麻烦的是那些不报错、只有行为改变的地方。
| 变化 | 会发生什么 / 该怎么做 |
|---|---|
| 工具调用之间的文字进入思考块 | 像“接下来我检查一下 X”这样的短句,在 Opus 5 上是文本块,现在则作为进度型思考块返回。在默认显示设置(display: "omitted")下它们是空的,因此原本向用户流式显示进度的界面,在工具调用之间会变得毫无动静。把 display 设为 "updates"(beta,请求头 thinking-display-updates-2026-08-18;只返回进度,推理内容保持隐藏)或 "summarized"(推理摘要与进度混合返回),并在随后的 tool_use 之前显示非空的思考块 |
| 拒绝的类别增加 | 除网络安全分类器外,生物学分类器也开始运行;试图让模型把内部推理写进回复的请求,可能以 reasoning_extraction 被拒绝。拒绝会以 HTTP 200 加 stop_reason: "refusal" 返回,所以要读取 stop_details 来处理。服务端回退(fallbacks: "default",beta)不会对 reasoning_extraction 重试 |
| 图表和图示的读取更准确 | 即使不用工具,也能准确读取包含精细图表或依赖版式的图片。为旧模型加的提示词变通写法可能不再需要(不过对最精细的输入,加上工具仍能提高准确度) |
| 从 Opus 4.8 迁移:没有 Priority Tier | Opus 4.8 支持 Priority Tier,Opus 5.5 不支持。有合约的组织需要另行规划容量 |
来源:What's new in Claude Opus 5.5、Migrating to Claude Opus 5.5
9. Claude Code 与 claude.ai 有哪些变化
如果你不直接调用 API,这一部分才是重点。Claude Code 在 CHANGELOG 的 v2.1.280 中加入了对 Opus 5.5 的支持。
在 Pro、Max、Team、Enterprise 和 API 上,default 现在指 Opus 5.5。Pro 和 Team Standard 此前的默认是 Sonnet 5,对它们来说这是从 Sonnet 换成了 Opus。在 Claude API、Claude Platform on AWS、Bedrock 和 Google Cloud 上,opus 别名也指向 Opus 5.5。低于 v2.1.280 的版本无法使用,请运行 claude update。
Opus 5.5 从 medium 开始。在 Opus 5 时期用 /effort 保存的 effort 不会被继承(无论是按模型保存的设置,还是用户设置中旧的顶层 effortLevel,都不适用于 Opus 5.5)。在你用 /effort 或 /model 界面重新选择之前,它都以 medium 运行。CLAUDE_CODE_EFFORT_LEVEL 环境变量,以及在项目设置或托管设置中指定的 effortLevel,则适用于所有模型。
Alt+T(macOS 上为 Option+T)、alwaysThinkingEnabled 和 MAX_THINKING_TOKENS=0 对 Opus 5.5 和 Fable 都不起作用。从 v2.1.281 起,在无法关闭思考的模型上,Claude Code 不再切换开关,而是显示一行说明。
分类器触发时,生物学请求会在 Opus 5 上重新运行,网络安全请求会在 Opus 4.8 上重新运行,并且会话会停留在那个模型上。用 /model 切换回来。官方文档说,渗透测试、CTF 或生物学内容较多的代码库,往往从第一个请求就会触发。
来源:Claude Code“Model configuration”与 CHANGELOG(v2.1.280 和 v2.1.281,2026 年 9 月 24 日查阅)
Claude Code 如何保存 effort,请参见 effort 设置指南;思考本身的工作原理,请参见自适应思考与扩展思考。据 Anthropic 的公告,高速模式(最高 2.5 倍速度,输入 $8 / 输出 $40)在 Claude Code 中同样可用。
claude.ai 与应用
从发布当天起,claude.ai 以及 iOS 和 Android 应用中就可以选择 Opus 5.5(Anthropic 也公开了同日日期的 Opus 5.5 系统提示词)。公告还说,伴随降价,将提高 Pro、Max、Team 和按席位计费的 Enterprise 的五小时用量上限,并给订阅用户一次可随时使用的用量上限重置。公告没有给出上限提高多少的具体数字。各方案的价格请参见 Claude 与 ChatGPT 价格对比。
10. Opus 5.5、Fable 5.1、Sonnet 5、Opus 5 怎么选
官方模型总览里的指引很简短:拿不准就从 Opus 5.5 开始;需要高难度推理和长时间智能体工作,或者在 high effort 下评估过 Opus 5.5 仍不够用时,再选 Fable 5.1。再叠加价格和 API 限制,选择可以这样划分。
- 想先定下一个模型(官方推荐的起点)
- 长时间运行的智能体编程和知识工作
- 正在用 Opus 5(每项费率都更便宜)
- Fable 5.1 的费用压力大,想测试 Opus 5.5 是否够用
- 在 high 及以上评估 Opus 5.5 后,质量仍然不够
- 高难度推理、超长时间的智能体工作
- 缓存用量大的工作,费率差距比输入/输出小($0.25 对 $0.20)
- 需要速度或大批量处理(官方速度标注为 Fast)
- 想关闭思考,或继续使用强制工具调用
- 输入和输出只要 Opus 5.5 的一半(缓存读取价格相同)
- 后继的 Sonnet 5.5 已宣布将在数周内推出
- 作为修好第 7 章四处问题之前的过渡
- 虽属 Legacy 但仍可使用,停止提供不早于 2027 年 7 月 24 日
- 每项费率都高于 Opus 5.5,没什么理由长期停留
拿不准时,顺序很简单:① 在自己的工作上用 medium 和 high 跑 Opus 5.5 → ② 不够就试 xhigh → ③ 还不够就换 Fable 5.1 → 如果 medium 就绰绰有余,再看看 low 或 Sonnet 5 是否也够用。提高 effort 和换更高一档的模型,都是花钱买质量;哪一种性价比更高,取决于具体工作。
11. 迁移步骤(API 用户)
以下从迁移指南的检查清单中,挑出从 Opus 5 迁移时适用的项目,按实际操作顺序排列。Claude Code 还提供 /claude-api migrate 来协助迁移(迁移指南中提到的内置技能,会在修改前先与你确认范围)。
- 把模型 ID 从
claude-opus-5改为claude-opus-5-5(Bedrock 上为anthropic.claude-opus-5-5) - 从
thinking中删除disabled和enabled(带预算),改为选择 effort - 显式指定 effort(省略即为 medium;要与 Opus 5 深度相同就用
high) - 把
tool_choice中的any和tool换成auto加 strict tool use,或换成结构化输出 - 如果在 Claude API 或 Google Cloud 上使用计算机操作,迁移到
computer_toolset_20260801并修改循环 - 读取响应时按
type筛选块;在工具循环中原样传回思考块 - 如果在界面中显示进度,把
display设为"updates"或"summarized" - 如果在对话中途改写
system、tools或过去的消息,改为只追加的方式 - 如果把请求路由到其他模型,按“Opus 5.5 的推理不会被继承”的前提进行测试
- 处理
stop_reason: "refusal"并配置回退 - 对原本关闭思考的工作负载,重新评估
max_tokens(xhigh 和 max 从 64K 起步) - 在所选 effort 下重新测量成本和延迟
来源:Anthropic“Migrating to Claude Opus 5.5”中“Every starting model”一节的项目,按操作顺序重新排列
如果直接从 Opus 4.8 或更早的版本迁移,还需要应对从未指定思考的请求现在也会运行思考这一点。建议同时查看 Opus 5 发布解析中的迁移步骤。
总结
Claude Opus 5.5 是降价与用法变化同时到来的一次发布。输入和输出费率降了 20%,缓存读取降了 60%,在 Anthropic 自己的对比表中,它在许多行上超过了 Fable 5.1。另一方面,思考不能再关闭,强制工具调用、旧版计算机操作工具和改写历史现在都会导致 400 错误。
而默认 effort 降为 medium,恰恰因为不报错才容易被忽略。在 API 上要显式指定 effort;在 Claude Code 中,要确认 Opus 5 时期的设置没有悄悄失效。是否真的变便宜了,要用 usage 来测,而不是看每 token 单价。
最后,基准数值是在那张表、那些条件下测得的数值。在 AutomationBench 和 Terminal-Bench-Science 上,同一张表中 GPT-6 Astra 更高;Anthropic 自己也说与 Fable 5.1 的差距比数字显示的要小。先在自己的工作上比较 medium 和 high 吧。
常见问题
Q. Opus 5.5 比 Opus 5 便宜吗?
A. 每 token 费率每一项都更低(输入 $4、输出 $20、缓存读取 $0.20,Opus 5 分别为 $5、$25 和 $0.50)。Anthropic 称默认设置下处理典型工作便宜 40%,但这是它自己的测量结果。原本关闭思考运行的工作负载,输出 token 可能会增加,迁移后请检查 usage。
Q. 有办法关闭思考吗?
A. 没有。在 API 上发送 disabled 会返回 400,Claude Code 的 Alt+T 等设置也不起作用。想减少思考量,就把 effort 设为 low。如果确实需要关闭思考,可以选择在任何 effort 下都能关闭思考的 Sonnet 5。
Q. 改了模型 ID 之后出现 400 错误。
A. 错误消息会告诉你是哪一种。"thinking.type.disabled" 或 "thinking.type.enabled" 指向思考设置,tool_choice: type "tool" and "any" 指向强制工具调用,computer_20251124 指向旧版计算机操作工具。如果都不是,而你又在对话中途改写了历史,就要怀疑是思考块的检查(第 7 章③)。
Q. 在 Claude Code 中,Opus 5 时期的 effort 设置好像没生效。
A. 这是设计如此。用 /effort 保存的 effort 按模型分别存储,无论是 Opus 5 的设置,还是用户设置中旧的顶层 effortLevel,都不适用于 Opus 5.5。Opus 5.5 从 medium 开始。用 /effort 重新选择一次,就会作为 Opus 5.5 的按模型设置保存下来。
Q. 自己做的智能体在运行时不再显示进度了。
A. 在 Opus 5.5 上,工具调用之间的文字会放在思考块里返回,而在默认显示设置下这些块是空的。把 thinking.display 设为 "updates"(beta)或 "summarized",并显示非空的思考块。
附注:本文数值依据 Anthropic 官方公告“Introducing Claude Opus 5.5”(基准数值来自该页面的对比表和图表说明)、官方文档“Models overview”“Claude Opus 5.5”“What's new in Claude Opus 5.5”“Migrating to Claude Opus 5.5”“Pricing”,以及 Claude Code 的“Model configuration”和 CHANGELOG(均于 2026 年 9 月 24 日查阅)。规格和价格可能变动,请以官方文档为准。