2026 年 9 月 22 日,Anthropic 发布了 Claude Opus 5.5。公告称它是 Claude 5.5 系列的第一款模型,距离 Opus 5(7 月 24 日发布)仅过去两个月。在官方文档的模型总览中,它现在被定位为拿不准选哪个模型时、适用于大多数场景的推荐起点,而 Opus 5 已被归入 Legacy(旧款,但仍可使用)。

先说结论:价格比 Opus 5 更低(输入 $4 / 输出 $20,Opus 5 为 $5 / $25)。但 API 的行为改动很大,有四处变更会让在 Opus 5 上正常运行的代码直接返回 400 错误。此外,不指定 effort 时的默认值从 high 降到了 medium。如果只看价格就切换过去,要么撞上报错,要么质量悄悄变了却浑然不觉。本文对照官方文档与公告的原文,按实际处理的顺序,梳理改了什么、要花多少钱、迁移时哪里会出问题

信息截至 2026 年 9 月 24 日:本文写于发布两天后,阅读了 Claude Platform 文档(模型总览、Opus 5.5 页面、What's new、迁移指南与定价)、Anthropic 的公告,以及 Claude Code 文档和 CHANGELOG 的原文。公告称将在数周内推出的 Claude Sonnet 5.5 和 Claude Haiku 5.5,在撰文时尚未发布。

CLAUDE OPUS 5.5 — 2026.09.22

降价与四处破坏性变更同时到来

—— 官方定位:面向长时间运行的智能体编程与知识工作

模型 ID
claude-opus-5-5
没有日期后缀(官方模型总览)
价格(每百万 token)
$4 / $20
Opus 5 为 $5 / $25(官方定价页)
默认 effort
medium
Opus 5 为 high;思考始终开启(官方文档)
注意
4 处破坏性变更
Anthropic 列为 breaking changes
来源:Anthropic 官方公告与 Claude Platform 文档(2026 年 9 月 22 日)

1. Opus 5.5 要点:性能、价格与迁移风险

① 性能

在 Anthropic 的对比表中,它在智能体编程、知识工作和计算机操作上得分高于 Fable 5.1。公告本身的说法是在大多数工作上与 Fable 5.1 相当。同一份公告还提到,到了这个水平,基准分差已不再能可靠地反映实际使用中的差距。

② 价格

输入和输出为 $4 / $20,比 Opus 5 便宜 20%;缓存读取为 $0.20,便宜 60%。但与 Sonnet 5 相比,输入和输出贵一倍,缓存读取则价格相同。“便宜”的含义取决于比较对象。

③ 迁移风险

共四处:无法关闭思考 / 强制工具调用返回 400 / 思考块与模型和对话绑定 / 旧版计算机操作工具不可用。此外,默认 effort 降为 medium,工具调用之间的文字也移进了思考块。

一句话概括,Opus 5.5 就是“按 Fable 5.1 的方式来用的、更便宜的 Opus”。四处破坏性变更中有三处,官方文档本身就注明同样适用于 Claude Fable 5.1。如果你的代码已经做过 Fable 5.1 的迁移,剩下的工作会少得多。

2. 核心规格与可用渠道

先看数字。对比对象有三个:它所取代的 Opus 5、高一档的 Fable 5.1,以及低一档的 Sonnet 5。

项目 Opus 5.5 Opus 5(Legacy) Fable 5.1 Sonnet 5
API 模型 ID claude-opus-5-5 claude-opus-5 claude-fable-5-1 claude-sonnet-5
价格(输入/输出) $4 / $20 $5 / $25 $10 / $50 $2 / $10
上下文 / 最大输出 1M / 128K 1M / 128K 1M / 128K 1M / 128K
思考 始终开启(无法关闭) 默认开启。effort 为 high 及以下时可关闭 始终开启(无法关闭) 默认开启。任何 effort 下都可关闭
默认 effort medium high high high
可靠知识截止 2026 年 6 月 2026 年 5 月 2026 年 6 月 2026 年 1 月
速度(官方相对标注) Moderate Slower Fast
停止提供 不早于 2027 年 9 月 22 日 不早于 2027 年 7 月 24 日 不早于 2027 年 9 月 1 日 不早于 2027 年 6 月 30 日

来源:Anthropic“Models overview”“Claude Opus 5.5”“Claude Opus 5”“Migrating to Claude Opus 5.5”(2026 年 9 月 24 日查阅)。速度是当前在售型号之间的相对标注,Opus 5 已属 Legacy,因此未标注。停止提供日期是对 Anthropic 自营平台的承诺,Amazon Bedrock 和 Google Cloud 另行规定。

这张表值得注意的是,与 Opus 5 不同的只有“思考”和“默认 effort”两行。上下文和最大输出完全相同,知识截止也只往后推了一个月。从规格表上看,它与 Opus 5 的区别在于用法和价格;性能差距请看第 4 章的表。另外,使用 Message Batches API 时,加上 beta 请求头 output-300k-2026-03-24 可以把输出上限提高到 300K token(与 Opus 5 相同)。

可用平台

API / 云平台

Claude API(claude-opus-5-5)、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry。发布首日即在所有平台上线。

应用 / 开发工具

claude.ai、iOS 和 Android 应用,以及 Claude Code。在 Claude Code 中,从 v2.1.280 起,它成为包括 Pro 在内的主要方案的默认模型(第 9 章)。

高速模式的限制

高速版本属于研究预览,官方文档注明仅限 Claude API。Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 均不可用。

3. 价格:比 Opus 5 便宜,但“便宜多少”取决于跟谁比

官方 What's new 页面给出的价格是 $4 / $20,低于 Opus 5 的 $5 / $25。从 Opus 4.5 到 Opus 5,Opus 的价格一直维持在 $5 / $25,这是首次调整(已在官方定价页的表中确认)。详细费率如下。

每百万 token Opus 5.5 Opus 5 Fable 5.1 Sonnet 5
输入 $4 $5 $10 $2
输出 $20 $25 $50 $10
缓存写入(5 分钟) $5 $6.25 $12.50 $2.50
缓存写入(1 小时) $8 $10 $20 $4
缓存读取 $0.20
输入的 5%
$0.50
输入的 10%
$0.25
输入的 2.5%
$0.20
输入的 10%
Batch API(输入/输出) $2 / $10 $2.50 / $12.50 $5 / $25 $1 / $5
高速模式(输入/输出) $8 / $40 $10 / $50

来源:Anthropic“Pricing”(2026 年 9 月 24 日查阅)。高速模式一行只列出定价页高速模式表中收录的型号。Sonnet 5 的 $2 / $10 在发布时是截至 8 月 31 日的推广价,之后转为正式价格(据同一页面的注释)。

跟不同的模型比,“便宜”的意思不一样

与 Opus 5 相比,它每一项都更便宜。但与 Fable 5.1 或 Sonnet 5 相比,各项之间的差距并不均匀。下图把对方模型的费率设为 100,显示 Opus 5.5 的费率。

以对方模型费率 = 100 时 Opus 5.5 的费率

对比 Opus 5
输入、输出、缓存写入
80
缓存读取
40
对比 Fable 5.1
输入、输出、缓存写入
40
缓存读取
80
对比 Sonnet 5
输入、输出、缓存写入
200
缓存读取
100

来源:本文根据 Anthropic“Pricing”中的费率计算(条形长度以 200 为满宽)

可以读出三点:

  • 从 Opus 5 迁移过来,缓存用得越多越省钱。输入和输出便宜 20%,缓存读取便宜 60%。公告本身也指出,在智能体和编程工作中,缓存读取占了成本的大头。
  • 与 Fable 5.1 相比,缓存读取的差距很小。输入和输出只要 Fable 5.1 的 40%,但缓存读取是 $0.20 对 $0.25,只差 20%。
  • 与 Sonnet 5 相比,只有缓存读取价格相同。输入和输出贵一倍,但缓存读取两者都是 $0.20,所以缓存 token 占比越高,价差就越小。

算例:一个任务包含 1000 万缓存读取、50 万输入、30 万输出 token(token 数为本文假设;未计入缓存写入费用)

  • Opus 5.5:$2.00 + $2.00 + $6.00 = $10.00
  • Opus 5:$5.00 + $2.50 + $7.50 = $15.00(Opus 5.5 是它的三分之二)
  • Fable 5.1:$2.50 + $5.00 + $15.00 = $22.50
  • Sonnet 5:$2.00 + $1.00 + $3.00 = $6.00(Opus 5.5 约为 1.7 倍,而不是 2 倍)

这里是在 token 数相同的前提下比较费率;实际上各模型消耗的 token 数不同。费率来自 Anthropic“Pricing”。

还有一点:每 token 单价和最终账单是两回事。Anthropic 的公告称,在默认设置下处理典型工作时,它比 Opus 5 便宜 40%,因为单价更低,每个任务用的 token 也更少。这是 Anthropic 自己的测量结果。另一方面,官方文档也写道,在相同 effort 下,Opus 5.5 每轮的思考量往往多于 Opus 5,xhigh 和 max 时尤其明显。思考 token 即使不显示,也按输出 token 计费。在 Opus 5 上关闭思考、以低成本运行的工作负载,到了 Opus 5.5 无法关闭思考,输出 token 可能会增加。迁移之后,唯一的办法是在自己的工作负载上测量 usage 再重新比较。所有 Claude 模型的价格可参见 Opus、Sonnet、Haiku 价格对比

4. 基准测试:只在 Anthropic 的同一张表内比较

Opus 5 的公告用图片展示对比表,而这次的公告在页面上用的是文字表格。表中有五列:Opus 5.5、Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol。首先是这张表的测量条件

  • 除非另有说明,Opus 5.5 均在最高 effort(max)下测量。唯一的例外是 Terminal-Bench 4.0:Opus 5.5 为 xhigh,GPT-6 Astra 为 high(OpenAI 公布的数值),各取该模型的最佳成绩
  • Terminal-Bench 4.0 上的 GPT-6 Astra 与 GPT-5.6 Sol,以及 Terminal-Bench-Science 0.1 上的 GPT-6 Astra,是 OpenAI 公布的数值。其他行的 GPT 数值没有注明由谁测量
  • AutomationBench 的数值由 Zapier 测量并公布(Opus 5.5 来自 Zapier 的抢先评测;Opus 5 与两款 GPT 来自 Zapier 的公开排行榜)。这是表中唯一明确注明由第三方测量的一行
  • Opus 5.5 在启用了与生产环境相同的安全防护下测量。遇到防护介入的题目时,网络安全类改由 Opus 4.8 作答,生物学和前沿 LLM 开发类改由 Opus 5 作答。Anthropic 注明这很可能拉低了 Opus 5.5 的得分
基准测试 Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0
终端中的智能体编程
66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1 (Main)
改动能否被合并
54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0
需求模糊的多文件任务
57.8% 51.8% 46.6% 41.7%
GDPval-AA v2.1 (Elo)
44 种职业的实际工作
1846 1735 1708 1542 1588
AutomationBench
业务工作流(Zapier 测量)
40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam
跨领域推理(使用工具)
67.7% 65.6% 63.6% 57.2%
Terminal-Bench-Science 0.1
智能体式科学研究
58.7% 52.6% 29.0% 64.6% 22.4%
OSWorld 2.0
计算机操作(表中标注为 partial)
81.8% 80.7% 74.0%
Chartography
图表解读(使用工具)
89.0% 88.4% 83.4%

来源:Anthropic“Introducing Claude Opus 5.5”中的对比表(2026 年 9 月 22 日;9 月 24 日查阅)。绿色表示 Opus 5.5 在该行得分最高;红色表示同一张表中该行有高于 Opus 5.5 的得分。“—”表示表中没有数值。

在 9 行中,Opus 5.5 有 7 行得分最高。领先幅度最大的是 Terminal-Bench 4.0(比 Fable 5.1 高 10.6 个百分点)和 GDPval-AA v2.1(比 Fable 5.1 高 111 分)。与上一代 Opus 5 相比,Terminal-Bench-Science 0.1 从 29.0% 升到 58.7%,大约翻了一倍。

各 effort 档位的成绩(来自公告的图表说明)

表中的数值是 max(Terminal-Bench 4.0 为 xhigh)下的成绩,但公告还附有按 effort 档位绘制的“得分 vs 每任务成本”图表,其说明文字给出了默认 medium 下的数值。

FrontierCode v1.1

medium 下为 54.6%。以大约五分之一的每任务成本,超过了 GPT-6 Astra 的最佳成绩(53.3%)。medium 的得分高于表中 max 的得分(54.4%)。

CursorBench 4.0

medium 下为 52.5%。高于 Fable 5.1(max)的 51.8% 和 Opus 5(max)的 46.6%,并以大约三分之一的成本,比 GPT-5.6 Sol 的最佳成绩(41.7%)高出 11 个百分点。

Terminal-Bench 4.0

在默认 effort 下,以大约五分之一的成本超过了 max 下的 Opus 5,并以约 40% 的成本追平 GPT-6 Astra。

GDPval-AA v2.1

在 medium 下,以大约五分之一的每任务成本超过了 max 下的 GPT-6 Astra。

来源:Anthropic“Introducing Claude Opus 5.5”中的图表说明(测量与比较均由 Anthropic 自行完成)

值得停下来看的是 FrontierCode。在同一份公告里,medium(54.6%)略高于 max(54.4%)。自 Opus 5 以来“提高 effort 不一定提高得分”的现象,在 Opus 5.5 上依然存在(第 6 章)。GPT-6 Astra 本身的发布内容与数值,请参见 GPT-6 Astra 发布解析

5. 没赢的地方,以及读表时的注意点

发布报道往往只列出模型赢的那几行,所以这里补上另一面。以下内容全部来自 Anthropic 自己的公告和文档。

业务工作流和科学研究由 GPT-6 Astra 领先

在 Anthropic 自己的表中,AutomationBench 为 40.0% 对 41.4%,Terminal-Bench-Science 0.1 为 58.7% 对 64.6%,都是 GPT-6 Astra 更高。需要注意,AutomationBench 在没有备用模型的情况下运行,安全防护介入时计为失败(据表格注释)。

网络安全工作交给别的模型

公告以网络能力非常强为由,采用了接近 Fable 5.1 的安全防护,并把大部分网络安全工作转交给 Opus 4.8。日常开发中查找和修复 bug 仍可照常进行。

生物学研究同样受限

生物学领域采用与 Fable 5.1 相同的安全防护。若要用于研发,需要申请面向经审核机构的 Life Sciences Verification Program。

读表时要记住两点:第一,公告本身就说,到了这个性能水平,基准分差正在变得无法可靠反映实际差距;而且在 Anthropic 内部使用中,与 Fable 5.1 的差距感觉比数字显示的要小。最好不要把“比 Fable 5.1 高 10 个百分点”理解为实际使用中也差 10 个百分点。第二,测试版本与 Opus 5 公告的对比表不同(CursorBench 3.2 → 4.0、GDPval-AA v2 → v2.1 等)。把 7 月那张表和这张表的数字拼在一起比较,就等于在比较不同条件下测得的数值。

6. 默认 effort 降为 medium 意味着什么

这是最容易被忽略的变化。不指定 effort 的请求,在 Opus 5 上以 high 运行,在 Opus 5.5 上则以 medium 运行。代码一模一样,模型却少想了一档。

① 不设置就会降一档

官方 effort 页面写明,显式指定默认值(Opus 5.5 为 medium)与省略 effort 的行为完全相同。想要与 Opus 5 相同的思考深度,就要显式指定 high

② 名字相同,深度不同

在相同 effort 下,Opus 5.5 每轮的思考量往往多于 Opus 5,xhigh 和 max 时尤其明显(What's new)。沿用 Opus 5 的 high,不一定得到相同的结果。

③ 它成了唯一的调节旋钮

因为思考无法关闭,能调节思考量和成本的只剩 effort。在 Opus 5 上关闭思考的地方,改为调低 effort。

那么该用哪一档?以下是官方文档的指引,按 Opus 5.5 的情况整理。

effort 适用场景(官方说明) Opus 5.5 的注意点
low 速度和成本优先的简单任务,例如子智能体 可作为 Opus 5 上关闭思考的工作负载的替代候选
medium(默认) 需要平衡速度、成本和性能的智能体工作 在公告图表中,就是这一档在 FrontierCode 和 CursorBench 上超过了竞品的最佳成绩
high 复杂推理、高难度编程和智能体工作 Opus 5 的默认值。迁移后做对比时,适合作为基准
xhigh 长时间运行的智能体编程工作 max_tokens 从 64K token 起步再调整(迁移指南)
max 需要最深推理的难题 Claude Code 文档提醒,收益容易见顶,且容易想太多,大范围使用前先测试

来源:Anthropic“Effort”、迁移指南、Claude Code“Model configuration”

官方的建议始终如一:不要沿用上一代模型的设置,要在自己的评测集上重新调整 effort。公告还引用了抢先测试企业的评价,例如 Deloitte 称即便在最低 effort 下,它找到的已知 bug 也比 high 下的 Opus 5 更多。但这些都是各公司在自己工作上测得、由 Anthropic 选择刊登的结果,不能保证你的工作负载也会如此。请在自己的工作上确认:medium 的质量是否够用,调到 high 又会改善什么。在 Opus 5.5 上,还可以在对话中途逐条消息更改 effort,而不会破坏提示缓存(beta)。

7. 从 Opus 5 迁移时会出错的四处变更及对策

官方的 What's new in Claude Opus 5.5 列出了影响 Opus 5 上运行代码的四处破坏性变更。它们都会返回 400 invalid_request_error

① 无法关闭思考

Opus 5 在 effort 为 high 及以下时接受 thinking: {"type": "disabled"}。在 Opus 5.5 上,思考始终开启,无论 disabled 还是手动预算 {"type": "enabled", "budget_tokens": N}在任何 effort 下都会报错。返回的消息如下:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

对策:删掉 thinking 参数(此时与 {"type": "adaptive"} 等同)。原本为了省钱而关闭思考的地方,改为调低 effort。

# 修改前:在 Opus 5 上可用,在 Opus 5.5 上返回 400
client.messages.create(
    model="claude-opus-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    messages=[...],
)

# 修改后:思考始终开启,用 effort 决定思考量
client.messages.create(
    model="claude-opus-5-5",
    max_tokens=16000,
    output_config={"effort": "low"},
    messages=[...],
)

由于思考一定会运行,响应可能以思考块开头。像 content[0].text 这样按位置读取的代码会出错,应改为筛选 type"text" 的块。在工具调用循环中,即使思考块为空,也要原样传回(编辑、调换顺序或删掉其中一部分都会返回 400)。max_tokens 是思考和回复的合计上限,所以原本关闭思考的工作负载需要重新评估这个上限。

② 强制工具调用会报错

tool_choice 设为 {"type": "any"}{"type": "tool", "name": "..."} 会返回 400。token 计数 API 也做同样的检查。只允许 auto(默认)和 none

tool_choice: type "tool" and "any" are not supported for this model.

对策:tool_choice 保持为 auto,并在工具定义中加上 strict: true(strict tool use),或者把 schema 移到结构化输出。然后在提示词里写明何时应使用该工具。如果你使用强制工具调用只是为了保证输出 JSON,改用结构化输出会更干净。需要注意的是,strict tool use 只接受 JSON Schema 的一个子集,而且schema 中的每个 object 都需要 additionalProperties: false

# 修改后:auto + strict,用文字说明何时使用工具
client.messages.create(
    model="claude-opus-5-5",
    max_tokens=1024,
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[{"role": "user",
               "content": "What's the weather in Paris? Use the get_weather tool."}],
)

③ 思考块与模型和对话绑定

每个思考块都记录着生成它的模型。Opus 5.5 可以读取 Opus 5 及以前的 Opus、Sonnet、Haiku 模型的思考块,但不能读取 Fable 或 Mythos 的。反过来,只有 Claude API 上的 Fable 5.1 和 Mythos 5.1 能读取 Opus 5.5 的思考块。

  • 从 Opus 5 切到 Opus 5.5,或从 Opus 5.5 切到 Fable 5.1(Claude API)时,之前的推理会被继承
  • 其他切换(例如 Opus 5.5 → Sonnet 5)意味着切换之后的轮次不带上一个模型的推理运行。请求本身会成功,被丢弃的块也不计费

此外,API 会检查 Opus 5.5 思考块之前的内容(systemtools、更早的消息)自该块生成以来是否有过改动。对于 2026 年 8 月 31 日 00:00(UTC)及以后创建的账号,这项检查默认强制执行,在对话中途改写过的历史上传回思考块会返回 400。

对策:对话只追加、不改写。想更改指令或工具时,用对话中途的系统消息,而不是改写历史。据迁移指南,Claude Code、claude.ai、Claude Managed Agents 和 Claude Agent SDK 本来就只追加,所以如果你是在它们之上构建的,无需任何修改。如果无法避免改写,可以加上 beta 请求头 thinking-binding-controls-2026-08-01,并把 thinking.block_binding.prefix_mismatch_behavior 设为 "drop_block",让受影响的块被丢弃而不是报错。这一机制与 Fable 5.1 相同,我们在 Fable 5.1 破坏性变更一文中有详细介绍。

④ Claude API 和 Google Cloud 上不能使用旧版计算机操作工具

Opus 5 同时接受新工具集 computer_toolset_20260801 和带 beta 请求头的旧工具 computer_20251124 进行计算机操作。Claude API 和 Google Cloud 上的 Opus 5.5 只接受工具集,声明旧工具会返回 400。消息开头如下:

'claude-opus-5-5' does not support tool types: computer_20251124.

对策:删掉 beta 请求头,把 tools 换成 [{"type": "computer_toolset_20260801"}](不需要名称和屏幕尺寸)。智能体循环也有三处要改:操作类型在块的 name 中,而不在 input.action一轮中可能包含多个操作每个结果都要连同 toolset_name 一起返回。在 Amazon Bedrock 上,Opus 5.5 仍可使用旧工具,因此无需修改。

8. 不报错却悄悄改变的地方

四处破坏性变更都会返回 400,所以你一定会发现。麻烦的是那些不报错、只有行为改变的地方。

变化 会发生什么 / 该怎么做
工具调用之间的文字进入思考块 像“接下来我检查一下 X”这样的短句,在 Opus 5 上是文本块,现在则作为进度型思考块返回。在默认显示设置(display: "omitted")下它们是空的,因此原本向用户流式显示进度的界面,在工具调用之间会变得毫无动静。把 display 设为 "updates"(beta,请求头 thinking-display-updates-2026-08-18;只返回进度,推理内容保持隐藏)或 "summarized"(推理摘要与进度混合返回),并在随后的 tool_use 之前显示非空的思考块
拒绝的类别增加 除网络安全分类器外,生物学分类器也开始运行;试图让模型把内部推理写进回复的请求,可能以 reasoning_extraction 被拒绝。拒绝会以 HTTP 200 加 stop_reason: "refusal" 返回,所以要读取 stop_details 来处理。服务端回退(fallbacks: "default",beta)不会对 reasoning_extraction 重试
图表和图示的读取更准确 即使不用工具,也能准确读取包含精细图表或依赖版式的图片。为旧模型加的提示词变通写法可能不再需要(不过对最精细的输入,加上工具仍能提高准确度)
从 Opus 4.8 迁移:没有 Priority Tier Opus 4.8 支持 Priority Tier,Opus 5.5 不支持。有合约的组织需要另行规划容量

来源:What's new in Claude Opus 5.5Migrating to Claude Opus 5.5

9. Claude Code 与 claude.ai 有哪些变化

如果你不直接调用 API,这一部分才是重点。Claude Code 在 CHANGELOG 的 v2.1.280 中加入了对 Opus 5.5 的支持。

Opus 5.5 成为新的默认模型

在 Pro、Max、Team、Enterprise 和 API 上,default 现在指 Opus 5.5。Pro 和 Team Standard 此前的默认是 Sonnet 5,对它们来说这是从 Sonnet 换成了 Opus。在 Claude API、Claude Platform on AWS、Bedrock 和 Google Cloud 上,opus 别名也指向 Opus 5.5。低于 v2.1.280 的版本无法使用,请运行 claude update

effort 从 medium 起步

Opus 5.5 从 medium 开始。在 Opus 5 时期用 /effort 保存的 effort 不会被继承(无论是按模型保存的设置,还是用户设置中旧的顶层 effortLevel,都不适用于 Opus 5.5)。在你用 /effort/model 界面重新选择之前,它都以 medium 运行。CLAUDE_CODE_EFFORT_LEVEL 环境变量,以及在项目设置或托管设置中指定的 effortLevel,则适用于所有模型。

关闭思考不起作用

Alt+T(macOS 上为 Option+T)、alwaysThinkingEnabledMAX_THINKING_TOKENS=0 对 Opus 5.5 和 Fable 都不起作用。从 v2.1.281 起,在无法关闭思考的模型上,Claude Code 不再切换开关,而是显示一行说明。

安全防护可能把你切到别的模型

分类器触发时,生物学请求会在 Opus 5 上重新运行,网络安全请求会在 Opus 4.8 上重新运行,并且会话会停留在那个模型上。用 /model 切换回来。官方文档说,渗透测试、CTF 或生物学内容较多的代码库,往往从第一个请求就会触发。

来源:Claude Code“Model configuration”与 CHANGELOG(v2.1.280 和 v2.1.281,2026 年 9 月 24 日查阅)

Claude Code 如何保存 effort,请参见 effort 设置指南;思考本身的工作原理,请参见自适应思考与扩展思考。据 Anthropic 的公告,高速模式(最高 2.5 倍速度,输入 $8 / 输出 $40)在 Claude Code 中同样可用。

claude.ai 与应用

从发布当天起,claude.ai 以及 iOS 和 Android 应用中就可以选择 Opus 5.5(Anthropic 也公开了同日日期的 Opus 5.5 系统提示词)。公告还说,伴随降价,将提高 Pro、Max、Team 和按席位计费的 Enterprise 的五小时用量上限,并给订阅用户一次可随时使用的用量上限重置。公告没有给出上限提高多少的具体数字。各方案的价格请参见 Claude 与 ChatGPT 价格对比

10. Opus 5.5、Fable 5.1、Sonnet 5、Opus 5 怎么选

官方模型总览里的指引很简短:拿不准就从 Opus 5.5 开始;需要高难度推理和长时间智能体工作,或者在 high effort 下评估过 Opus 5.5 仍不够用时,再选 Fable 5.1。再叠加价格和 API 限制,选择可以这样划分。

选 Opus 5.5
  • 想先定下一个模型(官方推荐的起点)
  • 长时间运行的智能体编程和知识工作
  • 正在用 Opus 5(每项费率都更便宜)
  • Fable 5.1 的费用压力大,想测试 Opus 5.5 是否够用
选 Fable 5.1
  • 在 high 及以上评估 Opus 5.5 后,质量仍然不够
  • 高难度推理、超长时间的智能体工作
  • 缓存用量大的工作,费率差距比输入/输出小($0.25 对 $0.20)
选 Sonnet 5
  • 需要速度或大批量处理(官方速度标注为 Fast)
  • 想关闭思考,或继续使用强制工具调用
  • 输入和输出只要 Opus 5.5 的一半(缓存读取价格相同)
  • 后继的 Sonnet 5.5 已宣布将在数周内推出
继续用 Opus 5
  • 作为修好第 7 章四处问题之前的过渡
  • 虽属 Legacy 但仍可使用,停止提供不早于 2027 年 7 月 24 日
  • 每项费率都高于 Opus 5.5,没什么理由长期停留

拿不准时,顺序很简单:① 在自己的工作上用 medium 和 high 跑 Opus 5.5 → ② 不够就试 xhigh → ③ 还不够就换 Fable 5.1 → 如果 medium 就绰绰有余,再看看 low 或 Sonnet 5 是否也够用。提高 effort 和换更高一档的模型,都是花钱买质量;哪一种性价比更高,取决于具体工作。

11. 迁移步骤(API 用户)

以下从迁移指南的检查清单中,挑出从 Opus 5 迁移时适用的项目,按实际操作顺序排列。Claude Code 还提供 /claude-api migrate 来协助迁移(迁移指南中提到的内置技能,会在修改前先与你确认范围)。

  1. 把模型 ID 从 claude-opus-5 改为 claude-opus-5-5(Bedrock 上为 anthropic.claude-opus-5-5
  2. thinking 中删除 disabledenabled(带预算),改为选择 effort
  3. 显式指定 effort(省略即为 medium;要与 Opus 5 深度相同就用 high
  4. tool_choice 中的 anytool 换成 auto 加 strict tool use,或换成结构化输出
  5. 如果在 Claude API 或 Google Cloud 上使用计算机操作,迁移到 computer_toolset_20260801 并修改循环
  6. 读取响应时按 type 筛选块;在工具循环中原样传回思考块
  7. 如果在界面中显示进度,把 display 设为 "updates""summarized"
  8. 如果在对话中途改写 systemtools 或过去的消息,改为只追加的方式
  9. 如果把请求路由到其他模型,按“Opus 5.5 的推理不会被继承”的前提进行测试
  10. 处理 stop_reason: "refusal" 并配置回退
  11. 对原本关闭思考的工作负载,重新评估 max_tokens(xhigh 和 max 从 64K 起步)
  12. 在所选 effort 下重新测量成本和延迟

来源:Anthropic“Migrating to Claude Opus 5.5”中“Every starting model”一节的项目,按操作顺序重新排列

如果直接从 Opus 4.8 或更早的版本迁移,还需要应对从未指定思考的请求现在也会运行思考这一点。建议同时查看 Opus 5 发布解析中的迁移步骤。

总结

Claude Opus 5.5 是降价与用法变化同时到来的一次发布。输入和输出费率降了 20%,缓存读取降了 60%,在 Anthropic 自己的对比表中,它在许多行上超过了 Fable 5.1。另一方面,思考不能再关闭,强制工具调用、旧版计算机操作工具和改写历史现在都会导致 400 错误。

默认 effort 降为 medium,恰恰因为不报错才容易被忽略。在 API 上要显式指定 effort;在 Claude Code 中,要确认 Opus 5 时期的设置没有悄悄失效。是否真的变便宜了,要用 usage 来测,而不是看每 token 单价。

最后,基准数值是在那张表、那些条件下测得的数值。在 AutomationBench 和 Terminal-Bench-Science 上,同一张表中 GPT-6 Astra 更高;Anthropic 自己也说与 Fable 5.1 的差距比数字显示的要小。先在自己的工作上比较 medium 和 high 吧。

常见问题

Q. Opus 5.5 比 Opus 5 便宜吗?

A. 每 token 费率每一项都更低(输入 $4、输出 $20、缓存读取 $0.20,Opus 5 分别为 $5、$25 和 $0.50)。Anthropic 称默认设置下处理典型工作便宜 40%,但这是它自己的测量结果。原本关闭思考运行的工作负载,输出 token 可能会增加,迁移后请检查 usage

Q. 有办法关闭思考吗?

A. 没有。在 API 上发送 disabled 会返回 400,Claude Code 的 Alt+T 等设置也不起作用。想减少思考量,就把 effort 设为 low。如果确实需要关闭思考,可以选择在任何 effort 下都能关闭思考的 Sonnet 5。

Q. 改了模型 ID 之后出现 400 错误。

A. 错误消息会告诉你是哪一种。"thinking.type.disabled""thinking.type.enabled" 指向思考设置,tool_choice: type "tool" and "any" 指向强制工具调用,computer_20251124 指向旧版计算机操作工具。如果都不是,而你又在对话中途改写了历史,就要怀疑是思考块的检查(第 7 章③)。

Q. 在 Claude Code 中,Opus 5 时期的 effort 设置好像没生效。

A. 这是设计如此。用 /effort 保存的 effort 按模型分别存储,无论是 Opus 5 的设置,还是用户设置中旧的顶层 effortLevel,都不适用于 Opus 5.5。Opus 5.5 从 medium 开始。用 /effort 重新选择一次,就会作为 Opus 5.5 的按模型设置保存下来。

Q. 自己做的智能体在运行时不再显示进度了。

A. 在 Opus 5.5 上,工具调用之间的文字会放在思考块里返回,而在默认显示设置下这些块是空的。把 thinking.display 设为 "updates"(beta)或 "summarized",并显示非空的思考块。

附注:本文数值依据 Anthropic 官方公告“Introducing Claude Opus 5.5”(基准数值来自该页面的对比表和图表说明)、官方文档“Models overview”“Claude Opus 5.5”“What's new in Claude Opus 5.5”“Migrating to Claude Opus 5.5”“Pricing”,以及 Claude Code 的“Model configuration”和 CHANGELOG(均于 2026 年 9 月 24 日查阅)。规格和价格可能变动,请以官方文档为准。

相关文章:Claude Opus 5 发布解析Claude Fable 5.1 破坏性变更与迁移