Claude Fable 5Claude Opus 5 都是 Anthropic 的顶级模型,但答案既不是「永远用 Fable 5」,也不是「永远用 Opus 5」。正确的做法是按任务来选。Fable 5 确实是旗舰,但它的价格是 Opus 5 的两倍,额度也消耗得更快。

而且,2026 年 7 月 24 日 Opus 5 的登场,把这个答案往前推了一大步。上一代的 Opus 4.8 处在「比 Fable 5 差一档,但便宜一半」的位置;Opus 5 在维持同样的 $5 / $25 价格的同时,在智能体类基准测试上已经追平甚至反超 Fable 5。说得直白一点,为 Fable 5 多付一倍钱的理由变少了。本文把两者在能力、价格、功能上并排对比,再用一套决策流程回答真正重要的问题:Fable 5 的溢价,如今还值在哪里?

30 秒看结论

如果只看一段,就看这里

日常工作与智能体
Opus 5(价格只要一半,长时间自主运行还更强)
最高难度推理、长时间调研
Fable 5(在 Opus 5 触顶的地方依然领先)
最实用的搭配
默认用 Opus 5,卡住了再上 Fable 5

1. 规格对比(能力、价格、功能)

先看整体轮廓。上下文窗口(100 万 token)和最大输出(128K)完全相同,差别出现在各自擅长什么、要花多少钱、能用哪些功能上。

项目Claude Fable 5Claude Opus 5
定位旗舰(最高难度推理)新一代主力,智能体领域顶尖
API 价格(每百万 token)输入 $10 / 输出 $50输入 $5 / 输出 $25(一半)
上下文窗口1M1M(默认即上限)
最大输出128K128K(相同)
知识截止2026 年 1 月2026 年 5 月
思考始终开启(无法关闭)默认开启(只有 effort 为 high 及以下才能关闭)
快速模式(约 2.5 倍速)不支持支持(价格 2 倍,仅限 Claude API)
额度消耗快(单价高)较慢(单价只有一半)
擅长领域最高难度推理、长时间自主调研智能体、计算机操作、业务自动化、日常工作

价格与规格引自 Anthropic 的公告与官方文档(截至 2026 年 7 月)。数值可能变动,正式采用前请先确认官方价格页

基准测试上的实际差距

这正是相比 Opus 4.8 时代变化最大的地方。当时的结论是「Fable 5 明显更强,Opus 是便宜一半的折中方案」。到了 Opus 5,好几项结果已经反转。

基准测试 Claude Opus 5 Claude Fable 5
Frontier-Bench v0.1
智能体终端作业
43.3%🟡 33.7%🟡
OSWorld 2.0
计算机操作智能体
70.6%🟡 66.1%🟡
CursorBench 3.2
编码
Anthropic 表示,在最高 effort 下其成绩与 Fable 5 的最佳分数相差不到 0.5%,而成本约为一半
DeepSWE v1.1
智能体编码
68.8%🟡 69.7%🟡
Humanity's Last Exam
最高难度知识与推理
56.3%🟡 56.5%🟡

🟡 表示来自媒体报道的数字the decodertech-ish,均为 2026 年 7 月 24 日),Anthropic 官方页面并未以数值形式写出这些成绩。CursorBench 的说法则见于官方正文。完整拆解请看我们的 Opus 5 发布解读

由此浮现出的图景是:一、任务自主运行的时间越长,Opus 5 越占优(终端作业、计算机操作)。二、单轮最高难度推理仍偏向 Fable 5,但差距极小——HLE 基本打平,DeepSWE 只差一分左右。三、Opus 5 的价格只有一半。两个模型都可以通过 effort 设置在五个档位之间权衡深度与成本。

2. 价格差 2 倍到底意味着什么

Fable 5 的价格正好是 Opus 5 的两倍(输入 $10 对 $5,输出 $50 对 $25),做同样的事还会更快耗掉订阅额度。在 Opus 4.8 的年代,这是一笔直白的交易:多付一倍,换来明显更强的能力。而现在,你可能多付了一倍,某些基准测试的分数反而更低

同样的输出量

Fable 5 要花 2 倍的钱

举例:输出 10 万 token,Opus 5 是 $2.50,Fable 5 是 $5.00。每天跑得越多,差距滚得越大。

而且还不止于此

单任务成本把差距进一步拉大

在计算机操作基准测试上,Anthropic 表示 Opus 5 以约三分之一的成本超过了 Fable 5 的最佳分数。省下来的不只是单价,还有那些白跑的步骤。

关于价格与订阅方案的全景,可以看我们的 Claude 价格对比AI 编码成本优化

3. 到底选哪个?——决策流程

按下面的顺序走一遍,基本不会选错。

先试 Opus 5

日常编码、摘要与分析,长时间运行的智能体也一样。价格只有一半,而且在大多数自主作业上更强。

卡住时再换 Fable 5

Opus 5 触顶的最高难度推理,以及长时间自主调研任务。这块地盘依然属于 Fable 5。

要快?用 Opus 5 快速模式

速度约 2.5 倍,但价格翻倍,且仅限 Claude API(Bedrock 等平台不支持)——此时单价就和 Fable 5 一样了。

预算吃紧就调低 effort

两个模型在较低的 effort 下都更省钱,而且 Anthropic 也不建议一直锁在最高档。这是最该优先调的旋钮。

经验法则:「先用 Opus 5,只有明显不够用时才切到 Fable 5。」不要一上来就用旗舰。这条原则从 Opus 4.8 时代起就没变——只是「Opus 就够用」的范围明显变大了

4. 两个都用才是正解——以 Opus 5 为主力,难点交给 Fable 5

实践中效果最好的是两个一起用把 Opus 5 设为默认,只把难点交给 Fable 5。这样既压住了整体成本,又能在关键处用上旗舰级的智能。

此外,2026 年 7 月重新上线的 Fable 5请求被安全分类器拦截时可以自动改用 Opus 系列模型(应用内的「switch model」开关;重新上线的公告中指定的目标是 Opus 4.8)。保持开启,被拦截的请求就不会让对话卡死。在 API 一侧,Opus 5 这一代还新增了用于回退的「default」模式(测试版),会自动套用 Anthropic 推荐的路由策略。

💡 实现建议:如果你在用 API 做开发,默认走 Opus 5,只在任务被判定为高难度时才路由到 Fable 5。不把自己绑死在单一模型上,对成本和可用性都有好处。另外要注意,Opus 5 的思考是默认开启的,若原封不动沿用 Opus 4.8 时代的参数,max_tokens 留得太紧会导致回答被截断(参见迁移注意事项)。

5. 注意事项——可用性与依赖风险

别忘了可用性这一环。Fable 5 曾在 2026 年 6 月因监管而全面暂停,并于 7 月重新上线。旗舰模型可能因监管或安全原因突然变更状态,而且经由各云平台(AWS、Google Cloud、Microsoft Foundry)的恢复也是分阶段进行的。不依赖单一模型的设计才是你的保险——参见 AI 依赖风险与业务连续性

反过来说,把 Opus 5 作为基础来搭建,不只是在能力和成本上合理,在连续性上同样合理。上一代的 Opus 4.8 也仍然可用,所以你现在的回退选项是变多了,而不是变少了

总结

  • 谁赢在哪:长时间自主智能体作业归 Opus 5(Frontier-Bench 43.3% vs 33.7%🟡,OSWorld 2.0 70.6% vs 66.1%🟡)。单轮最高难度推理仍偏向 Fable 5(HLE 56.5% vs 56.3%🟡)。
  • 价格:Fable 5 是 Opus 5 的 2 倍($10/$50 对 $5/$25),额度也消耗得更快。
  • 规格:同为 1M 上下文窗口与 128K 最大输出。快速模式只有 Opus 5 提供(价格 2 倍,仅限 API)。Opus 5 的知识截止更新(2026 年 5 月)。
  • 怎么选默认用 Opus 5,只在最高难度的活儿上升级到 Fable 5。「Opus 就够用」的范围,明显比 4.8 时代更宽了。
  • 可用性:Fable 5 曾因监管被下架。不要把系统押在单一模型上。

常见问题

Q. 我该把哪个设为默认?

对大多数个人和团队来说,默认用 Opus 5。它便宜一半,而且在多项智能体基准测试上胜过 Fable 5。只有当 Opus 5 明显不够用时才切到 Fable 5,这才是性价比最高的用法。

Q. 价格翻倍的 Fable 5,是不是「聪明一倍」?

这比以前更难说得通了。在 Opus 4.8 时代,多付一倍确实换来了明显的提升。但面对 Opus 5,它在编码上几乎打平(CursorBench 差距不到 0.5%),在智能体作业上还落后。溢价能回本的范围变窄了:只剩下 Opus 5 触顶的最高难度推理和长时间调研任务。

Q. 我要速度。Fable 5 和 Opus 5 哪个更快?

开启快速模式的 Opus 5(约 2.5 倍)是最快的选择。代价是价格翻倍,而且仅限 Claude API(Amazon Bedrock、Google Cloud、Microsoft Foundry 上都用不了)。另外要注意,开了快速模式之后,单价就和 Fable 5 持平了。

Q. 怎样才能既省钱又把活干好?

(1)默认用 Opus 5;(2)把 effort 调到与任务匹配的档位;(3)只在难点上升级到 Fable 5;(4)打开安全拦截时的自动切换。另外,Opus 5 把可缓存提示词的最小长度降到了 512 token,较短的提示词现在也能吃到提示词缓存的红利。

Q. 如果 Fable 5 又被暂停了怎么办?

既然它曾因监管被暂停过,在生产环境中最稳妥的做法是准备一条可以自动切换到替代模型(Opus 5 或 Opus 4.8)的回退路径。不依赖单一模型的设计,才扛得住突发的服务中断。

相关阅读:Claude Opus 5 发布解读