使用Claude时,你首先面临的问题就是:"该用Opus、Sonnet还是Haiku?"
三款模型的API价格最高相差5倍,性能也有明显差异。但最贵的模型并不总是最佳选择。某些任务用Haiku更划算,而有些任务确实需要Opus才能胜任。
本文将对比2026年6月最新的价格、性能和速度,并提供各场景的成本估算,帮你做出正确选择。
1. 三款模型概览
Claude三款模型:定位与特性
高性能,高成本 ← → 快速低成本
每百万Token价格(输入 / 输出)
| 模型 | 定位 | 发布时间 | 一句话概括 |
|---|---|---|---|
| Opus 4.8 | 旗舰 | 2026年2月 | 最智能,适合智能体和复杂编程 |
| Sonnet 4.6 | 均衡型 | 2026年2月 | 速度与智能的最佳平衡,适合日常使用 |
| Haiku 4.5 | 快速低成本 | 2025年10月 | 速度最快,适合大批量和实时任务 |
名称源自文学体裁的长度。Opus(大型乐曲)代表最深入的思考,Sonnet(十四行诗)提供适度的深度,Haiku(俳句)则是快速简洁的回复。
2. API价格对比
价格可能调整。最新准确数值请务必以Anthropic 官方价格页为准(本文为 2026 年 6 月时点)。
API价格对比(每百万Token)
标准价格(每百万Token)
| 模型 | 输入 | 输出 | 批量输入 | 批量输出 | 缓存命中 |
|---|---|---|---|---|---|
| Opus 4.8 | $5 | $25 | $2.50 | $12.50 | $0.50 |
| Sonnet 4.6 | $3 | $15 | $1.50 | $7.50 | $0.30 |
| Haiku 4.5 | $1 | $5 | $0.50 | $2.50 | $0.10 |
最贵的Opus输出($25/MTok)与最便宜的Haiku输出($5/MTok)相差5倍。不过,Opus 4.8实际上比前代便宜了3倍(Opus 4.1的输出价格为$75/MTok)。
降本技巧
批量API可将成本减半,缓存命中可将输入成本降至十分之一。两者结合最多可节省95%的成本。如果需要大批量处理,建议优先考虑这两种方式。
什么是"Token"?
API按"Token"计费。中文大约1个字 = 1~2个Token,英文约1个单词 = 1.3个Token。一百万Token约为50万~100万个中文字,相当于3~5本普通书籍。
3. 订阅方案
相比API按量付费,月度订阅的价格结构完全不同。
| 方案 | 月费 | 可用模型 | 默认模型 |
|---|---|---|---|
| Free | $0 | 仅Sonnet 4.5 | Sonnet 4.5 |
| Pro | $20 | 全部模型 | Sonnet 4.6 |
| Max 5x | $100 | 全部模型 | Opus 4.8 |
| Max 20x | $200 | 全部模型 | Opus 4.8 |
订阅不是"无限使用",而是有用量上限。但即便如此,它比API定价便宜得多。有用户报告称8个月内消耗了100亿Token——按API价格需要$15,000以上,而Max订阅只花了约$800(相差约19倍)。
在Claude Code中切换模型
在Claude Code中,可以在启动时使用 claude --model opus 或 claude --model sonnet,也可以在会话中使用 /model sonnet 来切换模型。Pro方案默认使用Sonnet,Max方案默认使用Opus。关于Claude Code的详细介绍,请参阅Claude Chat、Cowork与Code的区别。
4. 性能基准对比
| 基准测试 | 测评内容 | Opus 4.8 | Sonnet 4.6 | 差距 |
|---|---|---|---|---|
| SWE-bench Verified | 编程能力 | 88.6% | 79.6% | +9.0分 |
| GPQA Diamond | 科学推理 | 93.6% | 74.1% | +19.5分 |
当前的旗舰机型 Opus 4.8 在各项指标上全面领先 Sonnet 4.6:编程(SWE-bench Verified)约领先 9 分,研究生级科学推理(GPQA Diamond)约领先 19 分。对于最高难度的推理和自主编程任务,Opus 无疑是首选。
话虽如此,Sonnet 4.6 在日常编程上的表现已极为接近,而价格却只是其零头,因此对于绝大多数生产环境流量来说,它才是更合适的默认选择。Opus 4.8 完整的基准测试解读,请参阅 Opus 4.8 发布深度解析。
Haiku 4.5 的官方基准数据有限,但 Anthropic 将其定位为具有"接近前沿的智能"。在简单任务上,它能以最低成本接近 Sonnet 级别的准确度。
5. 速度与上下文窗口
| 模型 | 速度(约) | 上下文窗口 | 最大输出 |
|---|---|---|---|
| Opus 4.8 | 约20~30 tok/秒 | 100万Token | 128K Token |
| Sonnet 4.6 | 约40~60 tok/秒 | 100万Token | 64K Token |
| Haiku 4.5 | Sonnet的2~5倍 | 20万Token | 64K Token |
Haiku的最大优势是速度。它的首个Token响应时间(TTFT)最短,非常适合实时聊天机器人和自动补全功能。
Opus拥有100万Token的上下文窗口(约相当于10~20本书),可以一次性处理整个代码库。其128K Token的最大输出是Sonnet/Haiku的两倍,适合一次性生成长文档。
6. 各场景成本估算
以下是使用API标准价格(不含缓存和批量折扣)的典型任务成本估算。
场景一:生成一篇2000字的文章
输入:约1,000 Token,输出:约4,000 Token
| 模型 | 输入成本 | 输出成本 | 合计 |
|---|---|---|---|
| Opus 4.8 | $0.005 | $0.100 | 约$0.11 |
| Sonnet 4.6 | $0.003 | $0.060 | 约$0.06 |
| Haiku 4.5 | $0.001 | $0.020 | 约$0.02 |
场景二:读取代码文件并重构
输入:约10,000 Token(代码 + 指令),输出:约5,000 Token
| 模型 | 输入成本 | 输出成本 | 合计 |
|---|---|---|---|
| Opus 4.8 | $0.05 | $0.125 | 约$0.18 |
| Sonnet 4.6 | $0.03 | $0.075 | 约$0.11 |
| Haiku 4.5 | $0.01 | $0.025 | 约$0.04 |
场景三:聊天机器人每天处理1,000次查询
每次查询输入200 Token + 输出300 Token x 1,000次
| 模型 | 日成本 | 月成本(30天) |
|---|---|---|
| Opus 4.8 | $8.50 | $255 |
| Sonnet 4.6 | $5.10 | $153 |
| Haiku 4.5 | $1.70 | $51 |
对于聊天机器人等大批量场景,Haiku和Opus的月成本差距超过$200。务实的做法是将Haiku设为默认模型,仅在遇到复杂查询时路由到Sonnet或Opus。
7. 如何选择模型
模型选择流程图
| 使用场景 | 推荐模型 | 原因 |
|---|---|---|
| 日常编程与写作 | Sonnet 4.6 | 达到Opus 98%的编程质量,成本降低40%,速度提升2倍 |
| 大规模重构 | Opus 4.8 | 100万上下文窗口和128K输出的优势尽显 |
| 学术分析 | Opus 4.8 | GPQA差距17分,深度推理无可替代 |
| 聊天机器人与客服 | Haiku 4.5 | 速度最快 + 成本最低,完美适配标准回复 |
| 批量处理 | Haiku 4.5 | 成本仅为五分之一,轻松应对大批量任务 |
| Claude Code开发 | Sonnet 4.6 | Pro方案即可满足需求,仅在复杂架构设计时切换到Opus |
实用建议
拿不定主意时,先从Sonnet开始。它能胜任大多数任务。只有当Sonnet的输出质量不能满足需求时再升级到Opus,而对于简单的重复性任务则降级到Haiku。这种分级策略能让你获得最佳的性价比。
常见问题
Opus和Sonnet的编程性能差距有多大?
在SWE-bench Verified(编程基准测试)中,Opus 4.8得分80.8%,Sonnet 4.6得分79.6%,差距仅为1.2分。日常编程中几乎感觉不到差异。考虑到成本差异(输出价格Opus $25 vs Sonnet $15/MTok),Sonnet的性价比更高。不过,在大规模架构设计和复杂推理任务中,Opus仍具优势。
订阅和API按量付费哪个更划算?
如果经常使用,订阅方案要划算得多——比API定价便宜得多。即使是Pro方案($20/月),按API定价使用同等量需要每月$180以上,约合9倍;而上文的Max案例更是约19倍。API定价仅在使用频率极低或特定批量处理场景下才有优势。ChatGPT的价格对比请参阅Claude与ChatGPT价格对比。
Haiku 4.5有多"聪明"?
Anthropic将其描述为具有"接近前沿的智能"。虽然官方基准数据有限,但在内容分类、摘要和问答等标准任务上,预计可接近Sonnet级别的准确度。在复杂推理或长代码生成方面,与Sonnet/Opus的差距会显现出来。考虑到仅五分之一的成本,它在"以足够的质量大规模处理"的场景中表现最为出色。
Opus 4.8比之前的Opus便宜了吗?
是的,便宜了很多。Opus 4.1的输出价格为$75/MTok,而Opus 4.8降至$25/MTok——降价三分之二,性能还有提升。上下文窗口也从200K扩展到100万Token(增加5倍),性价比大幅提升。