“我每月付 20 美元用 ChatGPT,直接调 API 会不会更便宜?”这是 AI 新手经常提出的问题。简短回答:有时是,有时正相反。分界线取决于“你每月调用 AI 多少次”以及“输入有多长”。

举个例子,每天问 10 个短问题?API 一个月只花你 1–2 美元。但每天分析一份 10 万 token 的文档?API 账单立刻飙到 每月 50–200 美元。网页对话的固定月费很稳;轻度使用时 API 便宜得多 —— 但要是搞错了这个反转关系,月底账单会让你大吃一惊。

先把我的看法摆在前面:“想把 AI 嵌入自家应用的开发者”、“想取消 ChatGPT/Claude 订阅、轻度使用 AI 的个人”以及“想对比多个模型的人” —— 这三类人明显会从 API 中获益。反过来,如果你“想在网页 UI 里保留对话”、“经常用图像生成或语音输入”,或者“讨厌看账单”,那么继续订阅网页对话才是正解。本文将从新手视角讲解网页对话与 API 的根本差异、token 与计价的原理、2026 年 9 月主要 API 的价格、模型选择方法、新手都会掉进去的三个陷阱,以及你的第一次调用。

AI API · 2026 年 9 月

网页对话的固定月费 vs API 的按量付费

—— 同样的 AI 模型,完全不同的成本结构和使用体验

网页对话
每月固定 20 美元
完整 UI,支持图像
适合“想直接用 AI”的用户
VS
API
每次调用 0.005–0.05 美元
可编程访问
适合自动化/应用集成

轻度使用(每天 10 次调用)→ API 每月 1–2 美元。
重度使用(每天 10 万 token 的输入)→ API 每月 50–200 美元;这时网页对话的固定月费反而更划算。

1. ChatGPT 每月 20 美元 —— API 可能只要 2 美元(或者相反)

来算一笔具体的账。“每天 10 个短问题。”每次调用:输入 200 token + 输出 200 token(大致相当于 130–160 个英文单词)。用 2026 年 9 月时的 Claude Sonnet 5.5(输入每百万 token 2 美元 / 输出 10 美元),一次调用花 0.0024 美元,一个月约 0.72 美元。这是 ChatGPT Plus 每月 20 美元的 1/28。

再来看反面。“每天分析一份 10 万 token 的文档。”用 Anthropic 推荐作为默认入门的 Claude Opus(截至 2026 年 9 月为 Opus 5.5,输入 4 美元 / 输出 20 美元),一次调用输入 10 万 + 输出 5K = 0.50 美元。每月 30 次 = 15 美元;100 次 = 50 美元。同一时间 OpenAI 的旗舰(GPT-6 Astra,10 美元 / 50 美元)单价是它的 2.5 倍,而且超过 27.2 万 token 后输入加价 2 倍、输出 1.5 倍,长上下文任务的花销跳得更猛。

大致分界线:“每月调用低于 200–300 次时,API 更便宜。”重度用户(每天大量调用、输入很长)通常用网页对话的固定月费反而更划算。这就是“固定月费”(网页对话)与“按量付费”(API)之间的根本张力。

2. 网页对话 vs API —— 五个具体差异

除了价格,网页对话和 API 在使用方式上也有根本差别。五个要点:

维度网页对话(claude.ai / chatgpt.com)API
调用方式浏览器内对话从代码发出 HTTP 请求
计费方式每月固定约 20 美元按所用 token 计费
界面完整功能(历史、附件、图像生成)需自行开发
会话管理自动保留历史每次请求都要自己重发历史
功能语音、图像、Memory、Canvas 等主要是文本/图像的文字指令

关键点:“API 不会记得对话历史。”在网页对话里,过去的对话会自动保留;走 API 时,每次请求都是独立的。如果你想要“记得上一轮”的效果,必须自己重发完整历史,token 消耗会迅速攀升。这是新手抱怨“API 比想象中贵”的头号原因。

另外,API 本质上是一个文本接口。网页对话的图像生成、语音输入、Code Interpreter、Canvas、Memory 等功能,在 API 上要么不存在,要么放在独立的端点。人们以为“ChatGPT 80% 的功能都在 API 里”,但很快会发现实际只有 50–60%。

3. 什么是 Token?—— 最小的计价单位

要理解 API 的计价,你必须先理解 “token”。所有厂商的价格都写成 “每 100 万(1M)token 多少美元”。

Token 基础 × 3

读懂价格表的最低门槛

① 1 个 token 有多大?
英文约 0.75 词/token;中日韩文约 1–1.5 token/字。“Hello there” 约 3 个 token。代码因为缩进和符号容易膨胀。
② 输入与输出价格不同
输出比输入贵好几倍。截至 2026 年 9 月,Claude Sonnet 5.5 是输入 2 美元 / 输出 10 美元 —— 5 倍比例。只要叮嘱一句“简短回答”,就能真金白银地省钱。
③ 系统提示也要花钱
“你是 X 领域的专家”这种前置语每次调用都会消耗 token。冗长的系统提示让账单膨胀。提示缓存可以缓解(见下文)。

发送前估算 token 数,可用 OpenAI 的 tiktoken 库或 Anthropic 的 countTokens() 同类 API。
更多内容,请参阅 什么是 AI 上下文窗口。

4. 主要 API 价格 —— Claude vs GPT vs Gemini

以下是 2026 年 9 月 25 日在各家官方价格页面(Anthropic/OpenAI/Google/DeepSeek;Anthropic 在 Sonnet 5.5 推出后于 9 月 29 日重新核对)核对过的主要模型 API 价格(输入/输出,每 100 万 token)。版本名和单价每隔几个月就会更替,使用前务必到官方页面确认。名字变了也依然有用的是读表的方法:同一家公司有几档、长输入是否加价、有没有免费额度或批处理折扣。

模型输入输出备注
Claude Fable 5.110 美元50 美元Anthropic 的最高档,面向高难度推理和长时间的智能体任务
Claude Opus 5.54 美元20 美元1M 统一价,Anthropic 推荐的默认入门模型
Claude Sonnet 5.52 美元10 美元1M 统一价,速度与智能的平衡型
Claude Haiku 4.51 美元5 美元轻量、最快,上限 200K
GPT-6 Astra10 美元50 美元OpenAI 旗舰,GPT-6 三个模型超过 272K 后均为输入 2 倍、输出 1.5 倍
GPT-6 Sol2 美元10 美元均衡档
GPT-6 Luna0.10 美元0.50 美元低成本、大批量处理档
Gemini 3.1 Pro(预览版)2 美元12 美元1M 上下文,超过 200K 为 4 美元 / 18 美元,Batch API 半价,无免费额度
Gemini 3.8 Flash0.75 美元3.75 美元2026 年 12 月 31 日前的推广价(2027 年 1 月起为 1.50 美元 / 7.50 美元),有免费额度
DeepSeek V4-Pro0.66 美元1.98 美元开放权重,这是非高峰时段价格,高峰时段翻倍

仅从这张表就能看出:输出比输入贵 3–6 倍(多数为 5 倍)。每次调用都会同时产生输入和输出,所以输出量大的任务(总结、文章生成、代码生成)更贵。输出量小的任务(分类、短答)在 API 上跑起来非常便宜。

同样重要的还有“折扣机制”:

  • 提示缓存(Anthropic / OpenAI):重复使用同一个系统提示时,从缓存读取的部分按输入单价的 10% 或更低计费(截至 2026 年 9 月:Anthropic 默认 10%、Opus 5.5 为 5%;OpenAI 的 GPT-6 系列为 10%)
  • Batch API(Anthropic / OpenAI / Google):24 小时内处理的异步批次,5 折
  • 缓存写入费:写入缓存要加价(Anthropic 的 5 分钟缓存为 1.25 倍;OpenAI 的 GPT-6 系列也是 1.25 倍)。读取非常便宜,同一个前缀用两次就能回本

忽略这些机制,本可以付 1/3 到 1/5 价格的事情就只能按全价付。详见 AI token 与会话省钱方法。

5. 模型选择 —— 四类用途地图

“该选哪个模型?”是新手最大的疑问。不过把具体型号背下来,半年就对不上了。各厂商推出的阵容结构其实相似——最上位、主力、轻量、开放权重——所以按四个层级来把握,先确定自己处在哪一层会更快。名字会换,层级不换。

4 种用途 × 推荐模型

按用途的选择地图

① 高端/复杂任务
→ 各厂商的最上位模型
复杂推理、代码评审、长文档分析。质量优先。输出单价大致是主力层的 2~5 倍。同为最上位,也会分成“擅长语感细节”和“擅长严密逻辑”两类,拿自己的代表性任务在两家各跑一遍最稳妥。
② 性价比最佳 —— 主力
→ 各厂商的中位(均衡)模型
日常“主力”。先把它设为默认,不够用时再往 ① 提是通行做法。选的时候不只看单价,还要看长输入是否全区间统一计费、有没有批处理折扣。
③ 大量/轻量任务
→ 各厂商的轻量高速模型
分类、抽取、简单问答、摘要。输入单价能降到主力层的二分之一到二十分之一。仅仅把幕后的常规处理挪到这一层,账单就会明显改观。要给人看的输出,交给 ② 及以上。
④ 开放权重/本地部署
→ 开放权重的模型
走 API 单价极低,用自己的 GPU 跑则推理成本为零。目标是保密性/成本压缩。质量与 ② 持平或略低。选之前务必读许可证的商用条款——名为“开放”却带限制的并不少见。

实务中的通行做法:用 ②(主力)+ ③(大量处理)两个层级来运转。
复杂任务升级到 ①,机密数据走 ④。仅此一项就能在实战中让月度成本减半。

6. 每个新手都会掉进的三个计价陷阱

开始用 API 的头 3 个月里,几乎所有人都会撞上以下三个计价陷阱之一。逐个来看。

陷阱 ①:每次都重发整个对话历史

API 不会记住任何东西。为了营造“像聊天一样”的体验,你必须每次调用都重发完整的对话。放任不管的话,到第 10 轮时单次调用就要发超过 1 万个输入 token。解决办法:重发前先对旧对话做摘要,或者把话题切换当作新会话开启。

陷阱 ②:系统提示越写越长

“你是 X 领域的专家。”“请遵守下面 20 条规则。”“输出格式必须是……” —— 写一长串前置语是典型的新手做法。2000 token 的系统提示每天调用 100 次,单这一项每月就要花 30 美元。启用提示缓存,第二次以后的调用价格直降 90%。在代码里通常只是给某一块加上 cache_control: { type: "ephemeral" } 而已。

陷阱 ③:忘了设置费率/消费上限

新手最可怕的结局是:“代码有个 Bug 进入死循环,月底账单 500 美元。”预防方法是给每个 API key 设置消费上限(hard cap)。Anthropic Console 和 OpenAI Platform 都支持封顶月度消费;创建 key 时就设好。新手安全档位是 20–50 美元。

最重要的一点:千万不要把 API key 提交到 GitHub 或任何公开位置。泄漏的 key 会在几秒内被机器人扫到,几小时内就能产生数百美元的未授权调用。把 key 放在环境变量(.env)里并加进 .gitignore,或者使用 Secret Manager。

7. 你的第一次 API 调用 —— 5 分钟搞定 curl 与 Python

理论先放一边,下面是给 Anthropic Claude API 发送 “Hello” 的最小代码。

准备工作(3 步)

  1. 在 Anthropic Console 注册账号(或者用 OpenAI 的话去 platform.openai.com)
  2. 申请 API key(左侧菜单 “API Keys” → “Create Key”)。只显示一次 —— 立刻保存
  3. 在 Settings 里把 Spending Limit 设到 20 美元左右(新手必做)

最小 curl 调用

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 100,
    "messages": [
      {"role": "user", "content": "Hello from the AI API world"}
    ]
  }'

model 里填你要用的模型 ID。本例用的是 2026 年 9 月时 Claude Sonnet 5.5 的 ID(claude-sonnet-5-5)。出了新模型时,到 Anthropic 的模型总览确认 ID,只改这一行即可。OpenAI 和 Google 的 API 也同样用 ID 指定模型。

会返回 JSON。AI 的回答在 content[0].text;消耗的 token 在 usage.input_tokens 和 usage.output_tokens 里。“这次实际用了多少 token?” —— 响应每次都会告诉你。

Python(推荐)

pip install anthropic
import os
from anthropic import Anthropic

client = Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])

response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=100,
    messages=[
        {"role": "user", "content": "Hello from the AI API world"}
    ]
)

print(response.content[0].text)
print(f"Used: input {response.usage.input_tokens} / output {response.usage.output_tokens}")

这段最小代码跑通之后,你就已经完成了一半。剩下的是对话历史管理、工具调用(function calling)和流式输出 —— 按顺序学下来,你就能搭出大多数 AI 应用了。另请参阅 新手能用 AI 做出应用吗?。

总结

回顾要点:

  • 网页对话是固定月费,API 是按量付费。轻度使用(约每天 10 次)API 每月 1–2 美元;重度使用可能飙到每月 50–200 美元
  • 五个差异:调用方式/计费/界面/会话/功能。API 不记忆历史,需要自己重发
  • Token 是计价单位。英文约 0.75 词/token;输出比输入贵好几倍
  • 截至 2026 年 9 月的主要价格(输入/输出,每 100 万 token):Claude Opus 5.5 为 4/20 美元、Sonnet 5.5 为 2/10 美元;GPT-6 Astra 为 10/50 美元、GPT-6 Sol 为 2/10 美元;Gemini 3.1 Pro 为 2/12 美元(名称和单价会更替,选择时按四种类型来想)
  • 用四类模型地图(高端/主力/轻量/开放)。② 主力 + ③ 轻量搭配是实战答案
  • 三个计价陷阱:历史堆积/系统提示过长/没设消费上限。第一天就设好上限可以避开绝大多数
  • 第一次调用:用 curl 或 Python,5 分钟就够。不要把 key 提交到 GitHub,先设消费上限 —— 就这些

网页对话订阅很方便,但当你想“把 AI 嵌入到自己的工具、自动化或工作流里”的那一刻,API 就成了真正的选项。一开始会觉得有门槛,不过先设一个低消费上限、跑上一两次,亲自感受每次调用约 0.01 美元,等到月底账单只有 1.50 美元时,你就悄悄地越过了从“使用 AI”到“用 AI 构建”的那条线。

常见问题

Q1. 该退订 ChatGPT Plus 改用 API 吗?

看使用情况。如果你每月调用 AI 约 200 次、几乎不用图像生成或语音,API 更便宜(每月 2–5 美元)。如果你每天用 10 次以上,或者依赖图像生成/Memory,那继续保留 Plus 更舒服。并行跑一个月,对比账单 —— 这是最稳妥的答案。

Q2. 不绑信用卡能试用吗?

OpenAI 没有免费额度计划;Anthropic 注册时偶尔给约 5 美元的试用额度。Google AI Studio(Gemini)有真正的 Free Tier,可以在配额内免费试用 Flash 系列等部分模型(截至 2026 年 9 月,Gemini 3.8 Flash 有免费额度,最高档的 3.1 Pro 没有)。“只想免费摸一下 API” → 从 Gemini AI Studio 开始。

Q3. 不懂编程也能用 API 吗?

需要基础的代码复制与执行能力。但因为一行 curl 或五行 Python 就能跑起来,“复制粘贴运行”的门槛很低。在 2026 年,让 Claude / ChatGPT 自己写一句“请用 Python 写 Anthropic API 的第一次调用,加上注释”,几乎都能直接拿到可运行代码。

Q4. API 速度慢吗?

同样的模型,速度和网页对话差不多。打开流式输出后,响应就像网页对话里那种打字机效果。规模上来后可能撞到速率限制,不过限制会根据使用历史按层级提升(OpenAI 和 Anthropic 都有 Tier 计划)。

Q5. 该从哪个模型开始?

先从某一家的中档(均衡)模型开始。截至 2026 年 9 月,就是 Claude Sonnet 5.5 或 GPT-6 Sol(都是输入 2 美元 / 输出 10 美元)。如果只想免费试试,也可以从有免费额度的 Gemini Flash 系列入手。另外,Anthropic 官方文档建议拿不准时先用更高档的 Opus,所以如果质量比价格更重要,就选它。最高档(Claude 的 Fable 和 Opus、GPT-6 Astra)质量顶尖但更贵;轻量模型(Haiku / Luna / Flash-Lite)对初学者来说有时回答简短得让人摸不着头脑。先定一个主力模型,其他按需再加——这是标准做法。