一、Token 词元:AI 计费的核心单位
1.1 什么是 Token?
Token(词元)是大语言模型(LLM)处理和生成文本的最小计算单元。当你向 AI 发送消息时,模型先将文本切分成若干\”Token\”再进行运算。Token 既是模型理解输入的基础,也是厂商计费的核心依据。
直观感受:
- 英文:1 个单词 ≈ 1.3 个 Token(\”hello\”= 1 Token,\”ChatGPT\”= 2 Tokens)
- 中文:1 个汉字 ≈ 1.5~2 个 Token(\”你好\”≈ 3 Tokens)
- 代码:缩进、括号、关键字各自计 Token,1 行代码通常 8~20 Tokens
- 空格、标点:也消耗 Token,不可忽视
1.2 Token 与上下文窗口(Context Window)
上下文窗口是模型在单次对话中能\”看到\”的最大 Token 数量。超出窗口的内容会被截断或遗忘。
|
模型 |
上下文窗口 |
约合汉字数 |
典型场景 |
|
GPT-5.5 / GPT-5.4 |
1M Tokens |
约 50 万字 |
长文档分析、多轮对话 |
|
GPT-5 Pro($200 档) |
1M Tokens |
约 50 万字 |
超长代码库、全书分析 |
|
Claude Sonnet 4.6 |
1M Tokens |
约 50 万字 |
大型代码工程、长报告 |
|
Claude Opus 4.7 |
1M Tokens |
约 50 万字 |
复杂推理、Agent 工作流 |
|
Gemini 3.1 Pro |
2M Tokens |
约 100 万字 |
超长上下文,行业第一 |
|
DeepSeek V4 Pro |
1M Tokens |
约 50 万字 |
代码、长文档推理 |
|
Kimi K2.6 |
1M Tokens |
约 50 万字 |
长文本、Agent 场景 |
|
通义千问 Qwen3.5 |
1M Tokens |
约 50 万字 |
代码、多模态理解 |
1.3 输入 Token vs 输出 Token
几乎所有平台将 Token 分\”输入(Input)\”和\”输出(Output)\”分别计费,输出通常比输入贵 3~10 倍。
💡 关键认知: 输出 Token 价格通常是输入的 3~5 倍。Agent 场景下模型大量生成中间步骤文本,导致输出 Token 急速膨胀。选型时要重点关注输出价格,而非只看输入价格。
1.4 Token 计费的三大陷阱
⚠️ 注意: Agent 场景中,完成一次\”重构整个代码库\”的任务可能消耗 5,000 万~2 亿 Tokens,按 API 计费可能高达数百美元。这正是 Coding Plan 和 Token Plan 固定套餐兴起的核心原因。
二、 三种计费模式全解析
2.1 API Token 按量计费
最原始也最灵活的方式:消耗多少 Token 支付多少费用。适合用量不稳定、想精确控制成本的开发者或企业。
- 优点:按需付费,无月费浪费;最新模型第一时间可用
- 缺点:账单不可预测,Agent 场景可能月底\”爆单\”;需自行监控用量
2.2 Coding Plan(编程订阅套餐)
以固定月费换取在指定编程工具(如 Claude Code、Cursor、Cline、OpenClaw 等)中使用 AI 的请求次数额度。核心逻辑是\”用订阅价对冲 Token 账单焦虑\”。
- 优点:月费固定、心理安全感强;兼容多种主流编程工具;通常包含多模型访问权限
- 缺点:有时间窗口限制(如每 5 小时刷新);重度用户可能遭遇限速;模型版本非最新
2.3 Token Plan(Token 包月订阅)
以固定月费预购 Credits/Tokens 额度包,比按量付费享受折扣(通常 6~8 折)。适合用量稳定、想节省成本的开发者或团队。
- 优点:比按量付费便宜;一个 API Key 可调用多模型;预算可控
- 缺点:额度用完需续费或转按量计费;Credits 换算比率可能不透明
2.4 Agent Plan(智能体订阅套餐)
面向 AI Agent 工作流、自动化任务的专项套餐。按\”Agent Flow Point(AFP)\”或\”任务次数\”计费,为多步骤自主 Agent 场景优化。
- 优点:为 Agent 场景优化,包含工具调用配额;适合构建自动化产品
- 缺点:价格高;子 Agent 调用导致额度消耗更快;定价模型复杂
|
维度 |
API 按量计费 |
Coding Plan |
Token Plan |
Agent Plan |
|
计费方式 |
按每百万 Token |
固定月费/次数 |
固定月费/Credits |
固定月费/AFP |
|
可预测性 |
低(波动大) |
高 |
中高 |
中 |
|
适合用量 |
低或极高均可 |
中度稳定编程 |
中高频调用 |
高频 Agent 场景 |
|
模型选择 |
最丰富 |
限定模型 |
限定模型 |
限定且复杂 |
|
成本风险 |
账单爆炸 |
资源浪费 |
Credits 耗尽 |
额度耗尽 |
|
适合人群 |
企业开发者 |
个人开发者 |
中小团队 |
AI 产品团队 |
三、海外主流平台详解
备注:「数据更新:2026-05-24 | 以各平台官网实时价格为准」
3.1 Anthropic Claude
官网: https://claude.ai

定价页: https://claude.com/pricing

API 控制台: https://console.anthropic.com

订阅套餐
|
套餐 |
月费(美元) |
核心权限 |
Claude Code 支持 |
|
Free |
$0 |
基础功能,有日限额 |
❌ 不支持 |
|
Pro |
$20 |
标准额度,所有模型 |
✅ 支持 |
|
Max 5x |
$100 |
Pro 5 倍额度 |
✅ 支持 |
|
Max 20x |
$200 |
Pro 20 倍额度,适合重度 Agent |
✅ 支持 |
|
Team |
$30/用户 |
协作管理,最低 5 用户 |
✅ 支持 |
|
Enterprise |
定制 |
SSO、合规、无限上下文 |
✅ 支持 |
API Token 定价(2026 年 5 月)
|
模型 |
输入 / 百万 Token |
输出 / 百万 Token |
上下文 |
定位 |
|
Claude Opus 4.7 |
$5.00 |
$25.00 |
1M |
最强推理,旗舰 Agent |
|
Claude Sonnet 4.6 |
$3.00 |
$15.00 |
1M |
性能价格最均衡(推荐) |
|
Claude Haiku 4.5 |
$1.00 |
$5.00 |
200K |
速度快、成本低,高频调用 |
Claude Code 定价与实测
Claude Code 是 Anthropic 推出的终端内 AI 编程 Agent,订阅 Pro 及以上套餐即可使用,用量从对话额度中扣除,与 Claude.ai 网页对话共享配额。 • Pro($20/月):约 45 条消息 / 5 小时窗口;重度使用通常 1~2 小时耗尽 • Max 20x($200/月):约 20× Pro 额度;重度用户(月均 7,000 万+ Token)时比 API 显著划算
📊 实测数据 Anthropic 官方数据(2026年3月):Claude Code 平均开发者日消耗约 $6,90% 用户低于 $12/天。极端案例:8 个月日常使用消耗约 100 亿 Token,API 计费超 $15,000,Max 套餐仅需约 $1,600。
Anthropic Managed Agents(托管 Agent)
Anthropic 推出 Managed Agents(托管智能体)计划,允许企业以 API 方式调用多步骤 Agent,工具调用额外收费: • Web Search:每次 $0.002~$0.01 • 代码执行:按计算时长计费 • Extended Thinking Token:按输出 Token 价计(即使用户不可见)
3.2 OpenAI(ChatGPT / Codex)
官网: https://chatgpt.com/

定价页: https://chatgpt.com/zh-Hans-CN/pricing/

API 定价: https://openai.com/zh-Hans-CN/api/pricing/

消费者订阅套餐(2026 年 5 月)
|
套餐 |
月费(美元) |
核心功能 |
备注 |
|
Free |
$0(含广告) |
GPT-5.3 Instant,基础对话 |
国内无法直接使用 |
|
Go |
$8 |
GPT-5.4,有广告 |
全球 98 国可用(2026/01 起) |
|
Plus |
$20 |
GPT-5.5,Deep Research 10 次/月,Codex |
性价比之选 |
|
Pro $100 |
$100 |
5× Plus 额度,Deep Research 500 次/月 |
2026/04/09 新推出 |
|
Pro $200 |
$200 |
20× Plus 额度,1M 上下文,Sora |
重度用户旗舰档 |
|
Business |
$25/用户 |
团队协作,数据不用于训练 |
原 $30,2026/04 降价 |
|
Enterprise |
定制 |
SSO、合规、私有部署 |
大企业专属 |
OpenAI API Token 定价(2026 年 5 月)
|
模型 |
输入 / 百万 Token |
输出 / 百万 Token |
适用场景 |
|
GPT-5.5 |
$5.00 |
$30.00 |
最新旗舰,Plus 及以上默认 |
|
GPT-5.4 Thinking |
$3.00 |
$15.00 |
复杂推理、代码架构 |
|
GPT-5.1-chat |
$1.25 |
$10.00 |
通用对话,性价比均衡 |
|
o4-mini |
$1.10 |
$4.40 |
轻量推理,快速低价 |
|
GPT-4.1 nano |
$0.10 |
$0.40 |
超高频调用,分类/摘要 |
📌 Codex Mobile ChatGPT Codex 编程 Agent 2026/05/14 起推出移动端预览,所有套餐免费使用,可在 iOS/Android 远程监控和干预正在运行的 Codex 任务。
3.3 Google Gemini
官网: https://gemini.google.com

API 定价: https://ai.google.dev/gemini-api/docs/pricing?hl=zh-cn

Vertex AI 定价: https://cloud.google.com/gemini-enterprise-agent-platform/generative-ai/pricing?hl=zh-cn

|
套餐 |
月费(美元) |
核心权限 |
备注 |
|
Gemini 免费版 |
$0 |
Gemini 3.5 Flash,基础对话 |
Google AI Studio 免费 |
|
Gemini Advanced |
$19.99 |
|


