Token 成本计算器

Claude Token 成本计算器

Claude Opus、Sonnet、Haiku 的每 token 成本与月度估算——走 Anthropic API。

最近更新:2026-09-26

1,000
2,000
400
1,000 × 2,000in + 400out = 2,000,000 input,400,000 output tokens

覆盖 18 个模型的预估成本

google 最便宜

Gemini 2.5 Flash-Lite

$0.360/ 月
$4.32 / 年
openai

GPT-6 luna

$0.400/ 月
$4.80 / 年
deepseek

DeepSeek V4.1-Flash

$1.08/ 月
$12.96 / 年
高峰时段
google

Gemini 3.1 Flash-Lite

$1.10/ 月
$13.20 / 年
google

Gemini 2.5 Flash

$2.70/ 月
$32.40 / 年
长上下文 ≥200,000
google

Gemini 3.8 Flash

$3.00/ 月
$36.00 / 年
anthropic

Claude Haiku 4.5

$4.00/ 月
$48.00 / 年
deepseek

DeepSeek V4-Pro

$4.22/ 月
$50.69 / 年
高峰时段
grok

Grok 4.7

$6.40/ 月
$76.80 / 年
openai

GPT-6 sol

$8.00/ 月
$96.00 / 年
anthropic

Sonnet 5

$8.00/ 月
$96.00 / 年
google

Gemini 3.1 Pro Preview

$8.80/ 月
$106 / 年
google

Gemini 2.5 Pro

$11.00/ 月
$132 / 年
长上下文 ≥200,000
openai

GPT-5.6 sol

$16.00/ 月
$192 / 年
anthropic

Opus 5.5

$16.00/ 月
$192 / 年
openai

GPT-6 astra

$40.00/ 月
$480 / 年
anthropic

Fable 5.1

$40.00/ 月
$480 / 年
openai

GPT-5.6 cyber

$55.00/ 月
$660 / 年

价格核对:2026-09-26。来源:各厂商官方定价页。 · 机器可读:/api/prices.json

要点速览
  • 1输出 token 通常比输入贵 4–8 倍——压缩回复长度是最划算的省钱方式。
  • 2Anthropic prompt cache 让重复输入便宜约 90%;OpenAI GPT-5 缓存输入也便宜约 90%。
  • 3DeepSeek 非高峰时段(UTC 16:30–00:30)比高峰便宜约 10 倍——批量任务排进去。
  • 4Gemini 2.5 Pro 在上下文超过 200K 后输入价翻倍——大上下文调用成本大约翻一番。
Token 成本计算器

Claude.ai 订阅 vs API

Claude Pro($20/月)和 Claude Max($200/月)在用量上限内通常比 API 划算。过了上限,API——或者 OpenRouter 这类第三方聚合——才是更优选择。

Claude Pro · $20/月

盈亏平衡:约 1.90M 输入 + 0.95M 输出 每月

低于这个总用量,Pro 套餐更划算;超过则 API 开始赢。

Claude Max · $200/月

盈亏平衡:约 19.0M 输入 + 9.52M 输出 每月

持续高用量场景下,Max 大约覆盖到 API 等价 $200/月。

参考样本:通过 API 1M 输入 + 50万输出 token 每月 $10.50(按当前 Sonnet 4.5 单价)。

Token 成本计算器

怎么把账单压下去

  1. 1路由 / 分类用小模型——Haiku 4.5 / GPT-5 nano 比旗舰便宜 5–10 倍。
  2. 2缓存重复前缀(系统提示词、工具 schema)——Anthropic 缓存读便宜约 90%。
  3. 3显式设 max_tokens——输出是贵的,封顶防止回复失控。
  4. 4非紧急任务排进 DeepSeek 非高峰(UTC 16:30–00:30),推理便宜约 10 倍。
  5. 5砍长上下文——Gemini 2.5 Pro 输入在 200K 以上翻倍;不需要的全部分块丢掉。
Token 成本计算器

calculator.faqTitle

Claude Sonnet 4.5 走 Anthropic API 是 $3 输入 / $15 输出每 1M token。开 prompt cache 后缓存读降至 $0.30 每 1M(打 1 折)。5 分钟缓存写入 $3.75 每 1M;1 小时缓存写入 $6 每 1M。