Skip to content

模型价格 ​

本页汇总 GPT、Claude、Gemini、Grok 四个系列的模型价格,便于在选型和接入前进行成本评估。

计费规则说明 ​

文本模型按 Token 计费,图像模型按张计费。除特别说明外,价格单位均为美元(USD);具体单价和计费档位见下表。

Token 计费维度 ​

通常分为三类:

类型说明
Input Tokens用户输入消耗
Output Tokens模型生成消耗
Cache Tokens上下文缓存(部分模型支持)

计费原则 ​

  • 按 Token 使用量计费
  • 图像模型按 1K / 2K / 4K 单张价格计费,具体见各模型表格
  • 不同模型单价不同
  • 输入 / 输出 / 缓存价格通常不同
  • 长上下文模型可能启用 Cache 计费优化
  • 下方 Gemini 价格采用 Google Standard 实时付费档,不是 Batch、Flex 或 Priority 价格

价格对齐说明 ​

  • ✅ AI厂商复杂的报价体系难免让我们有差错,如有请及时联系我们,也请理解

OpenAI(GPT 系列) ​

Standard — Short context / Long context ​

单位为美元 / 百万 Token,采用 OpenAI Standard 价格。Short context 与 Long context 按请求输入 Token 数区分;超过 272K 时,整个请求使用 Long context 价格。

Short context输入 ≤272K tokens
模型输入缓存读取缓存写入输出
gpt-6.1-sol$2.00$0.10$2.50$10.00
gpt-6-astra$10.00$1.00$12.50$50.00
gpt-6-sol$2.00$0.20$2.50$10.00
gpt-6-luna$0.10$0.01$0.125$0.50
gpt-5.6-sol$4.00$0.40$5.00$20.00
gpt-5.6-terra$2.00$0.20$2.50$12.00
gpt-5.6-luna$0.20$0.02$0.25$1.20
Long context输入 >272K tokens
模型输入缓存读取缓存写入输出
gpt-6.1-sol$4.00$0.20$5.00$15.00
gpt-6-astra$20.00$2.00$25.00$75.00
gpt-6-sol$4.00$0.40$5.00$15.00
gpt-6-luna$0.20$0.02$0.25$0.75
gpt-5.6-sol$8.00$0.80$10.00$30.00
gpt-5.6-terra$4.00$0.40$5.00$18.00
gpt-5.6-luna$0.40$0.04$0.50$1.80

GPT-5.6 Sol 的促销价格至少持续至 2026-11-21。缓存写入与缓存读取分别计费。

其他文本模型(Standard) ​

Model NameInput Price ($/1M tokens)Output Price ($/1M tokens)Cache Read Price ($/1M tokens)
gpt-5.5$5.00$30.00$0.50
gpt-5.4-mini$0.75$4.50$0.075
gpt-5.3-codex-spark$1.75$14.00$0.175

图像模型(按张计费) ​

Model NameImage SizePrice
gpt-image-2.5-flare1K$0.134 / 张
gpt-image-2.5-flare2K$0.201 / 张
gpt-image-2.5-flare4K$0.268 / 张
gpt-image-2.5-sunburst1K$0.134 / 张
gpt-image-2.5-sunburst2K$0.201 / 张
gpt-image-2.5-sunburst4K$0.268 / 张
gpt-image-2-medium1K$0.134 / 张
gpt-image-2-medium2K$0.201 / 张
gpt-image-2-medium4K$0.268 / 张

GPT Image 模型按 1K / 2K / 4K 分别为 $0.134 / $0.201 / $0.268 每张。

Anthropic(Claude 系列) ​

Model NameInput Price ($/1M tokens)Output Price ($/1M tokens)Cache Read Price ($/1M tokens)
claude-fable-5-1$10.00$50.00$0.25
claude-fable-5$10.00$50.00$1.00
claude-opus-5-5$4.00$20.00$0.20
claude-opus-5$5.00$25.00$0.50
claude-opus-4-8$5.00$25.00$0.50
claude-opus-4-7$5.00$25.00$0.50
claude-opus-4-6$5.00$25.00$0.50
claude-sonnet-5-5$2.00$10.00$0.20
claude-sonnet-5$2.00$10.00$0.20
claude-sonnet-4-6$3.00$15.00$0.30
claude-haiku-4-5-20251001$1.00$5.00$0.10

Google(Gemini 系列) ​

文本模型(Token 计费) ​

Model NameInput Price ($/1M tokens)Output Price ($/1M tokens)Cache Read Price ($/1M tokens)
gemini-3.8-flash$0.75*$3.75*$0.075*
gemini-3.7-flash$0.75*$3.75*$0.075*
gemini-3.6-flash$0.75*$3.75*$0.075*
gemini-3.5-flash$1.50$9.00$0.15
gemini-3.5-flash-lite$0.30$2.50$0.03
gemini-3.1-flash-lite$0.25$1.50$0.025
gemini-3.1-pro-preview$2.00(≤200K)
$4.00(>200K)
$12.00(≤200K)
$18.00(>200K)
$0.20(≤200K)
$0.40(>200K)
gemini-3-flash-preview$0.50$3.00$0.05
gemini-2.5-flash$0.30$2.50$0.03
gemini-2.5-flash-lite$0.10$0.40$0.01
gemini-2.5-pro$1.25(≤200K)
$2.50(>200K)
$10.00(≤200K)
$15.00(>200K)
$0.125(≤200K)
$0.25(>200K)
  • gemini-3.6-flash、gemini-3.7-flash 和 gemini-3.8-flash 的 Standard 促销价有效至 2026-12-31;自 2027-01-01 起,输入 / 输出 / 缓存读取价格分别为 $1.50 / $7.50 / $0.15。

Cache Read 价格不包含缓存存储费;Grounding、Google 搜索 / 地图和其他工具费用另行计算,不包含在本表内。

图像模型(按张计费) ​

模型名称1K2K4K
gemini-3.1-flash-image$0.201 / 张$0.301 / 张$0.451 / 张
gemini-3.1-flash-image-preview (兼容别名)$0.201 / 张$0.301 / 张$0.451 / 张
gemini-3.1-flash-lite-image$0.201 / 张$0.301 / 张$0.451 / 张
gemini-3-pro-image$0.201 / 张$0.301 / 张$0.451 / 张
gemini-3-pro-image-preview (兼容别名)$0.201 / 张$0.301 / 张$0.451 / 张
gemini-2.5-flash-image$0.201 / 张$0.301 / 张$0.451 / 张

Gemini 图像模型按 1K / 2K / 4K 分别为 $0.201 / $0.301 / $0.451 每张。

输出尺寸对应 1K / 2K / 4K 计费档位;auto 或无法识别的尺寸按 2K 档计费。

⚠️ Gemini 图像模型(名称含 -image)仅支持 Google 原生协议 POST {base}/v1beta/models/{model}:generateContent。请勿用 OpenAI chat/completions 调用生图——会返回 200 但图片被静默丢弃,且照常按 output token 计费;OpenAI /v1/images/generations 仅支持 gpt-image-*。

xAI(Grok 系列) ​

Model NameInput Price ($/1M tokens)Output Price ($/1M tokens)Cache Read Price ($/1M tokens)Context Window
grok-4.5$2.00$6.00$0.30500K
grok-4.3$1.25$2.50$0.201M

注意事项 ​

  • 某些模型可能需要单独开通权限
  • 长上下文模型可能涉及额外费用

后续更新 ​

  • 模型清单将持续更新
  • 新模型上线后将第一时间同步