$ AI PriceCompare
← 返回套餐对比
API 费率

每一个 AI API,按每百万 token定价。

12 家供应商 37 个文本模型的输入、输出与缓存费率,另含图像、视频和语音生成 API。所有价格均来自供应商官方定价页面。

§ 01 — 文本与推理模型

37 个模型,按供应商分组。

API 定价按每百万 token 计。大致:1M tokens ≈ 75 万字。输出 token 比输入贵 3–5 倍,缓存输入最多可便宜 98%。下面是当前值得使用的每个模型,按服务商分组,旗舰在前。

视图
模型
输入 / 1M
输出 / 1M
缓存读 / 1M
缓存写 / 1M
上下文
OpenAI
6 个模型
最强大、最聪明
$30.00
$180.00
1M
8 月 21 日降价 20%(限时至 11 月 21 日);超 272K token:$8/$30,缓存 $0.80
$4.00
$20.00
$0.40
1M
均衡版 5.6;7 月 30 日降价 20%
$2.00
$12.00
$0.20
1M
更便宜,适合定义清晰的任务
$0.75
$4.50
$0.075
400K
最快、最便宜
$0.20
$1.25
$0.02
400K
最快最便宜的 5.6 档;7 月 30 日降价 80%
$0.20
$1.20
$0.02
1M
Anthropic
4 个模型
最强大;出口管制暂停后于 7 月 1 日恢复
$10.00
$50.00
$1.00
$12.50
1M
全新 Opus 旗舰(7 月 24 日);接近 Fable 5,价格减半
$5.00
$25.00
$0.50
$6.25
1M
$2/$10 已成永久价格(9 月 1 日涨至 $3/$15 的计划已取消)
$2.00
$10.00
$0.20
$2.50
1M
快速,接近 Sonnet 4 质量
$1.00
$5.00
$0.10
$1.25
200K
Google
7 个模型
前沿多模态(>200K:$4/$18)
$2.00
$12.00
$0.20
1M
长上下文 (100 万);超 200K:$2.50/$15
$1.25
$10.00
$0.125
1M
全新主力(2026 年 8 月 13 日),面向编程与智能体;限时价至 12 月 31 日,1 月 1 日恢复至 $1.50/$7.50
$0.75
$3.75
$0.075
1M
降价以匹配 3.7 Flash 限时价,至 2026 年 12 月 31 日;1 月 1 日恢复至 $1.50/$7.50
$0.75
$3.75
$0.075
1M
最快 Flash 档(~350 tok/s);接替 3.1 Flash-Lite
$0.30
$2.50
$0.03
1M
最佳性价比
$0.30
$2.50
$0.03
1M
快速,实惠
$0.10
$0.40
$0.01
1M
Mistral
5 个模型
Mistral Medium 3.5
前沿级多模态;专注智能体与编程
$1.50
$7.50
256K
Mistral 旗舰
$0.50
$1.50
256K
代码生成
$0.30
$0.90
128K
中端通用;取代 Small 3.1
$0.15
$0.60
256K
经济多模态;取代 Pixtral 12B
$0.20
$0.20
256K
SpaceXAI
3 个模型
全新旗舰(2026 年 8 月 12 日);以相同价格取代 4.5;超 200K token:$4/$12
$2.00
$6.00
$0.50
500K
推理主力;取代 Grok 4;超 200K token:$2.50/$5
$1.25
$2.50
$0.20
1M
编程任务;取代 Grok Code Fast 1;超 200K token:$2/$4
$1.00
$2.00
$0.20
256K
DeepSeek
3 个模型
非高峰价;高峰时段(UTC 01:00-04:00 与 06:00-10:00,工作日)为 2 倍:$1.32/$3.96
$0.66
$1.98
$0.022
1M
非高峰价;高峰时段(UTC 01:00-04:00 与 06:00-10:00,工作日)为 2 倍:$0.44/$1.32
$0.22
$0.66
$0.007
1M
DeepSeek V4-Flash-Vision-Exp
V4-Flash 的实验性多模态/视觉变体(2026 年 8 月 21 日);费率相同
$0.22
$0.66
$0.007
1M
Meta
Meta 首个付费模型,智能体;1.2 以相同价格取代 1.1
$1.25
$4.25
$0.15
1M
Alibaba
3 个模型
Qwen3.8-Max
阿里巴巴新旗舰(2026 年 8 月 3 日);2.4 万亿参数 MoE
$2.00
$6.00
$0.17
1M
Qwen3.7-Max
上一代 Qwen 旗舰;多语言能力强
$1.25
$3.75
$0.13
1M
Qwen3.7-Plus
均衡的 Qwen 主力
$0.32
$1.28
Moonshot AI
Kimi K3
顶级开源权重智能体模型
$3.00
$15.00
$0.30
1M
Z.ai
GLM-5.3
GLM 旗舰;以相同价格取代 5.2;编程性价比高
$1.40
$4.40
$0.26
1M
Perplexity
2 个模型
Sonar Pro
内置联网搜索;另收按请求费用
$3.00
$15.00
200K
Sonar
便宜的联网回答;另收按请求费用
$1.00
$1.00
128K
Cohere
Command A+
取代 Command A;开源权重(Apache 2.0);通过 Cohere/Azure 的托管访问仅限企业——无公开按量计费价格
256K

“—”表示服务商未公布该价格。缓存读是服务商近期已见过的输入 token 的折扣价。只有 Anthropic 收取缓存写入费(输入价的 +25%,5 分钟 TTL);OpenAI、Google、SpaceXAI 和 DeepSeek 自动缓存,不收写入费——Google 的显式缓存按小时收取存储费。

§ 02 — 不止于文本

图像、视频与语音 API。

生成类 API 不按 token 计费。图像模型按张计费,视频模型按生成秒数计费,语音模型按分钟或每百万字符计费。

图像生成 API

模型
价格
最强
GPT-Image-2
OpenAI · OpenAI 最新旗舰;照片级编辑
≈$0.032 / image
GPT-Image-1.5
OpenAI · 将于 2026 年 12 月 1 日退役——请迁移至现评分第一的 GPT-Image-2
≈$0.034 / image
Gemini 3.1 Flash Image
Google · 按分辨率分级:512px 为 $0.045,1024px 为 $0.067,4K 为 $0.151
$0.045–0.151 / image
Gemini 3 Pro Image
Google · "Nano Banana Pro";高于 Flash Image 的高级档,最高支持 4K
$0.134–0.24 / image
Seedream 4.5
ByteDance · 写实感强,空间理解出色
$0.04 / image
FLUX 1.1 Pro
BFL · 开放生态的热门之选
$0.04 / image
Recraft V3
Recraft · 设计、矢量风格与长文字
$0.04 / image
快速经济
Ideogram V3 Turbo
Ideogram · 快速;文字渲染同类最佳
$0.03 / image
GPT-Image-1-mini
OpenAI · OpenAI 低价档
≈$0.008 / image
FLUX Schnell
BFL · 质量可靠的最低价;开源权重
$0.003 / image

视频生成 API

模型
价格
最强
Sora 2 Pro
OpenAI · 顶级电影质感(720p–1080p)
$0.30–0.70 / s
Veo 3.1
Google · 前沿画质,带音频(720p–4K)
$0.40–0.60 / s
Grok Imagine 1.5
SpaceXAI · 最便宜的前沿档(480p–1080p)
$0.08–0.25 / s
快速经济
Sora 2
OpenAI · 标准档,720p
$0.10 / s
Veo 3.1 Fast
Google · 更快更便宜的 Veo(720p–4K)
$0.10–0.30 / s
Veo 3.1 Lite
Google · 最便宜的 Veo 档(720p–1080p)
$0.05–0.08 / s
Grok Imagine Video
SpaceXAI · 最便宜的视频 API(480p–720p)
$0.05–0.07 / s

语音与音频 API

模型
价格
最强
GPT-Realtime-2.1
OpenAI · 语音到语音智能体,支持工具调用
$32 in / $64 out per 1M audio tok
Grok Voice Think Fast 2.0
SpaceXAI · 带推理的实时语音
$0.08 / min
Gemini 3.1 Flash TTS
Google · 高质量可控 TTS
$20 / 1M audio tok out
快速经济
TTS-1 HD
OpenAI · 高清文本转语音
$30 / 1M chars
TTS-1
OpenAI · 标准文本转语音
$15 / 1M chars
Grok Voice Think Fast 1.0
SpaceXAI · 经济型实时语音
$0.05 / min
Whisper
OpenAI · 便宜的转录(语音转文字)
$0.006 / min

图像价格为默认 1024×1024 质量下每张生成图像的价格——≈ 表示由按 token 计费换算的估算值。视频价格为所列分辨率下每秒输出的价格。来源:OpenAI、Google 和 SpaceXAI 官方价格页及 Replicate 标价,核实于 2026 年 8 月 4 日。

示例

翻译一篇 2,500 字的文章 (≈ 6,666 tokens,各占一半):

  • Gemini 2.5 Flash-Lite$0.002
  • GPT-5.6 Luna$0.005
  • Claude Haiku 4.5$0.020
  • Gemini 3.1 Pro$0.047
  • Claude Fable 5$0.200
  • GPT-5.5 pro$0.700

提示先用便宜的,质量不够再升级。最便宜的模型在简单任务上通常有 95% 的水平。

§ 03 — 常见问题

API 定价,讲清楚

AI API 的价格是怎么计算的?

几乎所有供应商都按每百万 token 计费,输入(你发送的内容)和输出(模型生成的内容)分别定价。一个 token 约等于 ¾ 个英文单词,因此 100 万 token ≈ 75 万个单词。输出 token 通常比输入 token 贵 3–5 倍,而供应商近期已处理过的输入(缓存读取)最多可便宜 90%。

2026 年最便宜的 AI API 是哪个?

Ministral 3 14B 是本页最便宜的文本模型,每百万 token 价格为 $0.20 / $0.20(输入 / 输出)。在旗舰级模型中,最便宜的是 Grok 4.6,价格为 $2.00 / $6.00。最贵的是 GPT-5.5 pro,价格为 $30.00 / $180.00。

通过 API 使用 GPT、Claude 和 Gemini 要花多少钱?

旗舰模型每百万输入 / 输出 token 的费率:GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00。每家供应商还提供更便宜的中端和经济型模型,足以应对大多数日常任务。

什么是提示词缓存,能省多少钱?

提示词缓存让供应商复用已经处理过的输入——长系统提示词、文档、对话历史。缓存的输入按缓存读取费率计费,通常比正常输入价格低 50–90%。只有 Anthropic 收取缓存写入费(输入价格的 +25%);OpenAI、Google、SpaceXAI 和 DeepSeek 自动缓存,不额外收费。

API 比 ChatGPT 或 Claude 订阅更便宜吗?

轻度使用的话,是的:每月几百次简短对话、使用中端模型,只需几美分而不是 20 美元。每天重度使用旗舰模型则可能超过订阅费。用成本计算器根据每天消息数和消息长度估算你的月账单。