12 家供应商 37 个文本模型的输入、输出与缓存费率,另含图像、视频和语音生成 API。所有价格均来自供应商官方定价页面。
API 定价按每百万 token 计。大致:1M tokens ≈ 75 万字。输出 token 比输入贵 3–5 倍,缓存输入最多可便宜 98%。下面是当前值得使用的每个模型,按服务商分组,旗舰在前。
“—”表示服务商未公布该价格。缓存读是服务商近期已见过的输入 token 的折扣价。只有 Anthropic 收取缓存写入费(输入价的 +25%,5 分钟 TTL);OpenAI、Google、SpaceXAI 和 DeepSeek 自动缓存,不收写入费——Google 的显式缓存按小时收取存储费。
生成类 API 不按 token 计费。图像模型按张计费,视频模型按生成秒数计费,语音模型按分钟或每百万字符计费。
图像价格为默认 1024×1024 质量下每张生成图像的价格——≈ 表示由按 token 计费换算的估算值。视频价格为所列分辨率下每秒输出的价格。来源:OpenAI、Google 和 SpaceXAI 官方价格页及 Replicate 标价,核实于 2026 年 8 月 4 日。
翻译一篇 2,500 字的文章 (≈ 6,666 tokens,各占一半):
提示先用便宜的,质量不够再升级。最便宜的模型在简单任务上通常有 95% 的水平。
几乎所有供应商都按每百万 token 计费,输入(你发送的内容)和输出(模型生成的内容)分别定价。一个 token 约等于 ¾ 个英文单词,因此 100 万 token ≈ 75 万个单词。输出 token 通常比输入 token 贵 3–5 倍,而供应商近期已处理过的输入(缓存读取)最多可便宜 90%。
Ministral 3 14B 是本页最便宜的文本模型,每百万 token 价格为 $0.20 / $0.20(输入 / 输出)。在旗舰级模型中,最便宜的是 Grok 4.6,价格为 $2.00 / $6.00。最贵的是 GPT-5.5 pro,价格为 $30.00 / $180.00。
旗舰模型每百万输入 / 输出 token 的费率:GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00。每家供应商还提供更便宜的中端和经济型模型,足以应对大多数日常任务。
提示词缓存让供应商复用已经处理过的输入——长系统提示词、文档、对话历史。缓存的输入按缓存读取费率计费,通常比正常输入价格低 50–90%。只有 Anthropic 收取缓存写入费(输入价格的 +25%);OpenAI、Google、SpaceXAI 和 DeepSeek 自动缓存,不额外收费。
轻度使用的话,是的:每月几百次简短对话、使用中端模型,只需几美分而不是 20 美元。每天重度使用旗舰模型则可能超过订阅费。用成本计算器根据每天消息数和消息长度估算你的月账单。