大模型 API 价格对比

同一个模型,在不同地方调用的花费可以相差很多。下面把 16 个模型在五个地方的价格并排列出,统一到同一个单位:美元 / 1M tokens,缓存未命中,标准档。每个数字都取自对方自己的定价页,日期见下;我们更贵的那几行,在页面后半段单独成节写出来。

口径

这些数字是怎么来的

统一到同一个单位
我们标的是美元额度价,当前充值 $1 得 $10 额度。表里我们这一列是额度价 ÷ 10,也就是真正从卡里划走的现金。其余各家标的本来就是现金。
取最便宜的公开档,缓存未命中
对方分档计价时,表里取其中适用于普通调用的最便宜那一档:DeepSeek 取低谷价而非高峰价,DeepInfra 取标准档而非弹性档。缓存命中价全表都不计入,我们自己这一列也一样。
型号名按对方的写法原样抄
聚合平台常常上架的是带日期的快照版本(如 -0813),或者按参数规模改名。这些情况在表里都标了出来——带日期的版本不保证和当前滚动更新的同名型号行为一致。
两种不同的空格
写着「目录中无此型号」的格子,意思是我们核实过、对方确实没有这个型号。空白的格子意思是我们没核实过,不代表对方没有。这两者绝不合并显示。
16 个模型在厂商官方 API、三家聚合平台与 Y-API 上的每 1M tokens 输入价
厂商: DeepSeek
deepseek/deepseek-v4-pro每 1M tokensY-API$0.05 输入$0.10 输出DeepSeek$0.661,2低谷时段价; 另有更便宜的缓存命中档 输入$1.98 输出deepseek-v4-proOpenRouter$0.65873,2带日期的快照版本,不是滚动更新的同名型号; 另有更便宜的缓存命中档 输入$1.976 输出deepseek/deepseek-v4-pro-0813Together AI$1.323,2带日期的快照版本,不是滚动更新的同名型号; 另有更便宜的缓存命中档 输入$3.96 输出DeepSeek V4 Pro 0813DeepInfra$1.305标准档,优先级档与弹性档另计 输入$2.60 输出deepseek-ai/DeepSeek-V4-Pro
deepseek/deepseek-v4.1-flash每 1M tokensY-API$0.02 输入$0.10 输出DeepSeek$0.151,2低谷时段价; 另有更便宜的缓存命中档 输入$0.60 输出deepseek-flashOpenRouter$0.152另有更便宜的缓存命中档 输入$0.60 输出
deepseek/deepseek-v4-flash-0731每 1M tokensY-API$0.015 输入$0.03 输出DeepSeek$0.221,2,4低谷时段价; 另有更便宜的缓存命中档; 该版本的历史官方价;当前滚动版本价格可能不同 输入$0.66 输出deepseek-v4-flash
厂商: 通义千问 Qwen
qwen/qwen3.8-flash每 1M tokensY-API$0.02 输入$0.05 输出Alibaba Cloud Model Studio$0.1136六张地域价目表里最低的那一档 输入$0.382 输出qwen3.8-flashOpenRouter$0.152另有更便宜的缓存命中档 输入$0.47 输出Together AI$0.15 输入$0.47 输出Qwen3.8 FlashDeepInfra目录中无此型号
厂商: 智谱 GLM
z-ai/glm-5.2每 1M tokensY-API$0.14 输入$0.44 输出Z.ai$1.402另有更便宜的缓存命中档 输入$4.40 输出GLM-5.2
z-ai/glm-5.3每 1M tokensY-API$0.14 输入$0.50 输出Z.ai$1.402另有更便宜的缓存命中档 输入$4.40 输出GLM-5.3
z-ai/glm-5.3-flash每 1M tokensY-API$0.015 输入$0.05 输出Z.ai$0.152另有更便宜的缓存命中档 输入$0.50 输出GLM-5.3-Flash
厂商: 月之暗面 Kimi
moonshotai/kimi-k3每 1M tokensY-API$0.30 输入$1.50 输出Kimi$3.002另有更便宜的缓存命中档 输入$15.00 输出kimi-k3
moonshotai/kimi-k2.6每 1M tokensY-API$0.095 输入$0.40 输出Kimi$0.952另有更便宜的缓存命中档 输入$4.00 输出kimi-k2.6
厂商: Anthropic
anthropic/claude-opus-5每 1M tokensY-API$0.50 输入$2.50 输出Anthropic$5.002另有更便宜的缓存命中档 输入$25.00 输出claude-opus-5
anthropic/claude-sonnet-5每 1M tokensY-API$0.20 输入$1.00 输出Anthropic$2.002另有更便宜的缓存命中档 输入$10.00 输出claude-sonnet-5
厂商: OpenAI
openai/gpt-5.6-sol每 1M tokensY-API$0.50 输入$3.00 输出OpenAI$4.002,5,7,8另有更便宜的缓存命中档; 标准档,优先级档与弹性档另计; 输入长度最低的那一档,提示词更长则单价更高; 限时促销价,标价高于此 输入$20.00 输出gpt-5.6-sol
openai/gpt-5.6-luna每 1M tokensY-API$0.03 输入$0.13 输出OpenAI$0.202,5,7另有更便宜的缓存命中档; 标准档,优先级档与弹性档另计; 输入长度最低的那一档,提示词更长则单价更高 输入$1.20 输出gpt-5.6-luna
厂商: 其他
tencent/hy4-preview每 1M tokensY-API$0.10 输入$0.30 输出Tencent Hunyuan$1.20 输入$3.60 输出hy4-preview
stepfun/step-3.7-flash每 1M tokensY-API$0.02 输入$0.12 输出StepFun$0.22 输入$1.32 输出step-3.7-flash
xiaomi/mimo-v2.6-flash每 1M tokensY-API$0.018 输入$0.036 输出Xiaomi MiMo$0.16 输入$0.32 输出mimo-v2.6-flash
  • 1低谷时段价
  • 2另有更便宜的缓存命中档
  • 3带日期的快照版本,不是滚动更新的同名型号
  • 4该版本的历史官方价;当前滚动版本价格可能不同
  • 5标准档,优先级档与弹性档另计
  • 6六张地域价目表里最低的那一档
  • 7输入长度最低的那一档,提示词更长则单价更高
  • 8限时促销价,标价高于此

我们便宜在哪里

差价来自充值汇率,不是来自压低的标价

把我们的额度价当成美元读,它基本就贴在各厂商自己的标价上——能对上参考价的那几个落在厂商标价的 0.682× 到 1.77× 之间。差价几乎全部来自 1:10 的充值汇率。

与厂商官方价现金对现金地比,能对上参考价的模型在输入价上便宜 5.65× 到 14.7×。

我们更贵的场景

这两种情况不该用我们

持续命中提示词缓存的场景

DeepSeek 对 deepseek/deepseek-v4.1-flash 缓存命中的输入价是每 1M $0.003,我们同型号的现金价是 $0.02。DeepSeek 对 deepseek/deepseek-v4-pro 缓存命中的输入价是每 1M $0.022,我们同型号的现金价是 $0.05。OpenAI 对 openai/gpt-5.6-luna 缓存命中的输入价是每 1M $0.02,我们同型号的现金价是 $0.03。OpenAI 对 openai/gpt-5.6-sol 缓存命中的输入价是每 1M $0.40,我们同型号的现金价是 $0.50。我们完全没有缓存命中这一档。如果你在反复重放一段又长又稳定的系统提示词,直连厂商可能比走我们更便宜。

清单之外的模型

我们的清单是 20 个模型 ID。Gemini 不在其中,聚合平台上的大部分长尾模型也不在。需要的模型不在清单上时,价格再便宜也没有意义。

缺口

覆盖范围与计价限制

模型覆盖范围
表格已覆盖全部 16 个付费模型。历史版本价格和计费档位在对应价格旁标注。
阿里云没有「一个」Qwen 价格
Model Studio 把同一个版本切成六张地域价目表,再按输入长度切档,一部分版本限时打折、另一部分夜间打折,缓存命中还单独计费而页面上压根没写那一档的单价。官方价这一列取的是一次普通实时调用能拿到的最便宜的格子——最便宜的地域、最短输入档、限时折后、缓存未命中——也就是对我们最不利的那种读法。夜间档是故意没采的:英文页写「night 80% off」,中文口径读起来是「夜间 8 折」,一个是付两成一个是付八成,我们不去挑对自己有利的那一种读法。
全表没有采用任何第三方数字
仅一个 DeepSeek 型号,就能在三篇被广泛引用的文章里查到三个互相矛盾的价格。这里只承认对方自己的定价页。
聚合平台之间能差到 2×
表里 deepseek/deepseek-v4-pro 那一行,输入价在 OpenRouter 是每 1M $0.6587,在 Together AI 是 $1.32——同一个模型、同一个单位,都读自各家自己的定价页。任何单一聚合平台的数字都只是一个数据点,不是「市场价」。

一家一页

与单独一家的对比

这张表宽而浅:每格一个数字,容不下任何一家的计价结构。下面每一页只对一家,反方向做一遍——双方都在卖的每个型号、每个数字背后的档位、读到它的日期,以及对方比我们更便宜的那些场景。

常见问题

这张表会引出的问题

调用 deepseek/deepseek-v4-pro 最便宜的方式是哪一种?
每 1M 输入 token,每个数字都读于 2026-08-26 或之后:Y-API 实付 $0.05,DeepSeek 自己的 API $0.66,OpenRouter $0.6587(那边叫 deepseek/deepseek-v4-pro-0813)、Together AI $1.32(那边叫 DeepSeek V4 Pro 0813)、DeepInfra $1.30(那边叫 deepseek-ai/DeepSeek-V4-Pro)。唯一会翻转的情况是提示词持续命中缓存——DeepSeek 对缓存命中的输入价是每 1M $0.022,低于我们的 $0.05。
为什么 Y-API 标的是额度价而不是美元?
额度是服务内部的计量单位:充值把美元按当期汇率换成额度,各模型再按 token 扣减额度。标额度价能让汇率变动时每个模型的数字保持稳定。要换算成现金价,把额度价除以当前汇率即可——现在是 10。额度价与汇率都是公开的,现金价也在机器可读的价格接口里。
聚合平台会比模型厂商自己更便宜吗?
会,这张表里就有一例。OpenRouter 上 deepseek/deepseek-v4-pro-0813 的输入价是每 1M $0.6587,低于 DeepSeek 自己的 $0.66。但聚合平台有时只上架带日期的快照版本,它不会随滚动更新的同名型号一起升级——便宜,但不是同一个东西。
这里面有多少是真降价,多少只是充值优惠?
几乎全部是充值优惠。把额度价当美元来比,我们的价格落在厂商标价的 0.682× 到 1.77× 之间。表里那些大倍数来自 1:10 的充值汇率。
这张表多久更新一次?
每个数字都带核实日期,标在页面顶部。各家调价不另行通知,所以超过几周的数据只能当起点看,真要投入预算前请先点开出处。我们自己的价格在构建时从线上清单同步,因此不会比最近一次部署更旧。

出处

数据来源

拿你自己的账单核一个模型

挑你调用最多的那个模型,在表里找到它,乘上上个月的 token 数。如果这笔账算得过来,登录后把一个调用指过来——请求日志里会显示真实的扣减。