大模型 API 价格对比

同一个开源权重模型,在不同地方调用的花费可以相差很多。下面把 11 个模型在五个地方的价格并排列出,统一到同一个单位:美元 / 1M tokens,缓存未命中,标准档。每个数字都取自对方自己的定价页,日期见下;我们更贵的那几行,在页面后半段单独成节写出来。

口径

这些数字是怎么来的

统一到同一个单位
我们标的是美元额度价,当前充值 $1 得 $20 额度。表里我们这一列是额度价 ÷ 20,也就是真正从卡里划走的现金。其余各家标的本来就是现金。
取最便宜的公开档,缓存未命中
对方分档计价时,表里取其中适用于普通调用的最便宜那一档:DeepSeek 取低谷价而非高峰价,DeepInfra 取标准档而非弹性档。缓存命中价全表都不计入,我们自己这一列也一样。
型号名按对方的写法原样抄
聚合平台常常上架的是带日期的快照版本(如 -0813),或者按参数规模改名。这些情况在表里都标了出来——带日期的版本不保证和当前滚动更新的同名型号行为一致。
两种不同的空格
写着「目录中无此型号」的格子,意思是我们核实过、对方确实没有这个型号。空白的格子意思是我们没核实过,不代表对方没有。这两者绝不合并显示。
11 个模型在厂商官方 API、三家聚合平台与 Y-API 上的每 1M tokens 输入价
xiaomi/mimo-v2.5每 1M tokensY-API$0.007 输入$0.014 输出Xiaomi MiMo$0.142另有更便宜的缓存命中档 输入$0.28 输出mimo-v2.5OpenRouter$0.1193带日期的快照版本,不是滚动更新的同名型号 输入$0.238 输出xiaomi/mimo-v2.5-20260422Together AI目录中无此型号DeepInfra目录中无此型号
deepseek/deepseek-v4-flash每 1M tokensY-API$0.0075 输入$0.015 输出DeepSeek$0.221,2低谷时段价; 另有更便宜的缓存命中档 输入$0.66 输出deepseek-v4-flashOpenRouter$0.063带日期的快照版本,不是滚动更新的同名型号 输入$0.12 输出deepseek/deepseek-v4-flash-0731Together AI$0.143带日期的快照版本,不是滚动更新的同名型号 输入$0.28 输出DeepSeek V4 Flash 0731DeepInfra$0.095标准档,优先级档与弹性档另计 输入$0.18 输出deepseek-ai/DeepSeek-V4-Flash
minimax/minimax-m2.7每 1M tokensY-API$0.015 输入$0.06 输出MiniMax$0.302另有更便宜的缓存命中档 输入$1.20 输出MiniMax-M2.7Together AI$0.30 输入$1.20 输出MiniMax M2.7DeepInfra目录中无此型号
minimax/minimax-m2.5每 1M tokensY-API$0.015 输入$0.06 输出MiniMax$0.302另有更便宜的缓存命中档 输入$1.20 输出MiniMax-M2.5Together AI目录中无此型号DeepInfra目录中无此型号
qwen/qwen3.7-plus每 1M tokensY-API$0.0175 输入$0.065 输出Alibaba Cloud Model Studio不公开单价Together AI$0.32 输入$1.28 输出Qwen3.7-PlusDeepInfra目录中无此型号
xiaomi/mimo-v2.5-pro每 1M tokensY-API$0.0225 输入$0.045 输出Xiaomi MiMo$0.4352另有更便宜的缓存命中档 输入$0.87 输出mimo-v2.5-proTogether AI目录中无此型号DeepInfra目录中无此型号
deepseek/deepseek-v4-pro每 1M tokensY-API$0.025 输入$0.05 输出DeepSeek$0.661,2低谷时段价; 另有更便宜的缓存命中档 输入$1.98 输出deepseek-v4-proOpenRouter$1.1223带日期的快照版本,不是滚动更新的同名型号 输入$3.366 输出deepseek/deepseek-v4-pro-0813Together AI$1.74 输入$3.48 输出DeepSeek V4 ProDeepInfra$1.305标准档,优先级档与弹性档另计 输入$2.60 输出deepseek-ai/DeepSeek-V4-Pro
minimax/minimax-m2.7-highspeed每 1M tokensY-API$0.03 输入$0.12 输出MiniMax$0.60 输入$2.40 输出MiniMax-M2.7-highspeedTogether AI目录中无此型号DeepInfra目录中无此型号
minimax/minimax-m2.5-highspeed每 1M tokensY-API$0.03 输入$0.12 输出MiniMax$0.60 输入$2.40 输出MiniMax-M2.5-highspeedTogether AI目录中无此型号DeepInfra目录中无此型号
qwen/qwen3.7-max每 1M tokensY-API$0.075 输入$0.225 输出Alibaba Cloud Model Studio不公开单价Together AI$1.25 输入$3.75 输出Qwen3.7-MaxDeepInfra$2.505标准档,优先级档与弹性档另计 输入$7.50 输出Qwen/Qwen3.7-Max
qwen/qwen3.8-max每 1M tokensY-API$0.10 输入$0.30 输出Alibaba Cloud Model Studio不公开单价OpenRouter$2.00 输入$6.00 输出Together AI$2.504对方以另一个名字上架 输入$6.25 输出Qwen3.8-2.4T-A95BDeepInfra$1.655标准档,优先级档与弹性档另计 输入$4.951 输出Qwen/Qwen3.8-Max
  • 1低谷时段价
  • 2另有更便宜的缓存命中档
  • 3带日期的快照版本,不是滚动更新的同名型号
  • 4对方以另一个名字上架
  • 5标准档,优先级档与弹性档另计

我们便宜在哪里

差价来自充值汇率,不是来自压低的标价

把我们的额度价当成美元读,它基本就贴在各厂商自己的标价上——四个 MiniMax 型号与 xiaomi/mimo-v2.5 完全相同,xiaomi/mimo-v2.5-pro 略高于官方,两个 DeepSeek 版本低于官方。差价几乎全部来自 20:1 的充值汇率。这也是为什么必须说清楚这个倍数是临时的:汇率变成 1:10 时它会减半。

与厂商官方价现金对现金地比,能对上参考价的模型在输入价上便宜 19.3× 到 29.3×。

我们更贵的场景

这三种情况不该用我们

持续命中提示词缓存的场景

DeepSeek 对缓存命中的输入价是低谷时段每 1M $0.022,小米是 $0.0028——都低于我们同型号的现金价。我们完全没有缓存命中这一档。如果你在反复重放一段又长又稳定的系统提示词,直连厂商可能比走我们更便宜。

清单之外的模型

我们的清单是 16 个模型 ID。GPT、Claude、Gemini 都不在其中,聚合平台上的大部分长尾模型也不在。需要的模型不在清单上时,价格再便宜也没有意义。

需要一个不会变的价格时

表里的倍数建立在限时 20:1 充值汇率上。已经到账的额度不会被重新计价,但优惠结束后新充值按 1:10 折算,这里显示的每一项优势都会减半。厂商标价同样没有合约效力,但它变得慢、而且变在明面上。

缺口

这张表少了什么,以及为什么

不是所有模型都在表里
16 个模型里有 5 个不在表内:两个 Qwen 模型一条外部价都没核实到,两个 DeepSeek 版本在我们能查到的任何定价页上都不存在,还有一个模型没有署名厂商。
阿里云不公开 Qwen 的 token 单价
它的公开模型页只给能力表,token 计费藏在分地域的控制台里。这就是每一行 Qwen 的官方价格子都空着的原因——留空比抄一个博客里的数字更负责。我们自己的价格在公开页面上,也在一个机器可读的接口里。
全表没有采用任何第三方数字
仅一个 DeepSeek 型号,就能在三篇被广泛引用的文章里查到三个互相矛盾的价格。这里只承认对方自己的定价页。
聚合平台之间能差到 2 倍
Qwen3.7-Max 的输入价在 Together AI 是每 1M $1.25,在 DeepInfra 是 $2.50——同一个模型、同一个单位、同一天。任何单一聚合平台的数字都只是一个数据点,不是「市场价」。

常见问题

这张表会引出的问题

调用 DeepSeek V4 Pro 最便宜的方式是哪一种?
核实于 2026-08-26,每 1M 输入 token:Y-API 实付 $0.025,DeepSeek 自己的 API 低谷 $0.66、高峰 $1.32,DeepInfra $1.30,OpenRouter 带日期的 0813 版本 $1.122,Together AI $1.74。唯一会翻转的情况是提示词持续命中缓存——DeepSeek 对缓存命中的输入价是每 1M $0.022,略低于我们。
为什么 Y-API 标的是额度价而不是美元?
额度是服务内部的计量单位:充值把美元按当期汇率换成额度,各模型再按 token 扣减额度。标额度价能让汇率变动时每个模型的数字保持稳定。要换算成现金价,把额度价除以当前汇率即可——现在是 20,优惠结束后是 10。两个数字都是公开的,现金价也在机器可读的价格接口里。
聚合平台会比模型厂商自己更便宜吗?
会,这张表里就有一例。OpenRouter 上带日期的 xiaomi/mimo-v2.5-20260422 输入价是每 1M $0.119,低于小米自己的 $0.14。但聚合平台有时只上架带日期的快照版本,它不会随滚动更新的同名型号一起升级——便宜,但不是同一个东西。
这里面有多少是真降价,多少只是充值优惠?
几乎全部是充值优惠。把额度价当美元来比,我们的价格与厂商标价在四个 MiniMax 型号和 xiaomi/mimo-v2.5 上完全相同,在 xiaomi/mimo-v2.5-pro 上比官方高约 3%,在两个 DeepSeek 版本上低于官方。表里那些大倍数来自 20:1 的充值汇率,而它是限时的,之后恢复 1:10。
这张表多久更新一次?
每个数字都带核实日期,标在页面顶部。各家调价不另行通知,所以超过几周的数据只能当起点看,真要投入预算前请先点开出处。我们自己的价格在构建时从线上清单同步,因此不会比最近一次部署更旧。

出处

数据来源

每家一条链接,指向数字被读取的那个页面。Y-API 自己的价格来自模型页与价格页,也可从 https://y-api.bestvirtualgoods.com/pricing.json 直接取。

拿你自己的账单核一个模型

挑你调用最多的那个模型,在表里找到它,乘上上个月的 token 数。如果这笔账算得过来,登录后把一个调用指过来——请求日志里会显示真实的扣减。