大模型 API 价格对比
同一个模型,在不同地方调用的花费可以相差很多。下面把 16 个模型在五个地方的价格并排列出,统一到同一个单位:美元 / 1M tokens,缓存未命中,标准档。每个数字都取自对方自己的定价页,日期见下;我们更贵的那几行,在页面后半段单独成节写出来。
口径
这些数字是怎么来的
- 统一到同一个单位
- 我们标的是美元额度价,当前充值 $1 得 $10 额度。表里我们这一列是额度价 ÷ 10,也就是真正从卡里划走的现金。其余各家标的本来就是现金。
- 取最便宜的公开档,缓存未命中
- 对方分档计价时,表里取其中适用于普通调用的最便宜那一档:DeepSeek 取低谷价而非高峰价,DeepInfra 取标准档而非弹性档。缓存命中价全表都不计入,我们自己这一列也一样。
- 型号名按对方的写法原样抄
- 聚合平台常常上架的是带日期的快照版本(如 -0813),或者按参数规模改名。这些情况在表里都标了出来——带日期的版本不保证和当前滚动更新的同名型号行为一致。
- 两种不同的空格
- 写着「目录中无此型号」的格子,意思是我们核实过、对方确实没有这个型号。空白的格子意思是我们没核实过,不代表对方没有。这两者绝不合并显示。
| 模型 ID | Y-API | 厂商官方价 | OpenRouter | Together AI | DeepInfra |
|---|---|---|---|---|---|
| 厂商: DeepSeek | |||||
| deepseek/deepseek-v4-pro每 1M tokens | Y-API$0.05 输入$0.10 输出 | DeepSeek$0.661,2低谷时段价; 另有更便宜的缓存命中档 输入$1.98 输出deepseek-v4-pro | OpenRouter$0.65873,2带日期的快照版本,不是滚动更新的同名型号; 另有更便宜的缓存命中档 输入$1.976 输出deepseek/deepseek-v4-pro-0813 | Together AI$1.323,2带日期的快照版本,不是滚动更新的同名型号; 另有更便宜的缓存命中档 输入$3.96 输出DeepSeek V4 Pro 0813 | DeepInfra$1.305标准档,优先级档与弹性档另计 输入$2.60 输出deepseek-ai/DeepSeek-V4-Pro |
| deepseek/deepseek-v4.1-flash每 1M tokens | Y-API$0.02 输入$0.10 输出 | DeepSeek$0.151,2低谷时段价; 另有更便宜的缓存命中档 输入$0.60 输出deepseek-flash | OpenRouter$0.152另有更便宜的缓存命中档 输入$0.60 输出 | ||
| deepseek/deepseek-v4-flash-0731每 1M tokens | Y-API$0.015 输入$0.03 输出 | DeepSeek$0.221,2,4低谷时段价; 另有更便宜的缓存命中档; 该版本的历史官方价;当前滚动版本价格可能不同 输入$0.66 输出deepseek-v4-flash | |||
| 厂商: 通义千问 Qwen | |||||
| qwen/qwen3.8-flash每 1M tokens | Y-API$0.02 输入$0.05 输出 | Alibaba Cloud Model Studio$0.1136六张地域价目表里最低的那一档 输入$0.382 输出qwen3.8-flash | OpenRouter$0.152另有更便宜的缓存命中档 输入$0.47 输出 | Together AI$0.15 输入$0.47 输出Qwen3.8 Flash | DeepInfra目录中无此型号 |
| 厂商: 智谱 GLM | |||||
| z-ai/glm-5.2每 1M tokens | Y-API$0.14 输入$0.44 输出 | Z.ai$1.402另有更便宜的缓存命中档 输入$4.40 输出GLM-5.2 | |||
| z-ai/glm-5.3每 1M tokens | Y-API$0.14 输入$0.50 输出 | Z.ai$1.402另有更便宜的缓存命中档 输入$4.40 输出GLM-5.3 | |||
| z-ai/glm-5.3-flash每 1M tokens | Y-API$0.015 输入$0.05 输出 | Z.ai$0.152另有更便宜的缓存命中档 输入$0.50 输出GLM-5.3-Flash | |||
| 厂商: 月之暗面 Kimi | |||||
| moonshotai/kimi-k3每 1M tokens | Y-API$0.30 输入$1.50 输出 | Kimi$3.002另有更便宜的缓存命中档 输入$15.00 输出kimi-k3 | |||
| moonshotai/kimi-k2.6每 1M tokens | Y-API$0.095 输入$0.40 输出 | Kimi$0.952另有更便宜的缓存命中档 输入$4.00 输出kimi-k2.6 | |||
| 厂商: Anthropic | |||||
| anthropic/claude-opus-5每 1M tokens | Y-API$0.50 输入$2.50 输出 | Anthropic$5.002另有更便宜的缓存命中档 输入$25.00 输出claude-opus-5 | |||
| anthropic/claude-sonnet-5每 1M tokens | Y-API$0.20 输入$1.00 输出 | Anthropic$2.002另有更便宜的缓存命中档 输入$10.00 输出claude-sonnet-5 | |||
| 厂商: OpenAI | |||||
| openai/gpt-5.6-sol每 1M tokens | Y-API$0.50 输入$3.00 输出 | OpenAI$4.002,5,7,8另有更便宜的缓存命中档; 标准档,优先级档与弹性档另计; 输入长度最低的那一档,提示词更长则单价更高; 限时促销价,标价高于此 输入$20.00 输出gpt-5.6-sol | |||
| openai/gpt-5.6-luna每 1M tokens | Y-API$0.03 输入$0.13 输出 | OpenAI$0.202,5,7另有更便宜的缓存命中档; 标准档,优先级档与弹性档另计; 输入长度最低的那一档,提示词更长则单价更高 输入$1.20 输出gpt-5.6-luna | |||
| 厂商: 其他 | |||||
| tencent/hy4-preview每 1M tokens | Y-API$0.10 输入$0.30 输出 | Tencent Hunyuan$1.20 输入$3.60 输出hy4-preview | |||
| stepfun/step-3.7-flash每 1M tokens | Y-API$0.02 输入$0.12 输出 | StepFun$0.22 输入$1.32 输出step-3.7-flash | |||
| xiaomi/mimo-v2.6-flash每 1M tokens | Y-API$0.018 输入$0.036 输出 | Xiaomi MiMo$0.16 输入$0.32 输出mimo-v2.6-flash | |||
- 1低谷时段价
- 2另有更便宜的缓存命中档
- 3带日期的快照版本,不是滚动更新的同名型号
- 4该版本的历史官方价;当前滚动版本价格可能不同
- 5标准档,优先级档与弹性档另计
- 6六张地域价目表里最低的那一档
- 7输入长度最低的那一档,提示词更长则单价更高
- 8限时促销价,标价高于此
我们便宜在哪里
差价来自充值汇率,不是来自压低的标价
把我们的额度价当成美元读,它基本就贴在各厂商自己的标价上——能对上参考价的那几个落在厂商标价的 0.682× 到 1.77× 之间。差价几乎全部来自 1:10 的充值汇率。
与厂商官方价现金对现金地比,能对上参考价的模型在输入价上便宜 5.65× 到 14.7×。
我们更贵的场景
这两种情况不该用我们
持续命中提示词缓存的场景
DeepSeek 对 deepseek/deepseek-v4.1-flash 缓存命中的输入价是每 1M $0.003,我们同型号的现金价是 $0.02。DeepSeek 对 deepseek/deepseek-v4-pro 缓存命中的输入价是每 1M $0.022,我们同型号的现金价是 $0.05。OpenAI 对 openai/gpt-5.6-luna 缓存命中的输入价是每 1M $0.02,我们同型号的现金价是 $0.03。OpenAI 对 openai/gpt-5.6-sol 缓存命中的输入价是每 1M $0.40,我们同型号的现金价是 $0.50。我们完全没有缓存命中这一档。如果你在反复重放一段又长又稳定的系统提示词,直连厂商可能比走我们更便宜。
清单之外的模型
我们的清单是 20 个模型 ID。Gemini 不在其中,聚合平台上的大部分长尾模型也不在。需要的模型不在清单上时,价格再便宜也没有意义。
缺口
覆盖范围与计价限制
- 模型覆盖范围
- 表格已覆盖全部 16 个付费模型。历史版本价格和计费档位在对应价格旁标注。
- 阿里云没有「一个」Qwen 价格
- Model Studio 把同一个版本切成六张地域价目表,再按输入长度切档,一部分版本限时打折、另一部分夜间打折,缓存命中还单独计费而页面上压根没写那一档的单价。官方价这一列取的是一次普通实时调用能拿到的最便宜的格子——最便宜的地域、最短输入档、限时折后、缓存未命中——也就是对我们最不利的那种读法。夜间档是故意没采的:英文页写「night 80% off」,中文口径读起来是「夜间 8 折」,一个是付两成一个是付八成,我们不去挑对自己有利的那一种读法。
- 全表没有采用任何第三方数字
- 仅一个 DeepSeek 型号,就能在三篇被广泛引用的文章里查到三个互相矛盾的价格。这里只承认对方自己的定价页。
- 聚合平台之间能差到 2×
- 表里 deepseek/deepseek-v4-pro 那一行,输入价在 OpenRouter 是每 1M $0.6587,在 Together AI 是 $1.32——同一个模型、同一个单位,都读自各家自己的定价页。任何单一聚合平台的数字都只是一个数据点,不是「市场价」。
一家一页
与单独一家的对比
这张表宽而浅:每格一个数字,容不下任何一家的计价结构。下面每一页只对一家,反方向做一遍——双方都在卖的每个型号、每个数字背后的档位、读到它的日期,以及对方比我们更便宜的那些场景。
常见问题
这张表会引出的问题
- 调用 deepseek/deepseek-v4-pro 最便宜的方式是哪一种?
- 每 1M 输入 token,每个数字都读于 2026-08-26 或之后:Y-API 实付 $0.05,DeepSeek 自己的 API $0.66,OpenRouter $0.6587(那边叫 deepseek/deepseek-v4-pro-0813)、Together AI $1.32(那边叫 DeepSeek V4 Pro 0813)、DeepInfra $1.30(那边叫 deepseek-ai/DeepSeek-V4-Pro)。唯一会翻转的情况是提示词持续命中缓存——DeepSeek 对缓存命中的输入价是每 1M $0.022,低于我们的 $0.05。
- 为什么 Y-API 标的是额度价而不是美元?
- 额度是服务内部的计量单位:充值把美元按当期汇率换成额度,各模型再按 token 扣减额度。标额度价能让汇率变动时每个模型的数字保持稳定。要换算成现金价,把额度价除以当前汇率即可——现在是 10。额度价与汇率都是公开的,现金价也在机器可读的价格接口里。
- 聚合平台会比模型厂商自己更便宜吗?
- 会,这张表里就有一例。OpenRouter 上 deepseek/deepseek-v4-pro-0813 的输入价是每 1M $0.6587,低于 DeepSeek 自己的 $0.66。但聚合平台有时只上架带日期的快照版本,它不会随滚动更新的同名型号一起升级——便宜,但不是同一个东西。
- 这里面有多少是真降价,多少只是充值优惠?
- 几乎全部是充值优惠。把额度价当美元来比,我们的价格落在厂商标价的 0.682× 到 1.77× 之间。表里那些大倍数来自 1:10 的充值汇率。
- 这张表多久更新一次?
- 每个数字都带核实日期,标在页面顶部。各家调价不另行通知,所以超过几周的数据只能当起点看,真要投入预算前请先点开出处。我们自己的价格在构建时从线上清单同步,因此不会比最近一次部署更旧。
出处
数据来源
出处包括各平台定价页与特定版本的调价公告。本站价格见模型页、价格页和 pricing.json。