LLM API 成本计算器

选一个模型,填入你一个月实际跑掉的输入与输出 token,这一页会同时算出这个月在 5 个地方各要付多少。输出 token 按输出价计费,不按输入价——在对话类负载上,这个区别值几倍账单。每一行都给出它用的单价,所以你可以核对那道乘法,而不是选择相信。

你的月用量

我们 10 个模型里有 3 个能对上核实过的外部价格。其余的在价格页上标了价——我们宁愿把一个模型从这个列表里去掉,也不拿一个查不到出处的数字跟它比。

按 10M tokens 计算

按 2M tokens 计算

支持简写:10M、250k、1.5B。不知道自己的数字的话,控制台的用量日志会逐次请求给出两个计数,各平台的仪表盘也都有月度合计。

这个月要花多少

美元 / 1M tokens

同样的 token 用量在 deepseek/deepseek-v4-flash 上,于 Y-API、模型厂商与三家聚合平台各自的月成本
Y-API你在这里每月$0.105单价输入 $0.0075 · 输出 $0.015 每 1M
OpenRouterdeepseek/deepseek-v4-flash-0731每月$0.843带日期的快照版本,不是滚动更新的同名型号单价输入 $0.06 · 输出 $0.12 每 1M
DeepInfradeepseek-ai/DeepSeek-V4-Flash每月$1.264标准档,优先级档与弹性档另计单价输入 $0.09 · 输出 $0.18 每 1M
Together AIDeepSeek V4 Flash 0731每月$1.963带日期的快照版本,不是滚动更新的同名型号单价输入 $0.14 · 输出 $0.28 每 1M
DeepSeek最贵deepseek-v4-flash每月$3.521,2低谷时段价; 另有更便宜的缓存命中档单价输入 $0.22 · 输出 $0.66 每 1M

有价那几行里最贵的一家要 $3.52,相当于这张账单的 33.5×。

这个模型我们查了 4 个地方,其中 4 个对上了价格。没有数字的那几行会说明是两种原因里的哪一种。

20:1 的充值汇率是限时的。按常规的 1:10 算,同样这个月在这里要 $0.21。已经在账户里的额度不会重新计价。

  • 1低谷时段价
  • 2另有更便宜的缓存命中档
  • 3带日期的快照版本,不是滚动更新的同名型号
  • 4标准档,优先级档与弹性档另计

算法

这张账单是怎么算出来的

输入与输出分开计价
这张表里每一家平台上,输出 token 都是输入 token 的二到四倍。把所有 token 按输入价计费的计算器会把对话类负载算低一大截,所以这里两个计数都要,两档价格都用。
我们这一行是现金,不是额度
我们的价格以美元额度标价,目前充 $1 得到 $20 额度。我们这一行除以 20,换成真正从你卡里扣走的美元——那也是其余各行唯一的单位。
取对方公开的最便宜那一档
一家平台标了多档时,取适用于一次普通实时调用的最便宜那档:谷价而非峰价、标准档而非优先级档、最便宜的地域、最短输入长度档、限时折扣之后的价。缓存命中价一律不算,包括我们自己的。每一处这样的取舍都在表下标出,而且每一处都对对方有利。
没有任何估算
一行要么有一个从对方自己价格页上读来的数字,要么就说明没有。不做平均、不写「约」、不用第三方文章里的数字——单是某一个 DeepSeek 模型,三篇被广泛引用的文章就给出三个互不相容的价格。

边界

这个数字没有包含什么

提示词缓存

厂商 API 对缓存命中的输入收费远低于未命中价,而我们没有对应的档。如果你把一段很长、很稳定的系统提示词重放上千次,厂商那边可能比我们便宜——这个计算器不会显示出来,因为它两边都按未命中计价。

推理 token

在推理模型上,计费但从不出现在回复里的 token 不在你的输出计数里。探针测到有一个模型按其输出上限的 21.8 倍计费。如果你调的是推理模型,把填进去的输出数字当成下限。

除 token 以外的一切

这张表里没有一家收月费,所以账单只有 token。这也意味着这里的算术完全没有说到限流、延迟,以及某家平台到底有哪些模型——而这几样通常才是决定选择的东西。

常见问题

关于这道计算的问题

为什么必须分开填输入和输出 token?
因为每一家都把两者分开定价,通常差二到四倍。只给一个「总 token」输入框,就得替你假设一个输入输出比,而对负载不符合这个比例的人来说,账单会大致按那个倍数错掉。打开时显示的默认场景是 5:1,接近典型的对话或 RAG 负载——你自己的日志会告诉你真实比例。
为什么 Y-API 的账单低这么多?
几乎全是充值汇率。把我们的额度价直接当美元读,它大致就压在厂商自己的标价上;你看到的差距是 20:1 这个「一美元换多少额度」的比率。这个比率是限时的,会回到 1:10,那会让我们的数字翻倍——表下那一行显示的就是那时候这个月要多少。
为什么有些行是空的?
两种完全不同的原因,表里从不把它们合并。一种是对方根本没有这个模型。另一种是我们没在对方自己的价格页上核实到价格——不代表那个模型用不了,也不代表它便宜。拿二手来源把哪一种填上,都会让总额看起来完整,同时是错的。
这些价格有多新?
每个外部数字都是从对方自己的价格页上读来的;这些读数里最旧的一次是 2026-08-26,也就是页面顶部显示的那个日期。我们自己的价格在构建时从线上目录来,所以不会比上一次部署更旧。各平台确实会不提前通知就调价,所以真要做重要的决定,打开出处链接确认一下。

出处

价格从哪里来

这个计算器里的每个外部数字都和全市场对比表出自同一份数据集,那张表按平台逐一列出出处链接以及读取日期。

拿一次真实请求核对这道算术

验证这一切最快的办法是发一次调用。登录、发一个请求,用量日志会给出确切的 token 计数和确切的扣费——那就是这一页刚做完的同一道乘法。