Y-API 与 DeepInfra 对比
DeepInfra 是另一家转售同样这些厂商模型的网关,所以这里不是两家厂商之争,而是一个问题:两边都卖的那 2 个型号,走 Y-API 是不是更便宜。下表两列都是每 100 万输入 tokens 的现金价,DeepInfra 那一列取我们在其价目表上能找到的最低档——因此每个倍数都是下限,不是标题。
| 对比项 | Y-API | DeepInfra |
|---|---|---|
| API 协议 | Y-APIOpenAI Chat Completions。把 base_url 指向 https://api.y-api.bestvirtualgoods.com/v1,换掉密钥,其余代码不动。 | DeepInfra它自己的一个 OpenAI 兼容端点,base_url 不同,模型名也不同——见下面每个型号那一行。 |
| 一个密钥能调多少型号 | Y-API10 个型号 ID,来自 6 家厂商,一个余额,一个密钥。 | DeepInfra它自己公布的目录。我们拿去与它比的 10 个型号里,那上面有价的是 2 个。 |
| qwen/qwen3.8-max — 输入 / 100 万 tokens | Y-API现金 $0.10 | DeepInfra$1.65,那边叫 Qwen/Qwen3.8-Max,是我们的 16.5×(标准档,优先级档与弹性档另计) |
| deepseek/deepseek-v4-flash — 输入 / 100 万 tokens | Y-API现金 $0.0075 | DeepInfra$0.09,那边叫 deepseek-ai/DeepSeek-V4-Flash,是我们的 12×(标准档,优先级档与弹性档另计) |
| 充值换算 | Y-API限时:1 美元换 $20 账户额度,再按每个模型自己的单价扣减。优惠结束后回到 1:10。 | DeepInfra按标价付现金。没有额度倍率,也没有会过期的东西。 |
| 计费方式怎么分档 | Y-API每个模型一个价——不看时段、不看地域、不看单次请求。 | DeepInfra上面的数字都落在档位里:标准档,优先级档与弹性档另计。我们引的是其中最便宜的那一档。 |
| 缓存命中计价 | Y-API没有缓存折扣。重复的 prompt 与全新的 prompt 一样计费。 | DeepInfra上面这几行它没公布缓存命中价,所以两列都按每次请求都不命中算。如果 DeepInfra 在价目表之外对缓存命中打折,这个差距会收窄。 |
| 它没有报价的型号 | Y-API10 个全都能用同一个密钥调。 | DeepInfra我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。 |
对我们不利
DeepInfra 更便宜的地方
只往一个方向算的对比就是广告。以下每条的数字都取自与上表同一份价目表。
我们完全没有缓存折扣
prompt 与上一次一字不差,也照全价计费。长而固定的系统提示词、反复传入的文档上下文,正是这一点最吃亏的地方。
差距的大部分来自充值汇率,不是模型单价
我们的目录单价按额度读,与 DeepInfra 的现金标价相差不大。上面那个差距几乎全部来自 1 美元换 $20 额度。回到 1:10 之后,同样的对比变成qwen/qwen3.8-max 差 8.25×、deepseek/deepseek-v4-flash 差 6×。
DeepInfra 卖的型号比我们多得多
它的目录覆盖我们完全没有的厂商与开源权重模型,还能在某一家挂掉时绕开它。我们这 10 个是刻意收窄的清单;你要的模型不在里面,我们别的型号多便宜都与你无关。
适用场景
该走哪一边
这些情况走 Y-API
- 你的输入大部分是新内容——现在的充值汇率下,差距是qwen/qwen3.8-max 差 16.5×、deepseek/deepseek-v4-flash 差 12×。
- 你想用一个余额、一个密钥调 6 家厂商的 10 个型号,而不是每家开一个账号。
- 你不想去记自己这一次是按哪个档、哪个地域、哪个时段计费的。我们每个模型只有一个价。
这些情况走 DeepInfra
- 你要的模型不在我们这 10 个里,或者你要的是某一家挂掉时自动切换。
- 你要一个不依赖促销的价格。我们现在是 1 美元换 $20 额度,之后回到 1:10;它两种情况下都是按标价付现金。
- 你希望计费关系、SLA 与技术支持都在 DeepInfra 手上,而不是在一个转售方手上。
常见问题
切换前会问的几个问题
- Y-API 比 DeepInfra 便宜吗?
- 新输入上便宜:qwen/qwen3.8-max 是 $0.10,它那边 $1.65、deepseek/deepseek-v4-flash 是 $0.0075,它那边 $0.09。两条边界要一起说:它那一列永远取它公布的最低档,所以每个倍数都是下限而不是峰值;而这个差距依赖限时的 1:20 充值汇率,回到 1:10 后大致减半。
- 为什么会更便宜——你们是低于它的价拿货吗?
- 不是,这里得说实话。我们的目录单价按额度读,与 DeepInfra 的现金标价相差不大,差距几乎全部来自充值换算:促销期内 1 美元买到 $20 额度。请把它当成一个已公布回落时间的促销汇率(回到 1:10),不是结构性的便宜。
- DeepInfra 对我们哪些型号报了价?
- 我们 10 个里的 2 个,附上它那边的名字:qwen/qwen3.8-max(那边叫 Qwen/Qwen3.8-Max)、deepseek/deepseek-v4-flash(那边叫 deepseek-ai/DeepSeek-V4-Flash)。上表也只有这几行——只有一边有公开价的那一行不是对比。
- 它没报价的那些型号呢?
- 我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。「我们没查」与「它没有」这两句一直分开说:前一句只关于我们自己,后一句是对它下的断言,没核实过就不说。
- 我的代码要改多少?
- base_url、密钥、模型名。两边都说 OpenAI Chat Completions,请求体其余部分一个字不用动——我们的型号名带前缀,例如 qwen/qwen3.8-max。
出处
信息来源
本页 DeepInfra 的每个数字都于 2026-08-26 读自下面这个页面,取其公布的最低档。我们自己的数字在价格页与条款页上。