Y-API 与 Together AI 对比

Together AI 是另一家转售同样这些厂商模型的网关,所以这里不是两家厂商之争,而是一个问题:两边都卖的那 2 个型号,走 Y-API 是不是更便宜。下表两列都是每 100 万输入 tokens 的现金价,Together AI 那一列取我们在其价目表上能找到的最低档——因此每个倍数都是下限,不是标题。

Y-API 与 Together AI 在现金价、型号覆盖与计费方式上的对比
API 协议Y-APIOpenAI Chat Completions。把 base_url 指向 https://api.y-api.bestvirtualgoods.com/v1,换掉密钥,其余代码不动。Together AI它自己的一个 OpenAI 兼容端点,base_url 不同,模型名也不同——见下面每个型号那一行。
一个密钥能调多少型号Y-API10 个型号 ID,来自 6 家厂商,一个余额,一个密钥。Together AI它自己公布的目录。我们拿去与它比的 10 个型号里,那上面有价的是 2 个。
qwen/qwen3.8-max — 输入 / 100 万 tokensY-API现金 $0.10Together AI$2.50,那边叫 Qwen3.8-2.4T-A95B,是我们的 25×(对方以另一个名字上架)
deepseek/deepseek-v4-flash — 输入 / 100 万 tokensY-API现金 $0.0075Together AI$0.14,那边叫 DeepSeek V4 Flash 0731,是我们的 18.7×(带日期的快照版本,不是滚动更新的同名型号)
充值换算Y-API限时:1 美元换 $20 账户额度,再按每个模型自己的单价扣减。优惠结束后回到 1:10。Together AI按标价付现金。没有额度倍率,也没有会过期的东西。
缓存命中计价Y-API没有缓存折扣。重复的 prompt 与全新的 prompt 一样计费。Together AI上面这几行它没公布缓存命中价,所以两列都按每次请求都不命中算。如果 Together AI 在价目表之外对缓存命中打折,这个差距会收窄。
它没有报价的型号Y-API10 个全都能用同一个密钥调。Together AI我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。

对我们不利

Together AI 更便宜的地方

只往一个方向算的对比就是广告。以下每条的数字都取自与上表同一份价目表。

我们完全没有缓存折扣

prompt 与上一次一字不差,也照全价计费。长而固定的系统提示词、反复传入的文档上下文,正是这一点最吃亏的地方。

有几行两边并不是同一个 build

我们拿qwen/qwen3.8-max 对它的 Qwen3.8-2.4T-A95B、deepseek/deepseek-v4-flash 对它的 DeepSeek V4 Flash 0731。这个对应关系是我们按厂商、参数规模与发布时间判断的,不是对方的说法。价格可比,行为未必。在意就把模型 ID 钉住,自己测一遍。

差距的大部分来自充值汇率,不是模型单价

我们的目录单价按额度读,与 Together AI 的现金标价相差不大。上面那个差距几乎全部来自 1 美元换 $20 额度。回到 1:10 之后,同样的对比变成qwen/qwen3.8-max 差 12.5×、deepseek/deepseek-v4-flash 差 9.33×。

Together AI 卖的型号比我们多得多

它的目录覆盖我们完全没有的厂商与开源权重模型,还能在某一家挂掉时绕开它。我们这 10 个是刻意收窄的清单;你要的模型不在里面,我们别的型号多便宜都与你无关。

适用场景

该走哪一边

这些情况走 Y-API

  • 你的输入大部分是新内容——现在的充值汇率下,差距是qwen/qwen3.8-max 差 25×、deepseek/deepseek-v4-flash 差 18.7×。
  • 你想用一个余额、一个密钥调 6 家厂商的 10 个型号,而不是每家开一个账号。

这些情况走 Together AI

  • 你要的模型不在我们这 10 个里,或者你要的是某一家挂掉时自动切换。
  • 你要一个不依赖促销的价格。我们现在是 1 美元换 $20 额度,之后回到 1:10;它两种情况下都是按标价付现金。
  • 你希望计费关系、SLA 与技术支持都在 Together AI 手上,而不是在一个转售方手上。

常见问题

切换前会问的几个问题

Y-API 比 Together AI 便宜吗?
新输入上便宜:qwen/qwen3.8-max 是 $0.10,它那边 $2.50、deepseek/deepseek-v4-flash 是 $0.0075,它那边 $0.14。两条边界要一起说:它那一列永远取它公布的最低档,所以每个倍数都是下限而不是峰值;而这个差距依赖限时的 1:20 充值汇率,回到 1:10 后大致减半。
为什么会更便宜——你们是低于它的价拿货吗?
不是,这里得说实话。我们的目录单价按额度读,与 Together AI 的现金标价相差不大,差距几乎全部来自充值换算:促销期内 1 美元买到 $20 额度。请把它当成一个已公布回落时间的促销汇率(回到 1:10),不是结构性的便宜。
Together AI 对我们哪些型号报了价?
我们 10 个里的 2 个,附上它那边的名字:qwen/qwen3.8-max(那边叫 Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(那边叫 DeepSeek V4 Flash 0731)。上表也只有这几行——只有一边有公开价的那一行不是对比。
它没报价的那些型号呢?
我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。「我们没查」与「它没有」这两句一直分开说:前一句只关于我们自己,后一句是对它下的断言,没核实过就不说。
它那边的型号是不是同一个 build?
qwen/qwen3.8-max(那边是 Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(那边是 DeepSeek V4 Flash 0731)不是——带日期的快照,或者换了名字的另一个 build,按厂商、参数规模与发布时间对应上的。价格照比,别默认行为一致。
我的代码要改多少?
base_url、密钥、模型名。两边都说 OpenAI Chat Completions,请求体其余部分一个字不用动——我们的型号名带前缀,例如 qwen/qwen3.8-max。

出处

信息来源

本页 Together AI 的每个数字都于 2026-08-26 读自下面这个页面,取其公布的最低档。我们自己的数字在价格页与条款页上。

挑一个请求指过来

在你已经在跑的某一个请求上,改掉 base_url、密钥和模型名。在你动别的东西之前,请求日志会告诉你它到底花多少。