Y-API 与 Together AI 对比
Together AI 是另一家转售同样这些厂商模型的网关,所以这里不是两家厂商之争,而是一个问题:两边都卖的那 2 个型号,走 Y-API 是不是更便宜。下表两列都是每 100 万输入 tokens 的现金价,Together AI 那一列取我们在其价目表上能找到的最低档——因此每个倍数都是下限,不是标题。
| 对比项 | Y-API | Together AI |
|---|---|---|
| API 协议 | Y-APIOpenAI Chat Completions。把 base_url 指向 https://api.y-api.bestvirtualgoods.com/v1,换掉密钥,其余代码不动。 | Together AI它自己的一个 OpenAI 兼容端点,base_url 不同,模型名也不同——见下面每个型号那一行。 |
| 一个密钥能调多少型号 | Y-API10 个型号 ID,来自 6 家厂商,一个余额,一个密钥。 | Together AI它自己公布的目录。我们拿去与它比的 10 个型号里,那上面有价的是 2 个。 |
| qwen/qwen3.8-max — 输入 / 100 万 tokens | Y-API现金 $0.10 | Together AI$2.50,那边叫 Qwen3.8-2.4T-A95B,是我们的 25×(对方以另一个名字上架) |
| deepseek/deepseek-v4-flash — 输入 / 100 万 tokens | Y-API现金 $0.0075 | Together AI$0.14,那边叫 DeepSeek V4 Flash 0731,是我们的 18.7×(带日期的快照版本,不是滚动更新的同名型号) |
| 充值换算 | Y-API限时:1 美元换 $20 账户额度,再按每个模型自己的单价扣减。优惠结束后回到 1:10。 | Together AI按标价付现金。没有额度倍率,也没有会过期的东西。 |
| 缓存命中计价 | Y-API没有缓存折扣。重复的 prompt 与全新的 prompt 一样计费。 | Together AI上面这几行它没公布缓存命中价,所以两列都按每次请求都不命中算。如果 Together AI 在价目表之外对缓存命中打折,这个差距会收窄。 |
| 它没有报价的型号 | Y-API10 个全都能用同一个密钥调。 | Together AI我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。 |
对我们不利
Together AI 更便宜的地方
只往一个方向算的对比就是广告。以下每条的数字都取自与上表同一份价目表。
我们完全没有缓存折扣
prompt 与上一次一字不差,也照全价计费。长而固定的系统提示词、反复传入的文档上下文,正是这一点最吃亏的地方。
有几行两边并不是同一个 build
我们拿qwen/qwen3.8-max 对它的 Qwen3.8-2.4T-A95B、deepseek/deepseek-v4-flash 对它的 DeepSeek V4 Flash 0731。这个对应关系是我们按厂商、参数规模与发布时间判断的,不是对方的说法。价格可比,行为未必。在意就把模型 ID 钉住,自己测一遍。
差距的大部分来自充值汇率,不是模型单价
我们的目录单价按额度读,与 Together AI 的现金标价相差不大。上面那个差距几乎全部来自 1 美元换 $20 额度。回到 1:10 之后,同样的对比变成qwen/qwen3.8-max 差 12.5×、deepseek/deepseek-v4-flash 差 9.33×。
Together AI 卖的型号比我们多得多
它的目录覆盖我们完全没有的厂商与开源权重模型,还能在某一家挂掉时绕开它。我们这 10 个是刻意收窄的清单;你要的模型不在里面,我们别的型号多便宜都与你无关。
适用场景
该走哪一边
这些情况走 Y-API
- 你的输入大部分是新内容——现在的充值汇率下,差距是qwen/qwen3.8-max 差 25×、deepseek/deepseek-v4-flash 差 18.7×。
- 你想用一个余额、一个密钥调 6 家厂商的 10 个型号,而不是每家开一个账号。
这些情况走 Together AI
- 你要的模型不在我们这 10 个里,或者你要的是某一家挂掉时自动切换。
- 你要一个不依赖促销的价格。我们现在是 1 美元换 $20 额度,之后回到 1:10;它两种情况下都是按标价付现金。
- 你希望计费关系、SLA 与技术支持都在 Together AI 手上,而不是在一个转售方手上。
常见问题
切换前会问的几个问题
- Y-API 比 Together AI 便宜吗?
- 新输入上便宜:qwen/qwen3.8-max 是 $0.10,它那边 $2.50、deepseek/deepseek-v4-flash 是 $0.0075,它那边 $0.14。两条边界要一起说:它那一列永远取它公布的最低档,所以每个倍数都是下限而不是峰值;而这个差距依赖限时的 1:20 充值汇率,回到 1:10 后大致减半。
- 为什么会更便宜——你们是低于它的价拿货吗?
- 不是,这里得说实话。我们的目录单价按额度读,与 Together AI 的现金标价相差不大,差距几乎全部来自充值换算:促销期内 1 美元买到 $20 额度。请把它当成一个已公布回落时间的促销汇率(回到 1:10),不是结构性的便宜。
- Together AI 对我们哪些型号报了价?
- 我们 10 个里的 2 个,附上它那边的名字:qwen/qwen3.8-max(那边叫 Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(那边叫 DeepSeek V4 Flash 0731)。上表也只有这几行——只有一边有公开价的那一行不是对比。
- 它没报价的那些型号呢?
- 我们查过、其目录里确实没有的有 1 个(xiaomi/mimo-v2.5);我们还没拿去核对的有 7 个。「我们没查」与「它没有」这两句一直分开说:前一句只关于我们自己,后一句是对它下的断言,没核实过就不说。
- 它那边的型号是不是同一个 build?
- qwen/qwen3.8-max(那边是 Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(那边是 DeepSeek V4 Flash 0731)不是——带日期的快照,或者换了名字的另一个 build,按厂商、参数规模与发布时间对应上的。价格照比,别默认行为一致。
- 我的代码要改多少?
- base_url、密钥、模型名。两边都说 OpenAI Chat Completions,请求体其余部分一个字不用动——我们的型号名带前缀,例如 qwen/qwen3.8-max。
出处
信息来源
本页 Together AI 的每个数字都于 2026-08-26 读自下面这个页面,取其公布的最低档。我们自己的数字在价格页与条款页上。