Y-API と Together AI の比較

Together AI は同じベンダーのモデルを再販しているもう一つのゲートウェイです。つまりこれはベンダー同士の争いではなく、一つの問いです——両社が扱う 2 モデルについて、Y-API を通したほうが安いのか。下表の 2 列はいずれも入力 100 万トークンあたりの現金価格で、Together AI 側は同社の価格表で見つけられた最も安い区分です。したがって倍率はすべて下限であり、見出し用の数字ではありません。

Y-API と Together AI を現金価格・モデル網羅・課金の区分で比較
API プロトコルY-APIOpenAI Chat Completions。base_url を https://api.y-api.bestvirtualgoods.com/v1 に向け、キーを差し替えれば、ほかのコードは変えません。Together AI同社独自の OpenAI 互換エンドポイント。base_url もモデル名も異なります——モデルごとの行をご覧ください。
1 つのキーで呼べるモデルY-API6 ベンダーの 10 モデル ID を、残高 1 つ・キー 1 つで。Together AI同社が公開しているカタログ。当社が比較対象にした 10 モデルのうち、価格が載っているのは 2 モデルです。
qwen/qwen3.8-max — 入力 / 100 万トークンY-API現金 $0.10Together AI$2.50(同社名 Qwen3.8-2.4T-A95B)、当社価格の 25×(別の名称で掲載)
deepseek/deepseek-v4-flash — 入力 / 100 万トークンY-API現金 $0.0075Together AI$0.14(同社名 DeepSeek V4 Flash 0731)、当社価格の 18.7×(日付付きスナップショット版。ローリング更新版とは別物)
チャージの換算Y-API期間限定:1 ドルが $20 分のアカウントクレジットになり、そこから各モデルの単価で引かれます。終了後は 1:10 に戻ります。Together AI表示価格を現金で支払います。クレジット倍率はなく、失効するものもありません。
キャッシュヒット時の料金Y-APIキャッシュ割引はありません。同じプロンプトでも新規と同じように課金されます。Together AI上の行について同社はキャッシュヒット価格を公開していないため、両列とも毎回キャッシュミスとして計算しています。Together AI が料金表の外でキャッシュヒットを割引しているなら、差は縮まります。
同社が価格を出していないモデルY-API10 モデルすべてが同じキーで呼べます。Together AI探したものの同社のカタログに見つからなかったのが 1 モデル(xiaomi/mimo-v2.5)、まだ照合していないのが 7 モデルです。

当社に不利な点

Together AI のほうが安い場面

片方向にしか計算しない比較は広告です。以下の数値はすべて上表と同じ価格表から取っています。

キャッシュ割引が一切ありません

直前と一字も違わないプロンプトでも、満額で課金されます。長く固定されたシステムプロンプトや、繰り返し渡す文書コンテキストは、まさにここで損をします。

一部の行は両側で同じビルドではありません

qwen/qwen3.8-max は同社の Qwen3.8-2.4T-A95B と対比、deepseek/deepseek-v4-flash は同社の DeepSeek V4 Flash 0731 と対比しています。この対応付けはベンダー・パラメータ規模・リリース時期から当社が判断したもので、同社の主張ではありません。価格は比較できますが、挙動は同じとは限りません。気になる場合はモデル ID を固定してご自身で試してください。

差の大半はチャージレートであり、モデル単価ではありません

当社のカタログ単価をクレジットとして読むと、Together AI の現金表示価格に近い水準です。上の差はほぼすべて、1 ドルが $20 分のクレジットになることから来ています。1:10 に戻れば、同じ比較はqwen/qwen3.8-max が 12.5×、deepseek/deepseek-v4-flash が 9.33×になります。

Together AI は当社よりはるかに多くのモデルを扱っています

同社のカタログには、当社が一切扱っていないベンダーやオープンウェイトのモデルが含まれ、あるプロバイダが落ちたときに迂回することもできます。当社の 10 モデルは意図的に絞った一覧です。必要なモデルがそこに無ければ、ほかのモデルの価格はあなたには関係ありません。

向き不向き

どちらを呼ぶべきか

Y-API を通すのはこんな場合

  • 入力の大半が新規で、現在のチャージレートでの差がqwen/qwen3.8-max で 25×、deepseek/deepseek-v4-flash で 18.7×になる場合。
  • ベンダーごとにアカウントを持つのではなく、6 ベンダーの 10 モデルを残高 1 つ・キー 1 つで扱いたい場合。

Together AI を選ぶのはこんな場合

  • 当社の 10 モデルの外にあるモデルが必要な場合、あるいはどこかが落ちたときの自動フォールバックが欲しい場合。
  • プロモーションに依存しない価格が欲しい場合。当社は今 1 ドル → $20 分のクレジットで、その後 1:10 に戻ります。同社はどちらの時期でも表示価格の現金払いです。
  • 課金関係・SLA・サポートを、再販業者ではなく Together AI と直接持ちたい場合。

よくある質問

移行前によく聞かれること

Y-API は Together AI より安いですか?
新規入力なら安くなります:qwen/qwen3.8-max は当社 $0.10 に対し同社 $2.50、deepseek/deepseek-v4-flash は当社 $0.0075 に対し同社 $0.14。ただし前提が 2 つあります。同社側は常に公開されている最も安い区分なので、各倍率は上限ではなく下限です。そしてこの差は期間限定の 1:20 チャージレートに依存し、1:10 に戻るとおおよそ半分になります。
なぜ安いのですか——仕入れ値が向こうの価格より低いのですか?
いいえ。ここは正直に書きます。当社のカタログ単価をクレジットとして読むと Together AI の現金表示価格に近く、差はほぼすべてチャージの換算から来ています——プロモーション期間中、1 ドルで $20 分のクレジットが買えます。構造的な割安さではなく、戻る時期が告知されているプロモーションレート(1:10 に戻る)として扱ってください。
Together AI は当社のどのモデルに価格を出していますか?
当社の 10 モデルのうち 2 モデルです。同社側の名称も併記します:qwen/qwen3.8-max(同社では Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(同社では DeepSeek V4 Flash 0731)。上表の行もこれだけです——片側にしか公開価格が無い行は比較になりません。
同社が価格を出していないモデルはどうなりますか?
探したものの同社のカタログに見つからなかったのが 1 モデル(xiaomi/mimo-v2.5)、まだ照合していないのが 7 モデルです。「当社が確認していない」と「同社が扱っていない」は常に分けて書きます。前者は当社自身についての話ですが、後者は同社についての断定なので、確認できていないかぎり書きません。
同社側のモデルは文字どおり同じビルドですか?
qwen/qwen3.8-max(同社では Qwen3.8-2.4T-A95B)、deepseek/deepseek-v4-flash(同社では DeepSeek V4 Flash 0731)は違います——日付付きのスナップショット、あるいは別名の別ビルドで、ベンダー・パラメータ規模・リリース日から対応付けたものです。価格は比較してかまいませんが、挙動が同じだと決めつけないでください。
コードはどれだけ変える必要がありますか?
base_url とキーとモデル名です。両者とも OpenAI Chat Completions を話すので、リクエストボディのほかの部分は変わりません——当社のモデル名には接頭辞が付きます(例:qwen/qwen3.8-max)。

出典

情報源

本ページの Together AI の数値はすべて 2026-08-26 に下記のページから、公開されている最も安い区分で読み取ったものです。当社側の数値は料金ページと利用規約に記載しています。

リクエストを 1 本だけ向けてみる

すでに動いているリクエスト 1 本の base_url とキーとモデル名だけを変えてみてください。ほかを動かす前に、リクエストログが実際の費用を教えてくれます。