Y-API gegen Together AI
Together AI ist ein weiteres Gateway, das die Modelle derselben Anbieter weiterverkauft, das hier sind also nicht zwei konkurrierende Labore, sondern eine einzige Frage. Kostet es für die 2 Modelle, die beide verkaufen, über Y-API weniger? Beide Spalten unten sind bar pro 1 Mio. Eingabe-Tokens, und die Spalte von Together AI ist die günstigste Stufe, die wir auf dessen eigener Preisliste gefunden haben — jeder Faktor ist damit eine Untergrenze und keine Schlagzeile.
| Dimension | Y-API | Together AI |
|---|---|---|
| API-Protokoll | Y-APIOpenAI Chat Completions. base_url auf https://api.y-api.bestvirtualgoods.com/v1 zeigen, Schlüssel tauschen, den restlichen Code so lassen. | Together AIEin eigener OpenAI-kompatibler Endpunkt, unter anderer base_url und mit anderen Modellnamen — siehe die Zeile zu jedem Modell unten. |
| Modelle an einem Schlüssel | Y-API10 Modell-IDs von 6 Anbietern, ein Guthaben, ein Schlüssel. | Together AIDessen eigener veröffentlichter Katalog. Von den 10 Modellen, die wir dagegen vergleichen, sind dort 2 bepreist. |
| qwen/qwen3.8-max — Eingabe / 1 Mio. Tokens | Y-API$0.10 in bar | Together AI$2.50 als Qwen3.8-2.4T-A95B — 25× unser Preis (unter anderem Namen gelistet) |
| deepseek/deepseek-v4-flash — Eingabe / 1 Mio. Tokens | Y-API$0.0075 in bar | Together AI$0.14 als DeepSeek V4 Flash 0731 — 18.7× unser Preis (datierter Snapshot-Build, nicht das rollierende Modell) |
| Was eine Aufladung wird | Y-APIZeitlich begrenzt: 1 Dollar wird zu $20 Kontoguthaben, danach wird das Guthaben zum jeweiligen Modellsatz abgezogen. Danach zurück auf 1:10. | Together AIDu zahlst den Listenpreis in bar. Es gibt keinen Guthaben-Multiplikator und nichts, was verfällt. |
| Preis bei Cache-Treffern | Y-APIKein Cache-Rabatt. Ein wiederholter Prompt wird genau wie ein neuer abgerechnet. | Together AIFür die Zeilen oben ist kein Satz für Cache-Eingaben veröffentlicht, beide Spalten nehmen daher an, dass jeder Request den Cache verfehlt. Wenn Together AI Cache-Treffer außerhalb der Preisliste rabattiert, schrumpft der Abstand. |
| Modelle ohne Preis dort | Y-APIAlle 10 sind über denselben Schlüssel aufrufbar. | Together AIEin Modell, das wir gesucht und nicht gefunden haben (xiaomi/mimo-v2.5); 7 Modelle, die wir noch nicht gegen dessen Katalog geprüft haben. |
Zu unseren Ungunsten
Wo Together AI günstiger ist
Ein Vergleich, der nur in eine Richtung rechnet, ist Werbung. Alles hier unten stammt aus derselben Preisliste wie die Angaben oben.
Wir haben überhaupt keinen Cache-Rabatt
Jeder Request wird zum vollen Satz abgerechnet, egal ob der Prompt mit dem letzten identisch ist. Lange feste System-Prompts und wiederholt mitgeschickter Dokumentkontext sind genau die Stelle, an der das weh tut.
Einige Zeilen sind auf beiden Seiten nicht derselbe Build
Wir vergleichen qwen/qwen3.8-max gegen dessen Qwen3.8-2.4T-A95B und deepseek/deepseek-v4-flash gegen dessen DeepSeek V4 Flash 0731. Diese Zuordnung nach Anbieter, Parameterzahl und Release ist unser Urteil, nicht deren Aussage. Die Preise sind vergleichbar, das Verhalten muss es nicht sein. Pinne die Modell-ID und teste selbst, wenn dir das wichtig ist.
Der Abstand ist überwiegend der Aufladesatz, nicht der Modellpreis
Unsere Katalogsätze, als Guthaben gelesen, liegen nah an dem, was Together AI in bar verlangt. Fast der gesamte Abstand oben kommt daraus, dass 1 Dollar zu $20 Guthaben wird. Bei 1:10 wird aus demselben Vergleich 12.5× bei qwen/qwen3.8-max und 9.33× bei deepseek/deepseek-v4-flash.
Together AI verkauft weit mehr Modelle als wir
Dessen Katalog umfasst Anbieter und Open-Weight-Modelle, die wir gar nicht führen, und er kann um einen ausgefallenen Provider herumleiten. Unsere 10 sind eine bewusst kurze Liste; wenn das Modell, das du brauchst, nicht darauf steht, ist unser Preis für die anderen für dich belanglos.
Eignung
Was du wofür aufrufst
Ruf es über Y-API auf, wenn
- deine Eingabe überwiegend frisch ist — dort liegt der Abstand beim aktuellen Aufladesatz bei 25× bei qwen/qwen3.8-max und 18.7× bei deepseek/deepseek-v4-flash.
- du ein Guthaben und einen Schlüssel für 10 Modelle von 6 Anbietern willst statt ein Konto pro Anbieter.
Geh zu Together AI, wenn
- du ein Modell außerhalb unserer 10 brauchst oder automatisches Ausweichen zwischen Providern willst, wenn einer ausfällt.
- du einen Preis willst, der nicht von einer Aktion abhängt. Unserer ist heute 1 Dollar → $20 Guthaben und danach 1:10; deren Preis ist in beiden Fällen bar zum Listenpreis.
- du Abrechnung, SLA und Support bei Together AI haben willst und nicht bei einem Reseller.
FAQ
Fragen, die vor dem Wechsel gestellt werden
- Ist Y-API günstiger als Together AI?
- Bei frischer Eingabe ja: qwen/qwen3.8-max kostet $0.10 gegen deren $2.50 und deepseek/deepseek-v4-flash kostet $0.0075 gegen deren $0.14. Zwei Dinge begrenzen das. Deren Spalte ist immer die günstigste veröffentlichte Stufe, jeder Faktor ist also Untergrenze und nicht Spitzenwert; und der Abstand hängt am zeitlich begrenzten Aufladesatz 1:20, der sich bei der Rückkehr auf 1:10 etwa halbiert.
- Warum ist es günstiger — kauft ihr unter deren Preis ein?
- Nein, und hier zählt die ehrliche Antwort. Unsere Katalogsätze, als Guthaben gelesen, liegen nah an den Barlistenpreisen von Together AI. Fast der gesamte Abstand ist die Aufladeumrechnung: 1 Dollar kauft $20 Guthaben, solange die Aktion läuft. Behandle das als Aktionssatz mit angekündigter Rückkehr auf 1:10, nicht als strukturellen Rabatt.
- Welche unserer Modelle bepreist Together AI?
- Bepreist sind 2 von unseren 10, mit dem Namen, den jedes dort trägt: qwen/qwen3.8-max (dort Qwen3.8-2.4T-A95B) und deepseek/deepseek-v4-flash (dort DeepSeek V4 Flash 0731). Das sind die einzigen Zeilen in der Tabelle oben — eine Zeile mit veröffentlichtem Preis auf nur einer Seite ist kein Vergleich.
- Was ist mit den Modellen, die dort keinen Preis haben?
- Ein Modell, das wir gesucht und nicht gefunden haben (xiaomi/mimo-v2.5); 7 Modelle, die wir noch nicht gegen dessen Katalog geprüft haben. «Wir haben nicht nachgesehen» und «die verkaufen es nicht» halten wir absichtlich auseinander: das sind verschiedene Aussagen, und nur die erste handelt von uns.
- Ist das Modell auf deren Seite wörtlich derselbe Build?
- Nicht bei qwen/qwen3.8-max (dort Qwen3.8-2.4T-A95B) und deepseek/deepseek-v4-flash (dort DeepSeek V4 Flash 0731) — ein datierter Snapshot oder ein anders benannter Build, zugeordnet nach Anbieter, Parameterzahl und Release-Datum. Vergleiche die Preise; setze nicht identisches Verhalten voraus.
- Wie viel von meinem Code muss sich ändern?
- base_url, der Schlüssel und der Modellname. Beide Seiten sprechen OpenAI Chat Completions, am restlichen Request-Body ändert sich also nichts — unsere tragen ein Präfix, zum Beispiel qwen/qwen3.8-max.
Quellenlage
Quellen
Jede Together AI-Angabe auf dieser Seite wurde am 2026-08-26 aus der Seite unten gelesen, in der günstigsten veröffentlichten Stufe. Unsere eigenen Angaben stehen auf unseren Preis- und Nutzungsbedingungen-Seiten.
Richte einen Aufruf darauf
Ändere base_url, den Schlüssel und den Modellnamen an einem Aufruf, den du schon machst. Das Request-Log sagt dir, was er kostet, bevor du irgendetwas anderes umstellst.