Y-API gegen DeepInfra
DeepInfra ist ein weiteres Gateway, das die Modelle derselben Anbieter weiterverkauft, das hier sind also nicht zwei konkurrierende Labore, sondern eine einzige Frage. Kostet es für die 2 Modelle, die beide verkaufen, über Y-API weniger? Beide Spalten unten sind bar pro 1 Mio. Eingabe-Tokens, und die Spalte von DeepInfra ist die günstigste Stufe, die wir auf dessen eigener Preisliste gefunden haben — jeder Faktor ist damit eine Untergrenze und keine Schlagzeile.
| Dimension | Y-API | DeepInfra |
|---|---|---|
| API-Protokoll | Y-APIOpenAI Chat Completions. base_url auf https://api.y-api.bestvirtualgoods.com/v1 zeigen, Schlüssel tauschen, den restlichen Code so lassen. | DeepInfraEin eigener OpenAI-kompatibler Endpunkt, unter anderer base_url und mit anderen Modellnamen — siehe die Zeile zu jedem Modell unten. |
| Modelle an einem Schlüssel | Y-API10 Modell-IDs von 6 Anbietern, ein Guthaben, ein Schlüssel. | DeepInfraDessen eigener veröffentlichter Katalog. Von den 10 Modellen, die wir dagegen vergleichen, sind dort 2 bepreist. |
| qwen/qwen3.8-max — Eingabe / 1 Mio. Tokens | Y-API$0.10 in bar | DeepInfra$1.65 als Qwen/Qwen3.8-Max — 16.5× unser Preis (Standardstufe; Priority- und Flex-Stufen weichen ab) |
| deepseek/deepseek-v4-flash — Eingabe / 1 Mio. Tokens | Y-API$0.0075 in bar | DeepInfra$0.09 als deepseek-ai/DeepSeek-V4-Flash — 12× unser Preis (Standardstufe; Priority- und Flex-Stufen weichen ab) |
| Was eine Aufladung wird | Y-APIZeitlich begrenzt: 1 Dollar wird zu $20 Kontoguthaben, danach wird das Guthaben zum jeweiligen Modellsatz abgezogen. Danach zurück auf 1:10. | DeepInfraDu zahlst den Listenpreis in bar. Es gibt keinen Guthaben-Multiplikator und nichts, was verfällt. |
| Wie der Satz aufgebaut ist | Y-APIEin Satz pro Modell — zu jeder Stunde, in jeder Region, bei jedem Request. | DeepInfraDie Angaben oben liegen innerhalb von Stufen: Standardstufe; Priority- und Flex-Stufen weichen ab. Zitiert haben wir die günstigste davon. |
| Preis bei Cache-Treffern | Y-APIKein Cache-Rabatt. Ein wiederholter Prompt wird genau wie ein neuer abgerechnet. | DeepInfraFür die Zeilen oben ist kein Satz für Cache-Eingaben veröffentlicht, beide Spalten nehmen daher an, dass jeder Request den Cache verfehlt. Wenn DeepInfra Cache-Treffer außerhalb der Preisliste rabattiert, schrumpft der Abstand. |
| Modelle ohne Preis dort | Y-APIAlle 10 sind über denselben Schlüssel aufrufbar. | DeepInfraEin Modell, das wir gesucht und nicht gefunden haben (xiaomi/mimo-v2.5); 7 Modelle, die wir noch nicht gegen dessen Katalog geprüft haben. |
Zu unseren Ungunsten
Wo DeepInfra günstiger ist
Ein Vergleich, der nur in eine Richtung rechnet, ist Werbung. Alles hier unten stammt aus derselben Preisliste wie die Angaben oben.
Wir haben überhaupt keinen Cache-Rabatt
Jeder Request wird zum vollen Satz abgerechnet, egal ob der Prompt mit dem letzten identisch ist. Lange feste System-Prompts und wiederholt mitgeschickter Dokumentkontext sind genau die Stelle, an der das weh tut.
Der Abstand ist überwiegend der Aufladesatz, nicht der Modellpreis
Unsere Katalogsätze, als Guthaben gelesen, liegen nah an dem, was DeepInfra in bar verlangt. Fast der gesamte Abstand oben kommt daraus, dass 1 Dollar zu $20 Guthaben wird. Bei 1:10 wird aus demselben Vergleich 8.25× bei qwen/qwen3.8-max und 6× bei deepseek/deepseek-v4-flash.
DeepInfra verkauft weit mehr Modelle als wir
Dessen Katalog umfasst Anbieter und Open-Weight-Modelle, die wir gar nicht führen, und er kann um einen ausgefallenen Provider herumleiten. Unsere 10 sind eine bewusst kurze Liste; wenn das Modell, das du brauchst, nicht darauf steht, ist unser Preis für die anderen für dich belanglos.
Eignung
Was du wofür aufrufst
Ruf es über Y-API auf, wenn
- deine Eingabe überwiegend frisch ist — dort liegt der Abstand beim aktuellen Aufladesatz bei 16.5× bei qwen/qwen3.8-max und 12× bei deepseek/deepseek-v4-flash.
- du ein Guthaben und einen Schlüssel für 10 Modelle von 6 Anbietern willst statt ein Konto pro Anbieter.
- du nicht verfolgen willst, in welcher Stufe, Region oder Stunde du abgerechnet wirst. Wir haben einen Satz pro Modell.
Geh zu DeepInfra, wenn
- du ein Modell außerhalb unserer 10 brauchst oder automatisches Ausweichen zwischen Providern willst, wenn einer ausfällt.
- du einen Preis willst, der nicht von einer Aktion abhängt. Unserer ist heute 1 Dollar → $20 Guthaben und danach 1:10; deren Preis ist in beiden Fällen bar zum Listenpreis.
- du Abrechnung, SLA und Support bei DeepInfra haben willst und nicht bei einem Reseller.
FAQ
Fragen, die vor dem Wechsel gestellt werden
- Ist Y-API günstiger als DeepInfra?
- Bei frischer Eingabe ja: qwen/qwen3.8-max kostet $0.10 gegen deren $1.65 und deepseek/deepseek-v4-flash kostet $0.0075 gegen deren $0.09. Zwei Dinge begrenzen das. Deren Spalte ist immer die günstigste veröffentlichte Stufe, jeder Faktor ist also Untergrenze und nicht Spitzenwert; und der Abstand hängt am zeitlich begrenzten Aufladesatz 1:20, der sich bei der Rückkehr auf 1:10 etwa halbiert.
- Warum ist es günstiger — kauft ihr unter deren Preis ein?
- Nein, und hier zählt die ehrliche Antwort. Unsere Katalogsätze, als Guthaben gelesen, liegen nah an den Barlistenpreisen von DeepInfra. Fast der gesamte Abstand ist die Aufladeumrechnung: 1 Dollar kauft $20 Guthaben, solange die Aktion läuft. Behandle das als Aktionssatz mit angekündigter Rückkehr auf 1:10, nicht als strukturellen Rabatt.
- Welche unserer Modelle bepreist DeepInfra?
- Bepreist sind 2 von unseren 10, mit dem Namen, den jedes dort trägt: qwen/qwen3.8-max (dort Qwen/Qwen3.8-Max) und deepseek/deepseek-v4-flash (dort deepseek-ai/DeepSeek-V4-Flash). Das sind die einzigen Zeilen in der Tabelle oben — eine Zeile mit veröffentlichtem Preis auf nur einer Seite ist kein Vergleich.
- Was ist mit den Modellen, die dort keinen Preis haben?
- Ein Modell, das wir gesucht und nicht gefunden haben (xiaomi/mimo-v2.5); 7 Modelle, die wir noch nicht gegen dessen Katalog geprüft haben. «Wir haben nicht nachgesehen» und «die verkaufen es nicht» halten wir absichtlich auseinander: das sind verschiedene Aussagen, und nur die erste handelt von uns.
- Wie viel von meinem Code muss sich ändern?
- base_url, der Schlüssel und der Modellname. Beide Seiten sprechen OpenAI Chat Completions, am restlichen Request-Body ändert sich also nichts — unsere tragen ein Präfix, zum Beispiel qwen/qwen3.8-max.
Quellenlage
Quellen
Jede DeepInfra-Angabe auf dieser Seite wurde am 2026-08-26 aus der Seite unten gelesen, in der günstigsten veröffentlichten Stufe. Unsere eigenen Angaben stehen auf unseren Preis- und Nutzungsbedingungen-Seiten.
Richte einen Aufruf darauf
Ändere base_url, den Schlüssel und den Modellnamen an einem Aufruf, den du schon machst. Das Request-Log sagt dir, was er kostet, bevor du irgendetwas anderes umstellst.