LLM-API-Preisvergleich

Dasselbe Open-Weight-Modell kann sehr unterschiedlich viel kosten, je nachdem, wo du es aufrufst. Unten sind 10 Modelle an fünf Orten gleichzeitig bepreist, alle auf dieselbe Einheit umgerechnet: US-Dollar pro 1M Token, Cache-Miss, Standardstufe. Jede Angabe stammt von der eigenen Preisseite des Anbieters am jeweils genannten Datum, und die Zeilen, in denen wir die teure Option sind, werden weiter unten eigens benannt.

Methode

Wie diese Zahlen entstanden sind

Eine Einheit für alle
Unsere Sätze sind in USD-Guthaben ausgezeichnet; eine Aufladung von $1 wird derzeit zu $20 Guthaben. Die Zahlen in unserer Spalte sind Guthaben geteilt durch 20 — das Geld, das tatsächlich von deiner Karte geht. Die Zahlen aller anderen sind bereits Bargeld.
Günstigste veröffentlichte Stufe, Cache-Miss
Wo ein Anbieter mehrere Stufen veröffentlicht, nimmt die Tabelle die günstigste, die für einen normalen Aufruf gilt: DeepSeeks Off-Peak-Satz statt Peak, DeepInfras Standardstufe statt Flex. Gecachte Eingaben sind überall ausgeschlossen, auch bei uns.
Deren Modell-IDs, nicht unsere
Aggregatoren listen oft einen datierten Snapshot (`-0813`) statt des rollierenden Modells oder benennen ihn nach Parameterzahl um. Diese Fälle sind in der Tabelle markiert; ein datierter Build verhält sich nicht garantiert wie der aktuelle.
Zwei verschiedene Arten von leer
Eine Zelle mit „Nicht im Katalog“ bedeutet, dass wir nachgesehen haben und der Anbieter das Modell nicht führt. Eine leere Zelle bedeutet, dass wir es nicht verifiziert haben — nicht, dass es nicht verfügbar ist. Beides wird nie vermischt.
Eingabepreis pro 1M Token für 10 Modelle über offizielle Hersteller-APIs, drei Aggregatoren und Y-API
xiaomi/mimo-v2.5pro 1M TokenY-API$0.007 Eingabe$0.014 AusgabeXiaomi MiMo$0.142eine günstigere Cache-Treffer-Stufe existiert ebenfalls Eingabe$0.28 Ausgabemimo-v2.5OpenRouter$0.1193datierter Snapshot-Build, nicht das rollierende Modell Eingabe$0.238 Ausgabexiaomi/mimo-v2.5-20260422Together AINicht im KatalogDeepInfraNicht im Katalog
deepseek/deepseek-v4-flashpro 1M TokenY-API$0.0075 Eingabe$0.015 AusgabeDeepSeek$0.221,2Off-Peak-Satz; eine günstigere Cache-Treffer-Stufe existiert ebenfalls Eingabe$0.66 Ausgabedeepseek-v4-flashOpenRouter$0.063datierter Snapshot-Build, nicht das rollierende Modell Eingabe$0.12 Ausgabedeepseek/deepseek-v4-flash-0731Together AI$0.143datierter Snapshot-Build, nicht das rollierende Modell Eingabe$0.28 AusgabeDeepSeek V4 Flash 0731DeepInfra$0.095Standardstufe; Priority- und Flex-Stufen weichen ab Eingabe$0.18 Ausgabedeepseek-ai/DeepSeek-V4-Flash
minimax/minimax-m2.7pro 1M TokenY-API$0.015 Eingabe$0.06 AusgabeMiniMax$0.302eine günstigere Cache-Treffer-Stufe existiert ebenfalls Eingabe$1.20 AusgabeMiniMax-M2.7Together AI$0.30 Eingabe$1.20 AusgabeMiniMax M2.7DeepInfraNicht im Katalog
minimax/minimax-m2.5pro 1M TokenY-API$0.015 Eingabe$0.06 AusgabeMiniMax$0.302eine günstigere Cache-Treffer-Stufe existiert ebenfalls Eingabe$1.20 AusgabeMiniMax-M2.5Together AINicht im KatalogDeepInfraNicht im Katalog
qwen/qwen3.7-pluspro 1M TokenY-API$0.0175 Eingabe$0.065 AusgabeAlibaba Cloud Model StudioPreis nicht veröffentlichtTogether AI$0.32 Eingabe$1.28 AusgabeQwen3.7-PlusDeepInfraNicht im Katalog
deepseek/deepseek-v4-propro 1M TokenY-API$0.025 Eingabe$0.05 AusgabeDeepSeek$0.661,2Off-Peak-Satz; eine günstigere Cache-Treffer-Stufe existiert ebenfalls Eingabe$1.98 Ausgabedeepseek-v4-proOpenRouter$1.1223datierter Snapshot-Build, nicht das rollierende Modell Eingabe$3.366 Ausgabedeepseek/deepseek-v4-pro-0813Together AI$1.74 Eingabe$3.48 AusgabeDeepSeek V4 ProDeepInfra$1.305Standardstufe; Priority- und Flex-Stufen weichen ab Eingabe$2.60 Ausgabedeepseek-ai/DeepSeek-V4-Pro
minimax/minimax-m2.7-highspeedpro 1M TokenY-API$0.03 Eingabe$0.12 AusgabeMiniMax$0.60 Eingabe$2.40 AusgabeMiniMax-M2.7-highspeedTogether AINicht im KatalogDeepInfraNicht im Katalog
minimax/minimax-m2.5-highspeedpro 1M TokenY-API$0.03 Eingabe$0.12 AusgabeMiniMax$0.60 Eingabe$2.40 AusgabeMiniMax-M2.5-highspeedTogether AINicht im KatalogDeepInfraNicht im Katalog
qwen/qwen3.7-maxpro 1M TokenY-API$0.075 Eingabe$0.225 AusgabeAlibaba Cloud Model StudioPreis nicht veröffentlichtTogether AI$1.25 Eingabe$3.75 AusgabeQwen3.7-MaxDeepInfra$2.505Standardstufe; Priority- und Flex-Stufen weichen ab Eingabe$7.50 AusgabeQwen/Qwen3.7-Max
qwen/qwen3.8-maxpro 1M TokenY-API$0.10 Eingabe$0.30 AusgabeAlibaba Cloud Model StudioPreis nicht veröffentlichtOpenRouter$2.00 Eingabe$6.00 AusgabeTogether AI$2.504unter anderem Namen gelistet Eingabe$6.25 AusgabeQwen3.8-2.4T-A95BDeepInfra$1.655Standardstufe; Priority- und Flex-Stufen weichen ab Eingabe$4.951 AusgabeQwen/Qwen3.8-Max
  • 1Off-Peak-Satz
  • 2eine günstigere Cache-Treffer-Stufe existiert ebenfalls
  • 3datierter Snapshot-Build, nicht das rollierende Modell
  • 4unter anderem Namen gelistet
  • 5Standardstufe; Priority- und Flex-Stufen weichen ab

Wo wir günstiger sind

Die Lücke kommt vom Aufladekurs, nicht von herabgesetzten Sätzen

Lies unsere Guthabensätze, als wären es Dollars, und sie liegen ungefähr auf den eigenen Listenpreisen der Hersteller — identisch für alle vier MiniMax-Modelle und für xiaomi/mimo-v2.5, ein wenig über offiziell bei xiaomi/mimo-v2.5-pro, darunter bei den zwei DeepSeek-Builds. Praktisch die gesamte Differenz ist der Aufladekurs 20:1. Deshalb ist es auch ehrlich zu sagen, dass der Multiplikator vorübergehend ist: bei 1:10 halbiert er sich.

Gegen die offiziellen Herstellerpreise, Geld gegen Geld, liegen die vergleichbaren Modelle bei der Eingabe zwischen 20× und 29.3× günstiger.

Wo wir mehr kosten

Drei Fälle, in denen du uns nicht nutzen solltest

Workloads, die den Prompt-Cache ständig treffen

DeepSeek rechnet gecachte Eingaben mit $0.022 pro 1M Off-Peak ab, Xiaomi mit $0.0028 — unter unserem Barsatz für dieselben Modelle. Wir haben überhaupt keine Cache-Treffer-Stufe. Wenn du einen langen, stabilen System-Prompt tausendfach wiedergibst, kann der direkte Aufruf beim Hersteller weniger kosten als der über uns.

Modelle außerhalb unseres Katalogs

Unser Katalog umfasst 21 Modell-IDs. GPT, Claude und Gemini fehlen, ebenso der größte Teil des langen Tails, den ein Aggregator führt. Kein Preisvergleich hilft, wenn das Modell, das du brauchst, nicht auf der Liste steht.

Wenn du einen Preis brauchst, der sich nicht ändern kann

Der Multiplikator in dieser Tabelle ruht auf einem zeitlich begrenzten Aufladekurs 20:1. Bereits vorhandenes Guthaben wird nicht umgestellt, aber neue Aufladungen nach dem Ende der Aktion werden zu 1:10 umgerechnet, was jeden hier gezeigten Vorteil halbiert. Herstellerlistenpreise sind ebenfalls nicht vertraglich zugesichert, aber sie bewegen sich langsam und öffentlich.

Lücken

Was in dieser Tabelle fehlt, und warum

Nicht jedes Modell ist dabei
11 unserer 21 Modelle fehlen. Zwei Qwen-Modelle haben keinerlei überprüfbaren externen Preis, zwei DeepSeek-Builds erscheinen auf keiner Preisseite, die wir prüfen konnten, und ein Modell nennt seinen Hersteller nicht.
Alibaba veröffentlicht keinen Qwen-Preis
Die öffentlichen Modellseiten listen nur Fähigkeiten; die Abrechnung pro Token liegt hinter einer regionenspezifischen Konsole. Deshalb ist die offizielle Spalte in jeder Qwen-Zeile leer — eine leere Zelle ist besser als eine Zahl aus einem Blog. Unsere eigenen Sätze stehen auf einer öffentlichen Seite und in einem maschinenlesbaren Endpoint.
Keine Drittanbieter-Zahlen wurden verwendet
Für ein einzelnes DeepSeek-Modell zitieren drei vielbeachtete Beiträge drei miteinander unvereinbare Preise. Als Quelle zählt hier nur die eigene Preisseite des Anbieters.
Aggregatoren weichen um bis zu 2× ab
Qwen3.7-Max kostet $1.25 pro 1M Eingabe auf Together AI und $2.50 auf DeepInfra — dasselbe Modell, dieselbe Einheit, derselbe Tag. Behandle jede einzelne Aggregator-Angabe als einen Datenpunkt, nicht als den Marktpreis.

FAQ

Fragen, die diese Tabelle aufwirft

Was ist der günstigste Weg, DeepSeek V4 Pro aufzurufen?
Geprüft am 2026-08-26, je 1M Eingabe-Token: Y-API $0.025 in bar, DeepSeeks eigene API $0.66 Off-Peak und $1.32 Peak, DeepInfra $1.30, OpenRouter $1.122 für den datierten 0813-Build, Together AI $1.74. Der eine Fall, der kippt, ist ein ständig gecachter Prompt — DeepSeek berechnet für gecachte Eingaben $0.022 pro 1M, knapp unter unserem Satz.
Warum sind Y-APIs Preise in Guthaben statt in Dollar ausgezeichnet?
Guthaben ist die Zähleinheit innerhalb des Dienstes: Eine Aufladung verwandelt Dollar zum aktuellen Kurs in Guthaben, und jedes Modell zieht Guthaben pro Token ab. Die Auszeichnung in Guthaben hält die Zahl pro Modell stabil, wenn sich der Aufladekurs ändert. Für den Barpreis teile den Guthabensatz durch den aktuellen Kurs — 20 heute, 10 nach der Aktion. Beide Zahlen sind veröffentlicht, und der Barpreis steht im maschinenlesbaren Pricing-Endpoint.
Ist ein Aggregator jemals günstiger als der Modellhersteller selbst?
Ja, und diese Tabelle enthält ein Beispiel. OpenRouter listet den datierten Build xiaomi/mimo-v2.5-20260422 mit $0.119 pro 1M Eingabe, unter Xiamis eigenen $0.14. Aggregatoren listen manchmal auch nur einen datierten Snapshot, der dem rollierenden Modell bei Updates nicht folgt — günstiger, aber nicht dasselbe.
Wie viel der Differenz ist echter Rabatt und wie viel die Aufladeaktion?
Fast alles davon ist die Aktion. Verglichen, als wäre Guthaben Dollar, entsprechen unsere Sätze den eigenen Listenpreisen der Hersteller für alle vier MiniMax-Modelle und für xiaomi/mimo-v2.5, liegen 3 % über offiziell bei xiaomi/mimo-v2.5-pro und darunter bei den zwei DeepSeek-Builds. Die großen Multiplikatoren in der Tabelle kommen vom Aufladekurs 20:1, der zeitlich begrenzt ist und zu 1:10 zurückkehrt.
Wie oft wird diese Tabelle aktualisiert?
Jede Angabe trägt das Datum ihrer Prüfung, sichtbar am Anfang der Seite. Anbieter ändern Preise ohne Ankündigung; behandle alles, was älter als einige Wochen ist, als Ausgangspunkt, und folge dem Quellenlink, bevor du Ausgaben festlegst. Unsere eigenen Sätze werden beim Build aus dem Live-Katalog synchronisiert — sie sind nie älter als der letzte Deploy.

Quellenlage

Quellen

Ein Link pro Anbieter, jeder zeigt auf die Seite, von der die Zahlen gelesen wurden. Y-APIs eigene Sätze stammen von dessen Modell- und Preisseiten sowie von https://y-api.bestvirtualgoods.com/pricing.json.

Prüfe ein Modell gegen deine eigene Rechnung

Nimm das Modell, das du am häufigsten aufrufst, such es in der Tabelle und multipliziere mit der Token-Zahl des letzten Monats. Geht die Rechnung auf, melde dich an und richte einen Aufruf hierher — das Request-Log zeigt den echten Abzug.