Qwen3.8 Max

qwen/qwen3.8-max

Qwen3.8 Max ist das Flaggschiff der Qwen3.8-Reihe: ein großes Mixture-of-Experts-Modell mit einem Kontextfenster von einer Million Token, das Text, Bilder und Video annimmt. Es teilt die Generation mit Qwen3.8 Flash, liegt preislich aber eine Stufe darüber.

Eingabe · Kontoguthaben
$2.00

je 1 Mio. Tokens

Zahlungsäquivalent $0.20

Ausgabe · Kontoguthaben
$6.00

je 1 Mio. Tokens

Zahlungsäquivalent $0.60

Kontextfenster
1.000.000

tokens · OpenRouter

Eingabe → Ausgabe
Text · Bild · Video→ Text
Modellspezifikationen
Quellen geprüft: Stand des Y-API-Katalogs:

Dieses Modell auswählen

Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.

Geeignete erste Aufgaben

Reserviere es für Aufgaben, an denen das günstigere Flash nachweislich scheitert: lange Dokumente, die über die gesamte Länge zusammenpassen müssen, oder mehrstufige Analysen mit mehreren gleichzeitigen Vorgaben.

Worauf du achten solltest

Der Eintrag ist ein rollierender Name und kein datierter Schnappschuss; das Verhalten kann sich unter derselben ID verschieben. Der zehnfache Eingabepreis gegenüber Flash ist zudem eine echte Budgetentscheidung.

Modellspezifikationen

Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.

Kontextfenster
1.000.000 tokens
Eingabe
Text · Bild · Video
Ausgabe
Text
Bei OpenRouter gelistet seit
Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
OpenRouter-Modellseite und Spezifikationen

Kosten berechnen

Geschätzter Guthabenverbrauch
5,00 $
Geschätztes Zahlungsäquivalent
0,50 $

Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.

$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.

Gleiches Tokenbudget, andere Modelle
ModellGeschätzter GuthabenverbrauchGeschätztes Zahlungsäquivalent
Qwen3.8 Max5,00 $0,50 $
Qwen3.8 Flash0,45 $0,045 $
GLM 5.33,90 $0,39 $
Vollständige Abrechnungsdetails

API verwenden

Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.

Eine Aufgabe zum Ausprobieren

Lies das beigefügte Richtliniendokument und liste jede Klausel auf, die die Datenaufbewahrung einschränkt; zitiere jeweils den Satz, der sie benennt.

Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.

cURL · Qwen3.8 Max
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "qwen/qwen3.8-max",
  "messages": [
    {
      "role": "user",
      "content": "Lies das beigefügte Richtliniendokument und liste jede Klausel auf, die die Datenaufbewahrung einschränkt; zitiere jeweils den Satz, der sie benennt."
    }
  ],
  "max_tokens": 4096
}
JSON

Ergebnis prüfen

Jede zitierte Klausel muss wörtlich in der Quelle stehen und tatsächlich die Aufbewahrung betreffen. Gib dasselbe Dokument dem Flash-Modell und vergleiche, wie viele Klauseln jeweils fehlen.

Fragen zur Auswahl

Sollte ich mit Max oder mit Flash beginnen?

Mit Flash. Wechsle erst zu Max, wenn du an denselben Eingaben eine Aufgabe zeigen kannst, die bei Flash scheitert und bei Max gelingt; der Preisunterschied ist zu groß für einen ungeprüften Umstieg.

Quellen und Geltungsbereich

Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.