Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Erwäge es für Batch-Codierarbeit, bei der das Modell eine Aufgabe selbstständig durchhalten soll — Refactorings, nachgezogene Tests oder Abhängigkeitsupdates mit klarer Fertigstellungsdefinition.
Worauf du achten solltest
Mit 204.800 Token umfasst das Fenster rund ein Fünftel der neueren GLM-Einträge, während der Eingabepreis gleich bleibt; lange Dokumente gehören daher auf 5.2 oder 5.3. Als ältester Eintrag wird es zudem am ehesten abgelöst.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 204.800 tokens
- Eingabe
- Text
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Kosten berechnen
- Geschätzter Guthabenverbrauch
- 3,60 $
- Geschätztes Zahlungsäquivalent
- 0,36 $
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| GLM 5.1 | 3,60 $ | 0,36 $ |
| GLM 5.2 | 3,60 $ | 0,36 $ |
| DeepSeek V4 Flash 0731 | 0,30 $ | 0,03 $ |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Ergänze Tests für die ungetesteten Zweige dieses Moduls, ohne sein öffentliches Verhalten zu ändern. Berichte, welche Zweige du nicht erreichen konntest und warum.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "z-ai/glm-5.1",
"messages": [
{
"role": "user",
"content": "Ergänze Tests für die ungetesteten Zweige dieses Moduls, ohne sein öffentliches Verhalten zu ändern. Berichte, welche Zweige du nicht erreichen konntest und warum."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Bestätige per Diff der exportierten Oberfläche, dass die öffentliche API unverändert ist, und prüfe dann, ob jeder neue Test fehlschlägt, wenn du den zugehörigen Zweig gezielt brichst.
Fragen zur Auswahl
Warum GLM 5.1 statt 5.2 oder 5.3 bei gleichem Preis wählen?
Normalerweise gar nicht. Nimm es, wenn ein kürzeres Fenster ausreicht und du gezielt das ältere Verhalten willst; sonst kosten die neueren Einträge je Eingabetoken dasselbe und bieten mehr Platz.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.