Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Nutze Ticketklassifikation, Textbereinigung und kurze Codeerklärungen als Vergleichsbasis. Bewahre schwierige Beispiele auf, bevor du zu einer neueren Flash-Version wechselst.
Worauf du achten solltest
Die ID ohne Datum verspricht kein automatisches Upgrade. OpenRouter bezeichnet diesen Eintrag als 0423; die Bildfähigkeiten von V4.1 lassen sich daraus nicht ableiten.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 1.048.576 tokens
- Eingabe
- Text
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_completion_tokensmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p
Kosten berechnen
Im aktuellen Katalog ist dieses Modell kostenlos: Aufrufe ziehen kein Guthaben ab. Das verspricht weder unbegrenzte Kapazität noch dauerhafte Verfügbarkeit oder künftige Kostenfreiheit.
- Geschätzter Guthabenverbrauch
- Kostenlos — kein Guthaben abgezogen
- Geschätztes Zahlungsäquivalent
- Kostenlos — kein Guthaben abgezogen
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| DeepSeek V4 Flash 0423 | Kostenlos — kein Guthaben abgezogen | |
| DeepSeek V4 Flash 0731 | 0,30 $ | 0,03 $ |
| DeepSeek V4.1 Flash | 0,70 $ | 0,07 $ |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Ordne dieses Ticket Abrechnung, Anmeldung oder Fehler zu und begründe kurz: Dieselbe Rechnung wurde zweimal abgebucht.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "deepseek/deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "Ordne dieses Ticket Abrechnung, Anmeldung oder Fehler zu und begründe kurz: Dieselbe Rechnung wurde zweimal abgebucht."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Erwartet wird Abrechnung ohne erfundene Details. Ergänze mehrdeutige Tickets und solche mit mehreren Anliegen, um Fehlzuordnungen zu messen.
Fragen zur Auswahl
Ist das dasselbe Modell wie V4 Flash 0731?
Nein, die IDs unterscheiden sich. Der Entwickler beschreibt 0731 als offizielle Version nach der Vorschau. Speichere die vollständige ID und teste vor dem Wechsel erneut.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.