Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Probiere es als Standard-Arbeitspferd der Flash-Stufe für Codierhilfe und Agentenschritte, wenn du die aktuelle Generation willst, ohne den Tokenpreis der Pro-Stufe zu zahlen.
Worauf du achten solltest
Die älteren Flash-Generationen werden jetzt hierher geleitet: Google hat 3.7 Flash am 2026-10-08 zurückgezogen und schickt seine Anfragen auf diesen Eintrag, ein Umstieg ist also eine Frage des richtigen Modellnamens und nicht des Budgets. Die sehr breite Modalitätsliste ist eine Modellspezifikation; jedes Format braucht weiterhin eine Kompatibilitätsprüfung am Gateway.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 1.048.576 tokens
- Eingabe
- Text · Bild · Video · Datei · Audio
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Kosten berechnen
- Geschätzter Guthabenverbrauch
- 5,25 $
- Geschätztes Zahlungsäquivalent
- 0,525 $
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| Gemini 3.8 Flash | 5,25 $ | 0,525 $ |
| Gemini 3.7 Flash | 5,25 $ | 0,525 $ |
| Qwen3.8 Flash | 0,45 $ | 0,045 $ |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Prüfe diesen Diff auf Korrektheit und nenne die Änderung, die du zuerst zurücknehmen würdest, wenn die Tests nach dem Merge fehlschlagen.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "google/gemini-3.8-flash",
"messages": [
{
"role": "user",
"content": "Prüfe diesen Diff auf Korrektheit und nenne die Änderung, die du zuerst zurücknehmen würdest, wenn die Tests nach dem Merge fehlschlagen."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Prüfe, ob die benannte Änderung wirklich die riskanteste ist, indem du sie in einem Testzweig zurücknimmst und die Tests laufen lässt. Vergleiche die Prüfung anschließend mit dem 3.7-Eintrag am selben Diff.
Fragen zur Auswahl
Mit welchem Gemini Flash sollten neue Integrationen beginnen?
Mit dem neuesten, 3.8 Flash: Dorthin erreichen jetzt auch Aufrufe des zurückgezogenen 3.7 Flash, eine Anfrage unter beiden Namen landet also beim selben Modell. Behalte die Auswertungsumgebung, um beim nächsten Flash-Eintrag nachzuprüfen.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.