Gemini 3.7 Flash

google/gemini-3.7-flash

Gemini 3.7 Flash ist ein multimodaler Eintrag für schnelle Agentenabläufe, Codierung und mehrstufiges Reasoning, mit einem Kontextfenster von 1.048.576 Token über Text-, Bild-, Video-, Datei- und Audioeingabe.

Eingabe · Kontoguthaben
$1.50

je 1 Mio. Tokens

Zahlungsäquivalent $0.15

Ausgabe · Kontoguthaben
$7.50

je 1 Mio. Tokens

Zahlungsäquivalent $0.75

Kontextfenster
1.048.576

tokens · OpenRouter

Eingabe → Ausgabe
Text · Bild · Video · Datei · Audio→ Text
Modellspezifikationen
Quellen geprüft: Stand des Y-API-Katalogs:

Dieses Modell auswählen

Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.

Geeignete erste Aufgaben

Nutze es für Aufgaben, die zügige Iteration mit verlässlicher mehrstufiger Ausführung brauchen: einen Agenten, der ein Werkzeugergebnis liest und sofort den nächsten Aufruf entscheidet, oder eine Codierschleife mit vielen kurzen Zyklen.

Worauf du achten solltest

Google hat dieses Modell am 2026-10-08 zurückgezogen: Anfragen werden automatisch auf 3.8 Flash geleitet, und der Preis ist von der Preisliste verschwunden. Fenster und Medienweiterleitung des Gateways bleiben unverändert, aber was antwortet, ist nicht mehr dieses Modell — fixiere den Modellnamen, den du wirklich willst. Die Medienunterstützung ist weiterhin eigens gegen das Gateway zu prüfen.

Modellspezifikationen

Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.

Kontextfenster
1.048.576 tokens
Eingabe
Text · Bild · Video · Datei · Audio
Ausgabe
Text
Bei OpenRouter gelistet seit
Bei OpenRouter aufgeführte Parameter
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
OpenRouter-Modellseite und Spezifikationen

Kosten berechnen

Geschätzter Guthabenverbrauch
5,25 $
Geschätztes Zahlungsäquivalent
0,525 $

Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.

$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.

Gleiches Tokenbudget, andere Modelle
ModellGeschätzter GuthabenverbrauchGeschätztes Zahlungsäquivalent
Gemini 3.7 Flash5,25 $0,525 $
Gemini 3.8 Flash5,25 $0,525 $
Gemini 3.5 Flash8,00 $0,80 $
Vollständige Abrechnungsdetails

API verwenden

Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.

Eine Aufgabe zum Ausprobieren

Entscheide anhand der letzten drei Werkzeugausgaben den nächsten Aufruf und nenne die Abbruchbedingung für diese Schleife.

Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.

cURL · Gemini 3.7 Flash
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "google/gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Entscheide anhand der letzten drei Werkzeugausgaben den nächsten Aufruf und nenne die Abbruchbedingung für diese Schleife."
    }
  ],
  "max_tokens": 4096
}
JSON

Ergebnis prüfen

Lass die Schleife auf einer Aufgabe mit bekannter Lösung laufen und zähle die Schritte, ob sie von selbst endet und ob sie einen fehlgeschlagenen Aufruf wiederholt, statt den Ansatz zu wechseln.

Fragen zur Auswahl

Ist 3.7 Flash langsamer oder schneller als 3.8 Flash?

Auf diesem Eintrag hat die Frage keine Antwort mehr: Google hat 3.7 Flash am 2026-10-08 zurückgezogen und leitet seine Anfragen auf 3.8 Flash, ein Aufruf unter beiden Namen landet also beim selben Modell. Ruf 3.8 Flash direkt auf und miss das.

Quellen und Geltungsbereich

Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.