Step 3.7 Flash

stepfun/step-3.7-flash

Step 3.7 Flash verbindet ein sparsames Sprachmodell mit einem Bildencoder. Der Entwickler betont Wahrnehmung und Werkzeuge; OpenRouter listet Bild, Video und wählbare Reasoning-Intensität.

Eingabe · Kontoguthaben
$0.20

je 1 Mio. Tokens

Zahlungsäquivalent $0.02

Ausgabe · Kontoguthaben
$1.20

je 1 Mio. Tokens

Zahlungsäquivalent $0.12

Kontextfenster
262.144

tokens · OpenRouter

Eingabe → Ausgabe
Text · Bild · Video→ Text
Modellspezifikationen
Quellen geprüft: Stand des Y-API-Katalogs:

Dieses Modell auswählen

Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.

Geeignete erste Aufgaben

Prüfe strukturierte Extraktion mit anschließender externer Rechenkontrolle. Trenne Lesefehler in Dokumenten von Reasoning-Fehlern.

Worauf du achten solltest

Flash garantiert keine Latenz. Prüfe Formate und Einstellungen der Route, statt eine direkte Übertragung nativer Konfiguration anzunehmen.

Modellspezifikationen

Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.

Kontextfenster
262.144 tokens
Eingabe
Text · Bild · Video
Ausgabe
Text
Bei OpenRouter gelistet seit
Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
OpenRouter-Modellseite und Spezifikationen

Kosten berechnen

Geschätzter Guthabenverbrauch
0,80 $
Geschätztes Zahlungsäquivalent
0,08 $

Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.

$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.

Gleiches Tokenbudget, andere Modelle
ModellGeschätzter GuthabenverbrauchGeschätztes Zahlungsäquivalent
Step 3.7 Flash0,80 $0,08 $
Qwen3.8 Flash0,45 $0,045 $
GLM 5.3 Flash0,40 $0,04 $

API verwenden

Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.

Eine Aufgabe zum Ausprobieren

Eine Rechnung nennt Positionen von 30 und 45, Steuer 15 und Gesamtbetrag 100. Prüfe die Rechnung und unterscheide gesicherte von ungesicherten Schlüssen.

Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.

cURL · Step 3.7 Flash
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "stepfun/step-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Eine Rechnung nennt Positionen von 30 und 45, Steuer 15 und Gesamtbetrag 100. Prüfe die Rechnung und unterscheide gesicherte von ungesicherten Schlüssen."
    }
  ],
  "max_tokens": 4096
}
JSON

Ergebnis prüfen

Die Teile ergeben 90; welcher Ursprungswert falsch ist, bleibt offen. Der Widerspruch muss benannt werden, ohne die Rechnung still zu ändern.

Fragen zur Auswahl

Was sollte ich mit anderen Flash-Modellen vergleichen?

Extraktionsgenauigkeit, gültige Schemas, abgeschlossene Werkzeugaufrufe und Tokens bei gleichen Eingaben. Miss Latenz selbst: Flash ist keine standardisierte Geschwindigkeitsklasse.

Quellen und Geltungsbereich

Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.