StepFun

1 Modell mit geprüftem Leitfaden

Alle Modelle

StepFun ist bei Y-API durch Step 3.7 Flash vertreten: ein sparsames Sprach-Backbone, gepaart mit einem Vision-Encoder für Bild- und Videoeingabe bei 262.144-Token-Fenster und wählbarem Reasoning-Aufwand. Eine Ein-Modell-Reihe — wie Qwen und MiniMax hier.

Quellen geprüft: Y-API-Katalog-Schnappschuss:

Über diesen Anbieter

Anbieterübergreifende Auswahlhinweise von Y-API. Modellspezifische Prüfungen stehen auf den verlinkten Seiten; hier gibt es keine gemessenen Vergleiche.

Sein Platz im Katalog

Step 3.7 Flash liegt in der Flash-Preisstufe mit Vision und tritt direkt gegen Qwen3.8 Flash und GLM 5.3 Flash an; der eigene Winkel ist die Betonung des Herausgebers auf Wahrnehmung plus Werkzeugorchestrierung statt roher Kontextlänge.

Worauf zu achten ist

Der Name Flash ist keine Latenzklasse, und die vom Gateway akzeptierten Medienformate können enger sein als der Referenzeintrag. Mit einem Modell gibt es keinen Ersatz innerhalb der Familie — der Ersatz ist ein anderer Anbieter.

Modelle bei Y-API

Die Preise sind Guthaben-Schnappschüsse aus dem Y-API-Katalog. Jedes Modell verlinkt auf seinen eigenen Leitfaden mit Kostenschätzer und Anfragebeispiel.

StepFun · Modelle bei Y-API
ModellKontextfensterEingabe / 1M TokenAusgabe / 1M Token
Step 3.7 Flashstepfun/step-3.7-flash262,144$0.20$0.02$1.20$0.12

Kontoguthaben / Geldäquivalent · $1 Zahlung fügt $10 Guthaben hinzu; das Geldäquivalent ist verbrauchtes Guthaben ÷ 10. Dies sind Y-API-Preise, keine offiziellen Listenpreise des Herausgebers.

Auswahl innerhalb der Reihe

Prüfen Sie es im direkten Vergleich mit Qwen3.8 Flash und GLM 5.3 Flash an denselben Extraktionsaufgaben, indem Sie Wahrnehmungs- und Reasoning-Fehler getrennt bewerten. Passt sein Vernehmen-dann-Prüfen-Workflow, kann das übrige Budget ein stärkeres Zweitstufenmodell finanzieren.

Vor der Entscheidung

Worin unterscheidet sich Step 3.7 Flash von den anderen Flash-Modellen?

Es kombiniert einen Vision-Encoder mit sparsamem Sprach-Backbone, statt eine textzentrierte Familie fortzuführen, und legt den Reasoning-Aufwand offen. Vergleichen Sie Extraktionsgenauigkeit, Schema-Gültigkeit und Gesamttoken auf identischen Eingaben — der gemeinsame Flash-Name impliziert nichts davon.

Quellen & Geltungsbereich

Die Abdeckung dieses Anbieters auf dieser Site ist genau die obige Liste geprüfter Modell-Leitfäden; eine Anbieterseite existiert nur, solange mindestens eines ihrer Modelle geprüft ist. Aussagen zu Architektur und Positionierung folgen den zitierten Quellen. Wir veröffentlichen keine gemessenen Latenzen, Verfügbarkeiten oder Benchmark-Werte irgendeines Anbieters.