Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Prüfe es an anspruchsvoller multimodaler Arbeit, an der die Flash-Variante gescheitert ist: Videoverständnis, Reasoning über Audio und Text oder Aufgaben, bei denen die größere Parameterzahl eine komplexe Spezifikation halten soll.
Worauf du achten solltest
Eine veröffentlichte Parameterzahl beschreibt den Checkpoint, nicht den Durchsatz oder die Qualität über das Gateway. Audio- und Videoeingabe brauchen weiterhin einen eigenen Kompatibilitätstest, bevor du darauf aufbaust.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 1.050.000 tokens
- Eingabe
- Text · Bild · Video · Audio
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Kosten berechnen
- Geschätzter Guthabenverbrauch
- 1,00 $
- Geschätztes Zahlungsäquivalent
- 0,10 $
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| MiMo-V2.6-Pro | 1,00 $ | 0,10 $ |
| MiMo-V2.6-Flash | 0,36 $ | 0,036 $ |
| MiMo-V2.5 | Kostenlos — kein Guthaben abgezogen | |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Gegeben sind eine Bildschirmaufnahme und ihr Kommentar. Liste der Reihe nach die Schritte auf, die die Person tatsächlich ausgeführt hat, und markiere jeden Schritt, den der Kommentar nicht erwähnt.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "xiaomi/mimo-v2.6-pro",
"messages": [
{
"role": "user",
"content": "Gegeben sind eine Bildschirmaufnahme und ihr Kommentar. Liste der Reihe nach die Schritte auf, die die Person tatsächlich ausgeführt hat, und markiere jeden Schritt, den der Kommentar nicht erwähnt."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Vergleiche die extrahierten Schritte mit einer manuell erstellten Referenz. Schicke dieselbe Aufnahme anschließend durch den Flash-Eintrag und prüfe, ob die Pro-Stufe ihren höheren Preis für dein Material wert ist.
Fragen zur Auswahl
Beschreibt die verlinkte Karte die tatsächlich bereitgestellten Gewichte?
Die Karte benennt einen Checkpoint aus der Trainingspipeline des Herausgebers. Das ist nützlicher technischer Hintergrund, beweist aber nicht, welche Gewichte das Gateway ausliefert; prüfe das Verhalten mit eigenen Anfragen.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.