Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Probiere es in Agentenschleifen, die viele Schritte durchhalten müssen, ohne den Faden zu verlieren — ein Zyklus aus Bauen, Reparieren und erneutem Testen oder eine Datenpipeline, die ihre Invarianten über alle Transformationen behält.
Worauf du achten solltest
Das gelistete Kontextfenster beschreibt das Modell, nicht die Zusage des Gateways; lange Eingaben werden zudem schnell teuer. Besonders die Videoeingabe braucht einen eigenen Kompatibilitätstest, bevor du darauf aufbaust.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 1.048.576 tokens
- Eingabe
- Text · Bild · Video
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Kosten berechnen
- Geschätzter Guthabenverbrauch
- 0,90 $
- Geschätztes Zahlungsäquivalent
- 0,09 $
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| MiniMax M3 | 0,90 $ | 0,09 $ |
| MiniMax M2.7 | Kostenlos — kein Guthaben abgezogen | |
| Qwen3.8 Flash | 0,45 $ | 0,045 $ |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Ein Migrationsskript muss gefahrlos wiederholbar sein. Nenne die Operationen, die bei einem zweiten Lauf Daten duplizieren würden, und schreibe jede so um, dass sie idempotent ist.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "minimax/minimax-m3",
"messages": [
{
"role": "user",
"content": "Ein Migrationsskript muss gefahrlos wiederholbar sein. Nenne die Operationen, die bei einem zweiten Lauf Daten duplizieren würden, und schreibe jede so um, dass sie idempotent ist."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Führe das umgeschriebene Skript zweimal gegen dieselben Testdaten aus und vergleiche die Ergebnisse. Jeder Unterschied zwischen den Läufen bedeutet, dass eine Operation nicht wirklich idempotent geworden ist.
Fragen zur Auswahl
Ist M3 einfach ein größeres M2.7?
Nein. M3 ergänzt Bild- und Videoeingabe und ein deutlich längeres Kontextfenster und ist ein kostenpflichtiger Eintrag, während M2.7 kostenlos ist. Behandle es als eigenes Modell zur Prüfung, nicht als direkten Austausch.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.