Dieses Modell auswählen
Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.
Geeignete erste Aufgaben
Setze es für Klassifikation, Extraktion und Zusammenfassung in großen Mengen ein oder als günstige erste Stufe einer zweistufigen Pipeline, die nur schwierige Fälle an ein größeres Modell weiterreicht.
Worauf du achten solltest
Die 200.000 Token sind ein Fünftel des neueren Haiku-Eintrags bei deutlich höherem Eingabepreis, es ist also nicht die preiswerte Wahl dieser Familie. Auch die dokumentierte Parameterliste ist schmaler als bei den neueren Modellen.
Modellspezifikationen
Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.
- Kontextfenster
- 200.000 tokens
- Eingabe
- Text · Bild · Datei
- Ausgabe
- Text
- Bei OpenRouter gelistet seit
- Bei OpenRouter aufgeführte Parameter
include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Kosten berechnen
- Geschätzter Guthabenverbrauch
- 3,75 $
- Geschätztes Zahlungsäquivalent
- 0,375 $
Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.
$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.
| Modell | Geschätzter Guthabenverbrauch | Geschätztes Zahlungsäquivalent |
|---|---|---|
| Claude Haiku 4.5 | 3,75 $ | 0,375 $ |
| Claude Haiku 5.5 | 0,45 $ | 0,045 $ |
| Claude Sonnet 5 | 7,00 $ | 0,70 $ |
API verwenden
Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.
Eine Aufgabe zum Ausprobieren
Ordne jede Supportnachricht als Abrechnung, Anmeldung oder Störung ein und gib je Nachricht eine Zeile mit Label und kurzer Begründung zurück.
Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "anthropic/claude-haiku-4.5",
"messages": [
{
"role": "user",
"content": "Ordne jede Supportnachricht als Abrechnung, Anmeldung oder Störung ein und gib je Nachricht eine Zeile mit Label und kurzer Begründung zurück."
}
],
"max_tokens": 4096
}
JSONErgebnis prüfen
Vergleiche die Labels mit einem manuell geprüften Satz und verfolge die Eskalationsquote, wenn du unsichere Fälle weiterreichst. Stelle beides dem neueren Haiku an denselben Nachrichten gegenüber.
Fragen zur Auswahl
Ist Haiku 4.5 günstiger als Haiku 5.5?
Nein — in diesem Katalog ist es umgekehrt. Haiku 4.5 listet $1,00 je Million Eingabetoken gegenüber $0,15 bei Haiku 5.5, dazu ein kürzeres Fenster. Prüfe die aktuellen Zahlen auf der Modellseite, bevor du wählst.
Quellen und Geltungsbereich
Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.