Kimi K3

moonshotai/kimi-k3

Kimi K3 ist Moonshot AIs multimodales Open-Weight-Modell für Code, Wissensarbeit und länger laufende Agenten. Es betont Iterationen mit Repositories, Bildern, Logs und Ausführungsergebnissen.

Eingabe · Kontoguthaben
$3.00

je 1 Mio. Tokens

Zahlungsäquivalent $0.30

Ausgabe · Kontoguthaben
$15.00

je 1 Mio. Tokens

Zahlungsäquivalent $1.50

Kontextfenster
1.048.576

tokens · OpenRouter

Eingabe → Ausgabe
Text · Bild · Video→ Text
Modellspezifikationen
Quellen geprüft: Stand des Y-API-Katalogs:

Dieses Modell auswählen

Auswahlhinweise von Y-API. Die vorgeschlagenen Prüfungen sind keine bereits gemessenen Testergebnisse.

Geeignete erste Aufgaben

Bewerte einen echten Ablauf aus Fehleranalyse, Patch, Test und Überarbeitung. Zähle erfüllte Anforderungen und unerwünschte Änderungen statt Planlänge.

Worauf du achten solltest

Werkzeuge, Zustand und Ausführungslimits stammen aus dem Agentensystem, nicht aus der Modell-ID. Kalkuliere auch wiederholt gesendete lange Verläufe.

Modellspezifikationen

Dies sind Modellspezifikationen von OpenRouter, kein Y-API-Kompatibilitätstest. Einzelne Routen können weniger Formate, Parameter oder Tokens akzeptieren. Prüfe benötigte Funktionen mit kleinen Anfragen: Erfolgreicher Text belegt weder Bildverständnis noch Werkzeugaufrufe.

Kontextfenster
1.048.576 tokens
Eingabe
Text · Bild · Video
Ausgabe
Text
Bei OpenRouter gelistet seit
Bei OpenRouter aufgeführte Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
OpenRouter-Modellseite und Spezifikationen

Kosten berechnen

Geschätzter Guthabenverbrauch
10,50 $
Geschätztes Zahlungsäquivalent
1,05 $

Beispielhaftes Tokenbudget, keine Messung oder verbindliches Angebot. Enthält Ein- und Ausgabe, aber keine gesonderten Medienkosten, Cache-Rabatte oder Wiederholungen. Berechnete Reasoning-Tokens gehören zum Ausgabebudget. Die tatsächliche Abrechnung folgt der vom Dienst gemeldeten Nutzung.

$1 Zahlung ergibt $10 Guthaben. Zahlungsäquivalent = verbrauchtes Guthaben ÷ 10; dies ist nicht der Listenpreis des Modellentwicklers.

Gleiches Tokenbudget, andere Modelle
ModellGeschätzter GuthabenverbrauchGeschätztes Zahlungsäquivalent
Kimi K310,50 $1,05 $
Kimi K2.62,95 $0,295 $
Claude Opus 517,50 $1,75 $

API verwenden

Minimale Textanfragen mit der genauen Y-API-Modell-ID. Sie testen keine Bild-, Audio-, Video-, Datei- oder Werkzeugunterstützung. Plane auch Ausgabe für Reasoning ein; leerer Inhalt mit finish_reason=length kann auf ein ausgeschöpftes Budget hinweisen.

Eine Aufgabe zum Ausprobieren

Eine API läuft nur bei großen Exporten in ein Timeout. Unterscheide langsames SQL, Serialisierung und Proxy durch Diagnose ohne Datenänderung.

Setze TOKEN auf einen Schlüssel aus der Konsole und führe das Beispiel lokal oder serverseitig aus. Schlüssel gehören weder in Browsercode noch in öffentliche Repositories.

cURL · Kimi K3
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "moonshotai/kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Eine API läuft nur bei großen Exporten in ein Timeout. Unterscheide langsames SQL, Serialisierung und Proxy durch Diagnose ohne Datenänderung."
    }
  ],
  "max_tokens": 4096
}
JSON

Ergebnis prüfen

Verlange getrennte Messungen und eine sichere Reihenfolge. Prüfe, ob Werkzeugergebnisse die nächste Entscheidung tatsächlich beeinflussen.

Fragen zur Auswahl

Startet K3 automatisch mehrere Agenten?

Nein. Die Orchestrierung liegt beim Client oder deiner Anwendung. Rechte, Budgets und Abbruchbedingungen sind getrennt festzulegen.

Quellen und Geltungsbereich

Technische Angaben stammen aus der genannten Modellseite und gegebenenfalls der verlinkten Entwicklerkarte. Eine Karte beschreibt einen Checkpoint, beweist aber nicht die vom Gateway verwendeten Gewichte. Preise stammen ausschließlich aus dem Y-API-Katalog. Für diesen Endpunkt werden keine gemessene Latenz, Verfügbarkeit oder Benchmarkwerte behauptet.