Moonshot AI

2 Modelle mit geprüften Leitfäden

Alle Modelle

Moonshot AIs Kimi-Reihe hat bei Y-API zwei multimodale Einträge: K2.6 mit 262.144-Token-Fenster, fokussiert auf Codieren und UI-Arbeit, und K3 mit einem vollen Million-Token-Fenster für langlebige Agenten und repositoryweite Aufgaben.

Quellen geprüft: Y-API-Katalog-Schnappschuss:

Über diesen Anbieter

Anbieterübergreifende Auswahlhinweise von Y-API. Modellspezifische Prüfungen stehen auf den verlinkten Seiten; hier gibt es keine gemessenen Vergleiche.

Sein Platz im Katalog

Kimi besetzt die Premiumstufe offener Gewichte: über GLM und DeepSeek im Preis, unter Claude und GPT-5.6, mit dem Unterscheidungsmerkmal, dass K3s Gewichte veröffentlicht sind und seine Karte prüfbar ist — was geschlossene Frontier-Modelle nicht erlauben.

Worauf zu achten ist

Die rund 4× Ausgabepreis-Lücke zwischen K3 und K2.6 macht die Modellwahl zur Budgetentscheidung, und agentische Schleifen vervielfachen die Exposition, weil jeder Durchgang Kontext zum Eingabepreis neu liest. K2.6s kleineres Fenster verändert auch, was „lange Aufgabe“ dort bedeutet.

Modelle bei Y-API

Die Preise sind Guthaben-Schnappschüsse aus dem Y-API-Katalog. Jedes Modell verlinkt auf seinen eigenen Leitfaden mit Kostenschätzer und Anfragebeispiel.

Moonshot AI · Modelle bei Y-API
ModellKontextfensterEingabe / 1M TokenAusgabe / 1M Token
Kimi K3moonshotai/kimi-k31,048,576$3.00$0.30$15.00$1.50
Kimi K2.6moonshotai/kimi-k2.6262,144$0.95$0.095$4.00$0.40

Kontoguthaben / Geldäquivalent · $1 Zahlung fügt $10 Guthaben hinzu; das Geldäquivalent ist verbrauchtes Guthaben ÷ 10. Dies sind Y-API-Preise, keine offiziellen Listenpreise des Herausgebers.

Auswahl innerhalb der Reihe

Leiten Sie UI-Generierung und begrenzte Codieraufgaben zuerst an K2.6 und befördern Sie eine Last zu K3, wenn Aufgaben nachweislich das Fenster sprengen oder viele Werkzeugdurchgänge laufen. Vergleichen Sie beide mit GLM 5.3 und Claude Sonnet 5 an derselben Repository-Aufgabe.

Vor der Entscheidung

Wann ist Kimi K3 seinen Aufpreis gegenüber K2.6 wert?

Nur ein Vergleich auf Aufgabenebene kann das belegen. K3s Million-Token-Fenster und Agentenfokus wirken, wenn Arbeit tatsächlich 262.144 Token übersteigt oder lange Werkzeugschleifen läuft; bei begrenzter Komponentenarbeit rechtfertigt der Preisunterschied selten.

Quellen & Geltungsbereich

Die Abdeckung dieses Anbieters auf dieser Site ist genau die obige Liste geprüfter Modell-Leitfäden; eine Anbieterseite existiert nur, solange mindestens eines ihrer Modelle geprüft ist. Aussagen zu Architektur und Positionierung folgen den zitierten Quellen. Wir veröffentlichen keine gemessenen Latenzen, Verfügbarkeiten oder Benchmark-Werte irgendeines Anbieters.