Kimi K2.8 Preview vs Kimi K3: Welches sollten Sie verwenden?
Kimi K2.8 Preview und Kimi K3 liegen auf unterschiedlichen Ebenen: K3 ist ein öffentliches API-Modell (kimi-k3), K2.8 Preview ist eine Route in Kimi Code (kimi-for-coding). Vergleichen Sie Spezifikationen, Zugriffslimits, Preise und wann Sie welches verwenden sollten.
Published 2026-09-17
Kimi K2.8 Preview und Kimi K3 sind keine zwei Optionen im selben Regal. K3 ist ein öffentliches API-Modell, und K2.8 Preview ist eine Route innerhalb von Kimi Code. Auf Kimis offener Plattform antwortet das Flaggschiff auf kimi-k3; innerhalb von Kimi Code antwortet dasselbe Flaggschiff auf k3, während K2.8 Preview die ältere ID kimi-for-coding behält.
K2.8 Preview ist die leichtere, kostengünstigere Stufe: Jede Kimi-Code-Mitgliedschaftsstufe kann es verwenden, einschließlich des 1M-Token-Fensters, und Moonshot beschreibt seine Gesamtleistung als Annäherung an K3. K3 ist das Flaggschiff mit 2,8 Billionen Parametern, benötigt aber Moderato oder höher, und sein 1M-Fenster benötigt Allegretto oder höher.
Moonshot hat keinen Preis pro Token für K2.8 Preview veröffentlicht, daher gibt es nichts, was neben K3s offiziellen $3,00 pro Million Input-Tokens und $15,00 pro Million Output-Tokens gesetzt werden könnte. Auf APIMaster können Sie kimi-k3 heute mit einem OpenAI-kompatiblen Schlüssel verwenden; K2.8 Preview ist noch kein öffentliches API-Modell, und wir werden es auflisten, sobald Moonshot es für den offenen Markt freigibt.
Dasselbe Modell hat unterschiedliche IDs auf unterschiedlichen Oberflächen
Das ist der Teil, der Menschen verwirrt. Kimi betreibt zwei separate Produkte, und jedes benennt Modelle auf seine eigene Weise.
| Oberfläche | Was es ist | Kimi-K3-ID | Kimi-K2.8-Preview-ID |
|---|---|---|---|
| Kimi offene Plattform | Pay-as-you-go-API für jeden Entwickler | kimi-k3 |
— nicht angeboten |
| Kimi Code | Codierungsdienst, gebündelt mit einer Kimi-Mitgliedschaft | k3, k3-256k |
kimi-for-coding |
Kimi Code bietet derzeit vier Modell-IDs von drei Modellen an: k3 und k3-256k (die 1M- und 262.144-Token-Varianten von K3), kimi-for-coding (K2.8 Preview) und kimi-for-coding-highspeed (K2.7 Code HighSpeed).
Zwei praktische Konsequenzen:
- Senden Sie
kimi-k2.8nicht an eine API. Diese Kennung existiert nirgendwo. Auf Kimis offener Plattform sind die einzigen aktuellen Kimi-Modellekimi-k3,kimi-k2.7-code,kimi-k2.7-code-highspeedundkimi-k2.6. - Ein Gateway, das einen alten Kimi-Namen auflistet, ist nicht automatisch zu K2.8 geworden. Kimis offene Plattform hat die
kimi-k2-Serie im Mai 2026 undkimi-k2.5plus diemoonshot-v1-Familie im August 2026 eingestellt. Keine dieser IDs löst jetzt zu K2.8 Preview auf.
Wofür jedes Modell offiziell positioniert ist
Kimi K3 ist Moonshots leistungsfähigstes Modell. Kimis Modellliste beschreibt es als entwickelt für "Frontier-Intelligenz-Szenarien wie Software-Engineering, Wissensarbeit und tiefes Denken", aufgebaut auf 2,8 Billionen Parametern mit nativem visuellem Verständnis und einem Kontextfenster von 1.048.576 Token. Wir behandeln seine API-Oberfläche, Tool-Calling und Betriebsgrenzen im Kimi-K3-Launch-Guide.
Kimi K2.8 Preview ist für die tägliche Entwicklung positioniert und nicht für Frontier-Arbeit. Kimis Versionshinweise sagen, dass es die Codierungs- und Agent-Fähigkeiten mit spürbar besserer Denkeffizienz als K2.7 Code verbessert und für Code-Vervollständigung und Routine-Entwicklungsaufgaben geeignet ist. Es wurde am 11. September 2026 als vollständiger Rollout innerhalb von Kimi Code ausgeliefert — und die Modell-ID hat sich nicht geändert, sodass bestehende kimi-for-coding-Konfigurationen es ohne Client-Änderung übernommen haben. Unser Kimi-K2.8-Preview-Guide führt Sie durch die Verbindung von Kimi Code mit einem Drittanbieter-Schlüssel.
Die Beziehung zwischen den beiden ist beabsichtigt: K2.8 Preview ist das Standard-Arbeitsmodell, K3 ist der Eskalationspfad.
Spezifikationsvergleich
Alles unten ist Kimis eigene veröffentlichte Spezifikation für Kimi Code, wo beide Modelle derzeit nebeneinander verfügbar sind.
| Kimi K2.8 Preview | Kimi K3 | |
|---|---|---|
| Modell-ID | kimi-for-coding |
k3 / k3-256k |
| Parameteranzahl | Nicht veröffentlicht | 2,8 Billionen |
| Kontextfenster | 1.048.576 Token | 1.048.576 Token (k3) / 262.144 (k3-256k) |
| Reasoning-Aufwand | low / high / max, Standard max |
low / high / max, Standard high |
| Multimodale Eingabe | Bilder und Video | Bilder und Video (k3) / nur Bilder (k3-256k) |
| Wer kann es aufrufen | Jede Mitgliedschaftsstufe | Moderato und höher; 1M-Fenster benötigt Allegretto und höher |
| Relativer Verbrauch | Standard | k3 (1M) kostet ungefähr doppelt so viel wie k3-256k |
| Öffentlicher API-Preis | Nicht veröffentlicht | $0,30 gecachter Input / $3,00 Input / $15,00 Output pro 1M Token |
Eine Routing-Regel ist es wert, auswendig gelernt zu werden, weil sie stillschweigend ändert, welches Modell Ihre Anfrage bedient: Innerhalb von Kimi Code leitet das Deaktivieren des Denkens sowohl K3- als auch K2.8-Preview-Anfragen an K2.8 Preview ohne Denken weiter. Eine Anfrage, die Sie als K3 konfiguriert haben, kann daher von K2.8 beantwortet werden. Dies ist Kimi-Code-Verhalten; gehen Sie nicht davon aus, dass dieselbe Regel für die offene Plattform oder ein Drittanbieter-Gateway gilt.
Was Moonshot nicht veröffentlicht hat
Drei Lücken sind klar zu benennen, weil die meisten Vergleichsinhalte sie mit Vermutungen füllen:
- Parameteranzahl. Kimi hat 2,8T für K3 veröffentlicht. Es gibt keine veröffentlichte Parameteranzahl für K2.8 Preview.
- Benchmarks. Die K2.8-Preview-Ankündigung veröffentlicht keine Scores und keine reproduzierbare K2.8-gegen-K3-Evaluierung. "Nähert sich K3 an" ist Moonshots eigene Einschätzung, keine unabhängige Messung — auch nicht unsere.
- Preis. Siehe nächsten Abschnitt.
Preise: K3 hat eine Zahl, K2.8 Preview nicht
Kimis Preistabelle listet vier Modelle auf. K2.8 Preview ist nicht darunter.
| Modell | Input (Cache-Treffer) | Input (Cache-Fehltreffer) | Output | Kontext |
|---|---|---|---|---|
kimi-k3 |
$0,30/M | $3,00/M | $15,00/M | 1.048.576 |
kimi-k2.7-code |
$0,19/M | $0,95/M | $4,00/M | 262.144 |
kimi-k2.7-code-highspeed |
$0,38/M | $1,90/M | $8,00/M | 262.144 |
kimi-k2.6 |
$0,16/M | $0,95/M | $4,00/M | 262.144 |
| Kimi K2.8 Preview | — | — | — | — |
K2.8 Preview wird als Teil einer Kimi-Code-Mitgliedschaft verkauft, nicht pro Token. Kimi Code teilt sich dasselbe Kontingent wie die Kimi-Mitgliedschaft: Das Kontingent wird alle 7 Tage aufgefrischt, es gibt ein zusätzliches rollierendes 5-Stunden-Fenster, und ein Guthaben für zusätzliche Nutzung übernimmt, wenn das Kontingent erschöpft ist. Kimi beschreibt den Satz für zusätzliche Nutzung nur als "nahe am offiziellen API-Preis der Kimi offenen Plattform, wie auf der Plattform angezeigt" — es veröffentlicht keinen K2.8-Preview-Satz.
Der ehrliche Vergleich ist also nicht "K2.8 ist billiger als K3 um X", sondern "K2.8 wird als Abonnement abgerechnet und K3 als Token." Mit diesem Vorbehalt weisen drei veröffentlichte Fakten darauf hin, dass K2.8 Preview unter K3 bei den Kosten liegt:
- Jede Kimi-Code-Stufe kann K2.8 Preview aufrufen, während K3 Moderato oder höher benötigt.
- K2.8 Preview ist für Vervollständigung und Routine-Entwicklung positioniert, nicht für Frontier-Arbeit.
- Sein nächstgelegenes veröffentlichtes Geschwistermodell auf der offenen Plattform,
kimi-k2.7-code, ist mit $0,95 Input / $4,00 Output pro Million Token bepreist — ungefähr ein Drittel von K3s Input-Preis und ein Viertel seines Output-Preises.
Der APIMaster-Routenpreis für K2.8 Preview ist ein reservierter Platz. Wir kündigen keinen K2.8-Preis oder bestätigte Verfügbarkeit an. Wenn Moonshot das Modell für die öffentliche API freigibt und wir die Route auflisten, kommt die Zahl hierher, und Sie können sie im selben Marktplatz Karte für Karte mit K3 vergleichen.
| Route | Input | Output |
|---|---|---|
| Kimi K3 auf APIMaster (heute) | $2,25/M — 25% unter Kimis offiziellen $3,00/M | $11,25/M — 25% unter Kimis offiziellen $15,00/M |
| Kimi K2.8 Preview auf APIMaster | Reserviert — wird mit der Route veröffentlicht | Reserviert — wird mit der Route veröffentlicht |
Routenpreise und Kanalverfügbarkeit ändern sich. Prüfen Sie die Live-Karte im Marktplatz, bevor Sie Produktionsverkehr umstellen.
Beide Modelle gehören zur selben Familie. Wenn Sie also noch zwischen Kimi und den anderen Frontier-Routen entscheiden, vergleicht die Kimi-API-Seite, was ein einzelner Schlüssel über Kimi, Claude, GPT und DeepSeek abdeckt.
Was das in der Praxis bedeutet
Jenseits des Datenblatts entscheiden vier operative Details darüber, wie sich die Wahl im Alltag anfühlt.
Cache-Invalidierung. Das Ändern des Modells oder des Reasoning-Aufwands invalidiert den Kontext-Cache, sodass die nächste Anfrage das Gespräch neu vorlädt und mehr kostet. Kimi empfiehlt, eine neue Sitzung zu starten, anstatt innerhalb einer langen Sitzung hin und her zu wechseln. Wenn Sie K2.8 und K3 an derselben Aufgabe vergleichen möchten, planen Sie für diese erste teure Anfrage bei jedem ein.
Berechtigungsfehler sehen aus wie Authentifizierungsfehler. Eine Anfrage, die Ihren Plan überschreitet, gibt 401 zurück, keine Kontingentmeldung. Das Aufrufen von k3 unter Moderato, das Anfordern des 1M-Fensters auf Moderato oder das Aufrufen von kimi-for-coding-highspeed unter Allegretto erscheinen alle als 401. Wenn Ihr Schlüssel für ein Modell funktioniert und für ein anderes fehlschlägt, prüfen Sie den Plan, bevor Sie Schlüssel rotieren.
IDs unterscheiden sich pro Oberfläche. Eine k3-Konfiguration ist nur innerhalb von Kimi Code gültig. Auf der offenen Plattform ist dasselbe Modell kimi-k3. Kopieren Sie IDs von der Oberfläche, die Sie tatsächlich aufrufen, und notieren Sie Anbieter, Endpunkt und Modell-ID neben jedem Benchmark, den Sie aufbewahren.
Verifizieren, nicht annehmen. Die eigene Behauptung eines Modells über seine Identität ist kein Beweis dafür, welches Modell eine Anfrage bedient hat. Das ist hier wichtiger als üblich, weil das Deaktivieren des Denkens bei K3 die Anfrage legitim an K2.8 Preview übergibt — ein geroutetes Ergebnis, das wie eine Herabstufung aussieht, wenn Sie es nicht erwartet haben.
Wie man wählt
- Code-Vervollständigung, kleine Refactorings und Routine-Entwicklung: K2.8 Preview. Es ist auf jeder Stufe verfügbar, unterstützt das volle 1M-Fenster und ist die günstigere Route.
- Repository-weite Änderungen, lange Agent-Läufe, tiefes Denken und Wissensarbeit: K3. Seine 2,8T-Parameter-Flaggschiff-Stufe und der 1M-Kontext sind der Grund, mehr zu zahlen.
- Sie benötigen eine öffentliche API, SDK-Kompatibilität oder vorhersehbare Abrechnung pro Token: K3 heute, weil K2.8 Preview keine öffentliche API-ID hat.
- Sie möchten den höchsten Durchsatz innerhalb von Kimi Code: keines der beiden oben genannten —
kimi-for-coding-highspeedbietet ungefähr 6x Output-Geschwindigkeit bei 3x Verbrauch, mit derselben Codierungsfähigkeit wie K2.7 Code.
Worüber die Community spricht
Die beiden Modelle haben sehr unterschiedliche Niveaus öffentlicher Diskussion, und das ist selbst ein nützliches Signal.
K3 wird seit Juli 2026 stark diskutiert. Auf Hacker News erreichte "Kimi K3: Open Frontier Intelligence" 2.107 Punkte und 1.214 Kommentare, "Kimi-K3 on HuggingFace" 1.382 Punkte, "Kimi K3 Is Competitive with Fable" 877 Punkte und "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 Punkte — der letzte ist eine Erinnerung daran, dass Kapazität, nicht nur Qualität, geprägt hat, wie Moonshot seine Modelle verkauft hat. Architekturnotizen, der technische Bericht und lokale Inferenzexperimente (Ausführen von K3 in 29 GB RAM) zogen alle substanzielle Threads an.
K2.8 Preview hat fast keine englischsprachige Berichterstattung: Eine Hacker-News-Suche nach "Kimi K2.8" und "Moonshot K2.8" liefert überhaupt keine Geschichten oder Kommentare, und Mainstream-Drittanbieter-Gateways listen das Modell nicht. Die Diskussion konzentriert sich auf chinesischsprachige Entwicklerkanäle, was mit einem Modell konsistent ist, das derzeit nur innerhalb eines Abonnementprodukts ausgeliefert wird. Behandeln Sie Community-Enthusiasmus für K3 als Beleg für Interesse, nicht als Qualitätsurteil K2.8-gegen-K3.
FAQ
Was ist die Modell-ID für Kimi K2.8 Preview?
Innerhalb von Kimi Code, kimi-for-coding. Die ID hat sich nicht geändert, als das zugrunde liegende Modell aktualisiert wurde, sodass bestehende Konfigurationen weiter funktionieren. Kimis offene Plattform bietet K2.8 Preview nicht an, daher gibt es noch keine öffentliche API-Modell-ID dafür.
Ist Kimi K2.8 Preview besser als Kimi K3?
Moonshot beschreibt K2.8 Preview als Annäherung an K3 mit besserer Denkeffizienz als K2.7 Code, veröffentlicht aber keine Benchmark-Scores dafür. K3 bleibt das Flaggschiff-Modell mit 2,8T Parametern. Für eine echte Antwort führen Sie Ihre eigene Aufgabe aus — einen fehlschlagenden Test, eine Änderung über mehrere Dateien, eine Frage zu einem langen Dokument — auf beiden aus und vergleichen Sie Korrektheit, Abschlusszeit und Kosten.
Kann ich Kimi K3 von einer API aus aufrufen?
Ja. K3 ist ein öffentliches Modell auf Kimis offener Plattform als kimi-k3, und es ist auf APIMaster mit einem OpenAI-kompatiblen Endpunkt verfügbar. K2.8 Preview ist dasjenige, das nicht als öffentliches API-Modell aufrufbar ist.
Warum ist die Kimi-Code-ID k3, wenn die API-ID kimi-k3 ist?
Es sind zwei Produkte mit zwei Benennungsschemata. Kimi Codes vier IDs sind k3, k3-256k, kimi-for-coding und kimi-for-coding-highspeed; die aktuellen IDs der offenen Plattform sind kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed und kimi-k2.6. Kopieren Sie immer die ID von der Oberfläche, die Sie aufrufen.
Gibt mir das Deaktivieren des Denkens Kimi K2.8 Preview?
Innerhalb von Kimi Code, ja: Anfragen, die für K3 oder K2.8 Preview mit deaktiviertem Denken konfiguriert sind, werden beide von K2.8 Preview ohne Denken bedient. Verallgemeinern Sie diese Regel nicht auf die offene Plattform oder ein Drittanbieter-Gateway, ohne die Dokumentation dieses Anbieters zu prüfen.
Ist Kimi K2.8 Preview auf APIMaster verfügbar?
Noch nicht. K2.8 Preview ist kein öffentliches API-Modell, daher gibt es keine Route oder keinen Preis aufzulisten. APIMaster bedient derzeit kimi-k3, kimi-k2.6 und kimi-k2.7-code. Wir werden K2.8 Preview auflisten, sobald Moonshot es für den offenen Markt freigibt, und derselbe API-Schlüssel wird es dann abdecken.
Quellen und Verifikationsdatum
- Kimi Code: Modellkonfiguration, IDs, Limits und Routing, geprüft am 17. September 2026.
- Kimi Code: Versionshinweise zum K2.8-Preview-Rollout vom 11. September 2026.
- Kimi Code: Mitgliedschaft, gemeinsames Kontingent, 5-Stunden-Fenster und zusätzliche Nutzung.
- Kimi offene Plattform: Modellliste und eingestellte Modelle.
- Kimi offene Plattform: Modell-Inferenzpreise.
- Hacker-News-Diskussionen oben zitiert: 48935342, 49065752, 48999291, 48969291.
- APIMaster Live-Preiskatalog und Marktplatzkarten, geprüft am 17. September 2026. Verfügbarkeit und Routenpreise können sich nach der Veröffentlichung ändern.
Beginnen Sie mit Kimi K3 auf APIMaster.ai
K2.8 Preview ist das Modell, das man beobachten sollte; K3 ist das Modell, das Sie jetzt aufrufen können. Auf APIMaster.ai deckt ein einzelner OpenAI-kompatibler Schlüssel Kimi K3 zu 25% unter Kimis offiziellem Preis ab, zusammen mit Claude-, GPT-, DeepSeek-, Gemini- und GLM-Routen, sodass Sie das Flaggschiff gegen den Rest Ihres Stacks benchmarken können, bevor K2.8 Preview eintrifft.
Erstellen Sie ein APIMaster-Konto, generieren Sie einen Schlüssel in der Konsole, richten Sie Ihren Client auf https://apimaster.ai/v1 und setzen Sie das Modell auf kimi-k3. Jeder Kimi-Kanal wird vor der Auflistung per Fingerabdruck geprüft.