APIMaster.ai
Back to Blog
APIMaster Blog

Kimi K2.8 Preview vs Kimi K3: Który powinieneś wybrać?

Kimi K2.8 Preview i Kimi K3 działają na różnych płaszczyznach: K3 to publiczny model API (kimi-k3), K2.8 Preview to trasa Kimi Code (kimi-for-coding). Porównaj specyfikacje, limity dostępu, ceny i kiedy używać którego.

Kimi K2.8 PreviewKimi K3Kimi APIKimi CodeMoonshot AIAPIMaster

Published 2026-09-17

Quick Answer

Kimi K2.8 Preview i Kimi K3 to nie dwie opcje z tej samej półki. K3 to publiczny model API, a K2.8 Preview to trasa wewnątrz Kimi Code. Na otwartej platformie Kimi flagowy model odpowiada na kimi-k3; wewnątrz Kimi Code ten sam flagowy model odpowiada na k3, podczas gdy K2.8 Preview zachowuje starszy identyfikator kimi-for-coding.

K2.8 Preview to lżejszy, tańszy poziom: każdy poziom członkostwa Kimi Code może z niego korzystać, w tym z oknem 1M tokenów, a Moonshot opisuje jego ogólną wydajność jako zbliżającą się do K3. K3 to flagowy model z 2,8 biliona parametrów, ale wymaga Moderato lub wyższego poziomu, a jego okno 1M wymaga Allegretto lub wyższego poziomu.

Moonshot nie opublikował żadnej ceny za token dla K2.8 Preview, więc nie ma nic do zestawienia z oficjalną ceną K3 wynoszącą 3,00 USD za milion tokenów wejściowych i 15,00 USD za milion tokenów wyjściowych. Na APIMaster możesz używać kimi-k3 już dziś z jednym kluczem zgodnym z OpenAI; K2.8 Preview nie jest jeszcze publicznym modelem API i dodamy go do listy, gdy tylko Moonshot udostępni go na otwartym rynku.

Ten sam model ma różne identyfikatory na różnych płaszczyznach

To jest część, która dezorientuje ludzi. Kimi prowadzi dwa osobne produkty i każdy z nich nazywa modele na swój sposób.

Płaszczyzna Co to jest ID Kimi K3 ID Kimi K2.8 Preview
Otwarta platforma Kimi API pay-as-you-go dla każdego dewelopera kimi-k3 — nie oferowane
Kimi Code Usługa kodowania w pakiecie z członkostwem Kimi k3, k3-256k kimi-for-coding

Kimi Code obecnie udostępnia cztery identyfikatory modeli z trzech modeli: k3 i k3-256k (warianty K3 z 1M i 262 144 tokenami), kimi-for-coding (K2.8 Preview) oraz kimi-for-coding-highspeed (K2.7 Code HighSpeed).

Dwie praktyczne konsekwencje:

  • Nie wysyłaj kimi-k2.8 do API. Ten identyfikator nie istnieje nigdzie. Na otwartej platformie Kimi jedynymi obecnymi modelami Kimi są kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed i kimi-k2.6.
  • Brama wyświetlająca starą nazwę Kimi nie stała się automatycznie K2.8. Otwarta platforma Kimi wycofała serię kimi-k2 w maju 2026 roku oraz kimi-k2.5 wraz z rodziną moonshot-v1 w sierpniu 2026 roku. Żaden z tych identyfikatorów nie rozwiązuje się obecnie do K2.8 Preview.

Do czego oficjalnie pozycjonowany jest każdy model

Kimi K3 to najbardziej zaawansowany model Moonshot. Lista modeli Kimi opisuje go jako zaprojektowany do "scenariuszy inteligencji granicznej, takich jak inżynieria oprogramowania, praca intelektualna i głębokie rozumowanie", zbudowany na 2,8 biliona parametrów z natywnym rozumieniem wizualnym i kontekstem 1 048 576 tokenów. Omawiamy jego powierzchnię API, wywoływanie narzędzi i limity operacyjne w przewodniku po starcie Kimi K3.

Kimi K2.8 Preview jest pozycjonowany do codziennego rozwoju, a nie pracy granicznej. Notatki z wydania Kimi mówią, że poprawia zdolności kodowania i agenta przy zauważalnie lepszej wydajności myślenia niż K2.7 Code i nadaje się do uzupełniania kodu i rutynowych zadań programistycznych. Został wydany 11 września 2026 roku jako pełne wdrożenie wewnątrz Kimi Code — a identyfikator modelu się nie zmienił, więc istniejące konfiguracje kimi-for-coding pobrały go bez zmiany klienta. Nasz przewodnik po Kimi K2.8 Preview przeprowadza przez podłączenie Kimi Code do klucza strony trzeciej.

Relacja między nimi jest zamierzona: K2.8 Preview to domyślny model roboczy, K3 to ścieżka eskalacji.

Porównanie specyfikacji

Wszystko poniżej to oficjalna specyfikacja opublikowana przez Kimi dla Kimi Code, gdzie oba modele są obecnie dostępne obok siebie.

Kimi K2.8 Preview Kimi K3
ID modelu kimi-for-coding k3 / k3-256k
Liczba parametrów Nieopublikowana 2,8 biliona
Okno kontekstu 1 048 576 tokenów 1 048 576 tokenów (k3) / 262 144 (k3-256k)
Poziom rozumowania low / high / max, domyślnie max low / high / max, domyślnie high
Wejście multimodalne Obrazy i wideo Obrazy i wideo (k3) / tylko obrazy (k3-256k)
Kto może go wywoływać Każdy poziom członkostwa Moderato i wyżej; okno 1M wymaga Allegretto i wyżej
Względne zużycie Standardowe k3 (1M) kosztuje mniej więcej dwa razy tyle co k3-256k
Cena publicznego API Nieopublikowana 0,30 USD wejście z pamięci podręcznej / 3,00 USD wejście / 15,00 USD wyjście za 1M tokenów

Jedna zasada routingu jest warta zapamiętania, ponieważ po cichu zmienia to, który model obsługuje Twoje żądanie: wewnątrz Kimi Code wyłączenie myślenia kieruje zarówno żądania K3, jak i K2.8 Preview do K2.8 Preview bez myślenia. Żądanie skonfigurowane jako K3 może zatem zostać obsłużone przez K2.8. To zachowanie Kimi Code; nie zakładaj, że ta sama zasada dotyczy otwartej platformy lub bramy strony trzeciej.

Czego Moonshot nie opublikował

Trzy luki warto jasno przedstawić, ponieważ większość treści porównawczych wypełnia je zgadywaniem:

  • Liczba parametrów. Kimi opublikował 2,8T dla K3. Nie ma opublikowanej liczby parametrów dla K2.8 Preview.
  • Benchmarki. Ogłoszenie K2.8 Preview nie publikuje żadnych wyników ani powtarzalnej oceny K2.8 kontra K3. "Zbliża się do K3" to własna ocena Moonshot, a nie niezależny pomiar — w tym nasz.
  • Cena. Zobacz następną sekcję.

Ceny: K3 ma liczbę, K2.8 Preview nie

Tabela cen Kimi wymienia cztery modele. K2.8 Preview nie jest jednym z nich.

Model Wejście (trafienie w pamięć podręczną) Wejście (chybienie pamięci podręcznej) Wyjście Kontekst
kimi-k3 0,30 USD/M 3,00 USD/M 15,00 USD/M 1 048 576
kimi-k2.7-code 0,19 USD/M 0,95 USD/M 4,00 USD/M 262 144
kimi-k2.7-code-highspeed 0,38 USD/M 1,90 USD/M 8,00 USD/M 262 144
kimi-k2.6 0,16 USD/M 0,95 USD/M 4,00 USD/M 262 144
Kimi K2.8 Preview

K2.8 Preview jest sprzedawany jako część członkostwa Kimi Code, a nie za token. Kimi Code dzieli ten sam limit co członkostwo Kimi: limit odświeża się co 7 dni, istnieje dodatkowe ruchome okno 5 godzin, a saldo dodatkowego użycia przejmuje kontrolę, gdy limit się wyczerpie. Kimi opisuje stawkę dodatkowego użycia tylko jako "zbliżoną do oficjalnej ceny API otwartej platformy Kimi, jak pokazano na platformie" — nie publikuje stawki dla K2.8 Preview.

Zatem uczciwe porównanie to nie "K2.8 jest tańszy niż K3 o X", ale "K2.8 jest rozliczany jako subskrypcja, a K3 jako tokeny". Mając to na uwadze, trzy opublikowane fakty wskazują, że K2.8 Preview znajduje się poniżej K3 pod względem kosztów:

  1. Każdy poziom Kimi Code może wywoływać K2.8 Preview, podczas gdy K3 wymaga Moderato lub wyżej.
  2. K2.8 Preview jest pozycjonowany do uzupełniania i rutynowego rozwoju, a nie pracy granicznej.
  3. Jego najbliższy opublikowany odpowiednik na otwartej platformie, kimi-k2.7-code, jest wyceniony na 0,95 USD wejście / 4,00 USD wyjście za milion tokenów — mniej więcej jedną trzecią ceny wejścia K3 i jedną czwartą ceny wyjścia.

Cena trasy APIMaster dla K2.8 Preview to zarezerwowane miejsce. Nie ogłaszamy ceny K2.8 ani potwierdzonej dostępności. Gdy Moonshot udostępni model w publicznym API, a my dodamy trasę do listy, tutaj pojawi się liczba i będziesz mógł porównać ją z K3 karta w kartę na tym samym rynku.

Trasa Wejście Wyjście
Kimi K3 na APIMaster (dziś) 2,25 USD/M — 25% poniżej oficjalnych 3,00 USD/M Kimi 11,25 USD/M — 25% poniżej oficjalnych 15,00 USD/M Kimi
Kimi K2.8 Preview na APIMaster Zarezerwowane — do opublikowania z trasą Zarezerwowane — do opublikowania z trasą

Ceny tras i dostępność kanałów się zmieniają. Sprawdź aktywną kartę w marketplace przed przeniesieniem ruchu produkcyjnego.

Oba modele należą do tej samej rodziny, więc jeśli wciąż decydujesz między Kimi a innymi trasami granicznymi, strona API Kimi porównuje, co obejmuje jeden klucz w Kimi, Claude, GPT i DeepSeek.

Co to oznacza w praktyce

Poza arkuszem specyfikacji cztery szczegóły operacyjne decydują o tym, jak wybór odczuwalny jest na co dzień.

Unieważnianie pamięci podręcznej. Zmiana modelu lub zmiana poziomu rozumowania unieważnia pamięć podręczną kontekstu, więc następne żądanie ponownie wstępnie wypełnia rozmowę i kosztuje więcej. Kimi zaleca rozpoczęcie nowej sesji zamiast przełączania się tam i z powrotem w długiej sesji. Jeśli planujesz porównać K2.8 i K3 na tym samym zadaniu, zaplanuj budżet na to pierwsze kosztowne żądanie dla każdego.

Błędy uprawnień wyglądają jak błędy uwierzytelniania. Żądanie przekraczające Twój plan zwraca 401, a nie komunikat o limicie. Wywołanie k3 poniżej Moderato, żądanie okna 1M na Moderato lub wywołanie kimi-for-coding-highspeed poniżej Allegretto — wszystko to objawia się jako 401. Jeśli Twój klucz działa dla jednego modelu, a nie działa dla innego, sprawdź plan przed rotacją kluczy.

Identyfikatory różnią się w zależności od płaszczyzny. Konfiguracja k3 jest ważna tylko wewnątrz Kimi Code. Na otwartej platformie ten sam model to kimi-k3. Kopiuj identyfikatory z płaszczyzny, którą faktycznie wywołujesz, i zapisuj dostawcę, punkt końcowy i ID modelu obok każdego benchmarku, który prowadzisz.

Weryfikuj, nie zakładaj. Twierdzenie modelu o własnej tożsamości nie jest dowodem na to, który model obsłużył żądanie. To ma znaczenie bardziej niż zwykle, ponieważ wyłączenie myślenia na K3 legalnie przekazuje żądanie do K2.8 Preview — wynik trasowany, który wygląda jak degradacja, jeśli się tego nie spodziewałeś.

Jak wybrać

  • Uzupełnianie kodu, małe refaktoryzacje i rutynowy rozwój: K2.8 Preview. Jest dostępny na każdym poziomie, obsługuje pełne okno 1M i jest tańszą trasą.
  • Zmiany na skalę repozytorium, długie przebiegi agenta, głębokie rozumowanie i praca intelektualna: K3. Jego flagowy poziom z 2,8T parametrów i kontekst 1M to powód, by płacić więcej.
  • Potrzebujesz publicznego API, zgodności z SDK lub przewidywalnego rozliczania za token: K3 dziś, ponieważ K2.8 Preview nie ma publicznego ID API.
  • Chcesz najwyższej przepustowości wewnątrz Kimi Code: żaden z powyższych — kimi-for-coding-highspeed zapewnia mniej więcej 6-krotną prędkość wyjścia przy 3-krotnym zużyciu, z taką samą zdolnością kodowania jak K2.7 Code.

O czym mówi społeczność

Oba modele mają bardzo różne poziomy publicznej dyskusji, co samo w sobie jest użytecznym sygnałem.

K3 jest intensywnie dyskutowany od lipca 2026 roku. Na Hacker News "Kimi K3: Open Frontier Intelligence" osiągnął 2 107 punktów i 1 214 komentarzy, "Kimi-K3 on HuggingFace" 1 382 punkty, "Kimi K3 Is Competitive with Fable" 877 punktów, a "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 punkty — ten ostatni przypomina, że przepustowość, a nie tylko jakość, ukształtowała sposób, w jaki Moonshot zdecydował się sprzedawać swoje modele. Notatki architektoniczne, raport techniczny i eksperymenty z lokalną inferencją (uruchomienie K3 w 29 GB RAM) przyciągnęły znaczące wątki.

K2.8 Preview ma prawie zerowe pokrycie w języku angielskim: wyszukiwanie na Hacker News dla "Kimi K2.8" i "Moonshot K2.8" nie zwraca żadnych historii ani komentarzy, a główne bramy stron trzecich nie wymieniają modelu. Dyskusja koncentruje się w chińskojęzycznych kanałach deweloperskich, co jest spójne z modelem, który obecnie jest dostępny tylko w produkcie subskrypcyjnym. Traktuj entuzjazm społeczności wobec K3 jako dowód zainteresowania, a nie werdykt jakościowy K2.8 kontra K3.

FAQ

Jaki jest identyfikator modelu dla Kimi K2.8 Preview?

Wewnątrz Kimi Code — kimi-for-coding. Identyfikator nie zmienił się, gdy bazowy model został ulepszony, więc istniejące konfiguracje działają dalej. Otwarta platforma Kimi nie oferuje K2.8 Preview, więc nie ma jeszcze publicznego ID modelu API dla niego.

Czy Kimi K2.8 Preview jest lepszy niż Kimi K3?

Moonshot opisuje K2.8 Preview jako zbliżający się do K3 z lepszą wydajnością myślenia niż K2.7 Code, ale nie publikuje żadnych wyników benchmarków dla niego. K3 pozostaje flagowym modelem z 2,8T parametrów. Aby uzyskać prawdziwą odpowiedź, uruchom własne zadanie — nieudany test, zmianę w wielu plikach, pytanie o długi dokument — na obu i porównaj poprawność, czas ukończenia i koszt.

Czy mogę wywołać Kimi K3 z API?

Tak. K3 to publiczny model na otwartej platformie Kimi jako kimi-k3 i jest dostępny na APIMaster z punktem końcowym zgodnym z OpenAI. K2.8 Preview to ten, którego nie można wywołać jako publicznego modelu API.

Dlaczego ID w Kimi Code to k3, skoro ID API to kimi-k3?

To dwa produkty z dwoma schematami nazewnictwa. Cztery ID Kimi Code to k3, k3-256k, kimi-for-coding i kimi-for-coding-highspeed; obecne ID otwartej platformy to kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed i kimi-k2.6. Zawsze kopiuj ID z płaszczyzny, którą wywołujesz.

Czy wyłączenie myślenia daje mi Kimi K2.8 Preview?

Wewnątrz Kimi Code tak: żądania skonfigurowane dla K3 lub K2.8 Preview z wyłączonym myśleniem są obsługiwane przez K2.8 Preview bez myślenia. Nie uogólniaj tej zasady na otwartą platformę lub bramę strony trzeciej bez sprawdzenia dokumentacji tego dostawcy.

Czy Kimi K2.8 Preview jest dostępny na APIMaster?

Jeszcze nie. K2.8 Preview nie jest publicznym modelem API, więc nie ma trasy ani ceny do wymienienia. APIMaster obecnie obsługuje kimi-k3, kimi-k2.6 i kimi-k2.7-code. Dodamy K2.8 Preview do listy, gdy tylko Moonshot udostępni go na otwartym rynku, a ten sam klucz API będzie go wtedy obejmował.

Źródła i data weryfikacji

Zacznij z Kimi K3 na APIMaster.ai

K2.8 Preview to model, który warto obserwować; K3 to model, który możesz wywołać już teraz. Na APIMaster.ai jeden klucz zgodny z OpenAI obejmuje Kimi K3 w cenie 25% poniżej oficjalnej ceny Kimi, obok tras Claude, GPT, DeepSeek, Gemini i GLM, więc możesz porównać flagowy model z resztą swojego stosu, zanim K2.8 Preview trafi na rynek.

Utwórz konto APIMaster, wygeneruj klucz w konsoli, skieruj swojego klienta na https://apimaster.ai/v1 i ustaw model na kimi-k3. Każdy kanał Kimi jest sprawdzany pod kątem odcisku palca, zanim trafi do listy.