Kimi K2.8 Preview vs Kimi K3: Mana yang Harus Anda Gunakan?
Kimi K2.8 Preview dan Kimi K3 berada di permukaan yang berbeda: K3 adalah model API publik (kimi-k3), K2.8 Preview adalah rute Kimi Code (kimi-for-coding). Bandingkan spesifikasi, batas akses, harga, dan kapan menggunakan masing-masing.
Published 2026-09-17
Kimi K2.8 Preview dan Kimi K3 bukanlah dua opsi di rak yang sama. K3 adalah model API publik, dan K2.8 Preview adalah rute di dalam Kimi Code. Di platform terbuka Kimi, model unggulan merespons dengan nama kimi-k3; di dalam Kimi Code, model unggulan yang sama merespons dengan nama k3, sementara K2.8 Preview mempertahankan ID lama kimi-for-coding.
K2.8 Preview adalah tingkatan yang lebih ringan dan lebih murah: setiap tingkatan keanggotaan Kimi Code dapat menggunakannya, termasuk jendela 1M token, dan Moonshot menggambarkan kinerja keseluruhannya sebagai mendekati K3. K3 adalah model unggulan dengan 2,8 triliun parameter, tetapi membutuhkan Moderato atau lebih tinggi, dan jendela 1M-nya membutuhkan Allegretto atau lebih tinggi.
Moonshot belum memublikasikan harga per token untuk K2.8 Preview, jadi tidak ada yang bisa dibandingkan dengan harga resmi K3 sebesar $3,00 per juta token input dan $15,00 per juta token output. Di APIMaster Anda dapat menggunakan kimi-k3 hari ini dengan satu kunci yang kompatibel dengan OpenAI; K2.8 Preview belum menjadi model API publik, dan kami akan mencantumkannya segera setelah Moonshot membukanya ke pasar terbuka.
Model yang sama memiliki ID berbeda di permukaan yang berbeda
Inilah bagian yang sering membuat orang bingung. Kimi menjalankan dua produk terpisah, dan masing-masing memberi nama model dengan caranya sendiri.
| Permukaan | Apa itu | ID Kimi K3 | ID Kimi K2.8 Preview |
|---|---|---|---|
| Platform terbuka Kimi | API bayar-per-pakai untuk pengembang mana pun | kimi-k3 |
— tidak ditawarkan |
| Kimi Code | Layanan coding yang dibundel dengan keanggotaan Kimi | k3, k3-256k |
kimi-for-coding |
Kimi Code saat ini mengekspos empat ID model dari tiga model: k3 dan k3-256k (varian 1M dan 262.144 token dari K3), kimi-for-coding (K2.8 Preview), dan kimi-for-coding-highspeed (K2.7 Code HighSpeed).
Dua konsekuensi praktis:
- Jangan kirim
kimi-k2.8ke API. Pengidentifikasi itu tidak ada di mana pun. Di platform terbuka Kimi, satu-satunya model Kimi saat ini adalahkimi-k3,kimi-k2.7-code,kimi-k2.7-code-highspeed, dankimi-k2.6. - Gateway yang mencantumkan nama Kimi lama tidak otomatis menjadi K2.8. Platform terbuka Kimi menghentikan seri
kimi-k2pada Mei 2026 dankimi-k2.5plus keluargamoonshot-v1pada Agustus 2026. Tidak satu pun dari ID tersebut yang kini merespons sebagai K2.8 Preview.
Posisi resmi masing-masing model
Kimi K3 adalah model paling mumpuni milik Moonshot. Daftar model Kimi menggambarkannya sebagai model yang dirancang untuk "skenario intelijen kelas frontier seperti rekayasa perangkat lunak, pekerjaan pengetahuan, dan penalaran mendalam," dibangun di atas 2,8 triliun parameter dengan pemahaman visual native dan jendela konteks 1.048.576 token. Kami membahas permukaan API, pemanggilan alat, dan batas operasionalnya di panduan peluncuran Kimi K3.
Kimi K2.8 Preview diposisikan untuk pengembangan sehari-hari, bukan pekerjaan kelas frontier. Catatan rilis Kimi mengatakan model ini meningkatkan kemampuan coding dan agen dengan efisiensi berpikir yang jauh lebih baik daripada K2.7 Code, dan cocok untuk penyelesaian kode dan tugas pengembangan rutin. Model ini dirilis pada 11 September 2026 sebagai peluncuran penuh di dalam Kimi Code — dan ID modelnya tidak berubah, sehingga konfigurasi kimi-for-coding yang ada langsung menggunakannya tanpa perubahan klien. Panduan Kimi K2.8 Preview kami memandu Anda menghubungkan Kimi Code ke kunci pihak ketiga.
Hubungan antara keduanya disengaja: K2.8 Preview adalah model kerja default, K3 adalah jalur eskalasi.
Perbandingan spesifikasi
Semua di bawah ini adalah spesifikasi resmi yang dipublikasikan Kimi untuk Kimi Code, tempat kedua model saat ini tersedia berdampingan.
| Kimi K2.8 Preview | Kimi K3 | |
|---|---|---|
| ID Model | kimi-for-coding |
k3 / k3-256k |
| Jumlah parameter | Tidak dipublikasikan | 2,8 triliun |
| Jendela konteks | 1.048.576 token | 1.048.576 token (k3) / 262.144 (k3-256k) |
| Upaya penalaran | low / high / max, default max |
low / high / max, default high |
| Input multimodal | Gambar dan video | Gambar dan video (k3) / gambar saja (k3-256k) |
| Siapa yang dapat memanggilnya | Setiap tingkatan keanggotaan | Moderato dan di atasnya; jendela 1M membutuhkan Allegretto dan di atasnya |
| Konsumsi relatif | Standar | k3 (1M) memakan biaya sekitar dua kali lipat k3-256k |
| Harga API publik | Tidak dipublikasikan | $0,30 input cache / $3,00 input / $15,00 output per 1M token |
Satu aturan perutean layak dihafal karena secara diam-diam mengubah model mana yang melayani permintaan Anda: di dalam Kimi Code, mematikan mode berpikir mengarahkan permintaan K3 dan K2.8 Preview ke K2.8 Preview tanpa berpikir. Permintaan yang Anda konfigurasikan sebagai K3 karena itu bisa dijawab oleh K2.8. Ini adalah perilaku Kimi Code; jangan berasumsi aturan yang sama berlaku untuk platform terbuka atau gateway pihak ketiga.
Apa yang belum dipublikasikan Moonshot
Tiga celah layak disebutkan secara gamblang, karena sebagian besar konten perbandingan mengisinya dengan tebakan:
- Jumlah parameter. Kimi memublikasikan 2,8T untuk K3. Tidak ada jumlah parameter yang dipublikasikan untuk K2.8 Preview.
- Benchmark. Pengumuman K2.8 Preview tidak memublikasikan skor apa pun dan tidak ada evaluasi K2.8-versus-K3 yang dapat direproduksi. "Mendekati K3" adalah penilaian Moonshot sendiri, bukan pengukuran independen — termasuk milik kami.
- Harga. Lihat bagian berikutnya.
Harga: K3 punya angka, K2.8 Preview tidak
Tabel harga Kimi mencantumkan empat model. K2.8 Preview bukan salah satunya.
| Model | Input (cache hit) | Input (cache miss) | Output | Konteks |
|---|---|---|---|---|
kimi-k3 |
$0,30/Jt | $3,00/Jt | $15,00/Jt | 1.048.576 |
kimi-k2.7-code |
$0,19/Jt | $0,95/Jt | $4,00/Jt | 262.144 |
kimi-k2.7-code-highspeed |
$0,38/Jt | $1,90/Jt | $8,00/Jt | 262.144 |
kimi-k2.6 |
$0,16/Jt | $0,95/Jt | $4,00/Jt | 262.144 |
| Kimi K2.8 Preview | — | — | — | — |
K2.8 Preview dijual sebagai bagian dari keanggotaan Kimi Code, bukan per token. Kimi Code berbagi kuota yang sama dengan keanggotaan Kimi: kuota diperbarui setiap 7 hari, ada jendela bergulir tambahan 5 jam, dan saldo penggunaan ekstra mengambil alih saat kuota habis. Kimi menggambarkan tarif penggunaan ekstra hanya sebagai "mendekati harga API resmi platform terbuka Kimi, seperti yang ditampilkan di platform" — tidak memublikasikan tarif K2.8 Preview.
Jadi perbandingan yang jujur bukanlah "K2.8 lebih murah daripada K3 sebesar X" melainkan "K2.8 ditagih sebagai langganan dan K3 sebagai token." Dengan demikian, tiga fakta yang dipublikasikan menunjukkan K2.8 Preview berada di bawah K3 dalam hal biaya:
- Setiap tingkatan Kimi Code dapat memanggil K2.8 Preview, sementara K3 membutuhkan Moderato atau di atasnya.
- K2.8 Preview diposisikan untuk penyelesaian dan pengembangan rutin, bukan pekerjaan frontier.
- Saudara terdekatnya yang dipublikasikan di platform terbuka,
kimi-k2.7-code, dibanderol $0,95 input / $4,00 output per juta token — sekitar sepertiga dari harga input K3 dan seperempat dari harga outputnya.
Harga rute APIMaster untuk K2.8 Preview adalah slot yang dicadangkan. Kami tidak mengumumkan harga K2.8 atau ketersediaan yang dikonfirmasi. Saat Moonshot membuka model ke API publik dan kami mencantumkan rutenya, di sinilah angka itu akan muncul, dan Anda akan dapat membandingkannya dengan K3 kartu demi kartu di marketplace yang sama.
| Rute | Input | Output |
|---|---|---|
| Kimi K3 di APIMaster (hari ini) | $2,25/Jt — 25% di bawah harga resmi Kimi $3,00/Jt | $11,25/Jt — 25% di bawah harga resmi Kimi $15,00/Jt |
| Kimi K2.8 Preview di APIMaster | Dicadangkan — akan dipublikasikan dengan rute | Dicadangkan — akan dipublikasikan dengan rute |
Harga rute dan pasokan saluran dapat berubah. Periksa kartu langsung di marketplace sebelum memindahkan lalu lintas produksi.
Kedua model berasal dari keluarga yang sama, jadi jika Anda masih memutuskan antara Kimi dan rute frontier lainnya, halaman API Kimi membandingkan cakupan satu kunci di seluruh Kimi, Claude, GPT, dan DeepSeek.
Apa artinya ini dalam praktik
Di luar lembar spesifikasi, empat detail operasional menentukan bagaimana pilihan terasa sehari-hari.
Invalidasi cache. Mengubah model atau mengubah upaya penalaran membatalkan cache konteks, sehingga permintaan berikutnya mengisi ulang percakapan dan memakan biaya lebih banyak. Kimi merekomendasikan memulai sesi baru alih-alih bolak-balik di dalam sesi yang panjang. Jika Anda berencana membandingkan K2.8 dan K3 pada tugas yang sama, anggarkan untuk permintaan mahal pertama di masing-masing.
Kesalahan izin terlihat seperti kesalahan autentikasi. Permintaan yang melebihi paket Anda mengembalikan 401, bukan pesan kuota. Memanggil k3 di bawah Moderato, meminta jendela 1M di Moderato, atau memanggil kimi-for-coding-highspeed di bawah Allegretto semuanya muncul sebagai 401. Jika kunci Anda berfungsi untuk satu model dan gagal untuk model lain, periksa paket sebelum memutar kunci.
ID berbeda per permukaan. Konfigurasi k3 hanya valid di dalam Kimi Code. Di platform terbuka, model yang sama adalah kimi-k3. Salin ID dari permukaan yang benar-benar Anda panggil, dan catat penyedia, endpoint, dan ID model di samping benchmark apa pun yang Anda simpan.
Verifikasi, jangan berasumsi. Klaim model tentang identitasnya sendiri bukanlah bukti model mana yang melayani permintaan. Ini lebih penting dari biasanya di sini, karena menonaktifkan mode berpikir di K3 secara sah menyerahkan permintaan ke K2.8 Preview — hasil yang dirutekan yang terlihat seperti penurunan versi jika Anda tidak mengharapkannya.
Cara memilih
- Penyelesaian kode, refaktor kecil, dan pengembangan rutin: K2.8 Preview. Tersedia di setiap tingkatan, mendukung jendela 1M penuh, dan merupakan rute yang lebih murah.
- Perubahan skala repositori, proses agen panjang, penalaran mendalam, dan pekerjaan pengetahuan: K3. Tingkatan unggulan 2,8T parameter dan konteks 1M adalah alasan untuk membayar lebih.
- Anda membutuhkan API publik, kompatibilitas SDK, atau penagihan per token yang dapat diprediksi: K3 hari ini, karena K2.8 Preview tidak memiliki ID API publik.
- Anda menginginkan throughput tertinggi di dalam Kimi Code: bukan keduanya —
kimi-for-coding-highspeedmenyediakan kecepatan output sekitar 6x dengan konsumsi 3x, dengan kemampuan coding yang sama dengan K2.7 Code.
Apa yang dibicarakan komunitas
Kedua model memiliki tingkat diskusi publik yang sangat berbeda, dan itu sendiri merupakan sinyal yang berguna.
K3 telah banyak dibahas sejak Juli 2026. Di Hacker News, "Kimi K3: Open Frontier Intelligence" mencapai 2.107 poin dan 1.214 komentar, "Kimi-K3 on HuggingFace" 1.382 poin, "Kimi K3 Is Competitive with Fable" 877 poin, dan "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 poin — yang terakhir adalah pengingat bahwa kapasitas, bukan hanya kualitas, membentuk cara Moonshot memilih menjual modelnya. Catatan arsitektur, laporan teknis, dan eksperimen inferensi lokal (menjalankan K3 dalam RAM 29 GB) semuanya menarik thread yang substansial.
K2.8 Preview hampir tidak memiliki liputan berbahasa Inggris: pencarian Hacker News untuk "Kimi K2.8" dan "Moonshot K2.8" tidak mengembalikan cerita atau komentar sama sekali, dan gateway pihak ketiga mainstream tidak mencantumkan model tersebut. Diskusi terkonsentrasi di saluran pengembang berbahasa Mandarin, yang konsisten dengan model yang saat ini hanya dikirim di dalam produk langganan. Perlakukan antusiasme komunitas untuk K3 sebagai bukti minat, bukan sebagai vonis kualitas K2.8-versus-K3.
FAQ
Apa ID model untuk Kimi K2.8 Preview?
Di dalam Kimi Code, kimi-for-coding. ID tidak berubah saat model yang mendasarinya ditingkatkan, sehingga konfigurasi yang ada tetap berfungsi. Platform terbuka Kimi tidak menawarkan K2.8 Preview, jadi belum ada ID model API publik untuk itu.
Apakah Kimi K2.8 Preview lebih baik daripada Kimi K3?
Moonshot menggambarkan K2.8 Preview sebagai mendekati K3 dengan efisiensi berpikir yang lebih baik daripada K2.7 Code, tetapi tidak memublikasikan skor benchmark untuk itu. K3 tetap menjadi model unggulan 2,8T parameter. Untuk jawaban nyata, jalankan tugas Anda sendiri — tes yang gagal, perubahan multi-file, pertanyaan dokumen panjang — di keduanya dan bandingkan kebenaran, waktu penyelesaian, dan biaya.
Bisakah saya memanggil Kimi K3 dari API?
Ya. K3 adalah model publik di platform terbuka Kimi sebagai kimi-k3, dan tersedia di APIMaster dengan endpoint yang kompatibel dengan OpenAI. K2.8 Preview-lah yang tidak dapat dipanggil sebagai model API publik.
Mengapa ID Kimi Code k3 padahal ID API-nya kimi-k3?
Mereka adalah dua produk dengan dua skema penamaan. Empat ID Kimi Code adalah k3, k3-256k, kimi-for-coding, dan kimi-for-coding-highspeed; ID platform terbuka saat ini adalah kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed, dan kimi-k2.6. Selalu salin ID dari permukaan yang Anda panggil.
Apakah menonaktifkan mode berpikir memberi saya Kimi K2.8 Preview?
Di dalam Kimi Code, ya: permintaan yang dikonfigurasi untuk K3 atau K2.8 Preview dengan mode berpikir dimatikan keduanya dilayani oleh K2.8 Preview tanpa berpikir. Jangan menggeneralisasi aturan ini ke platform terbuka atau gateway pihak ketiga tanpa memeriksa dokumentasi penyedia tersebut.
Apakah Kimi K2.8 Preview tersedia di APIMaster?
Belum. K2.8 Preview bukan model API publik, jadi belum ada rute atau harga untuk dicantumkan. APIMaster saat ini melayani kimi-k3, kimi-k2.6, dan kimi-k2.7-code. Kami akan mencantumkan K2.8 Preview segera setelah Moonshot membukanya ke pasar terbuka, dan kunci API yang sama akan mencakupnya.
Sumber dan tanggal verifikasi
- Kimi Code: konfigurasi model, ID, batas, dan perutean, diperiksa 17 September 2026.
- Kimi Code: catatan rilis untuk peluncuran K2.8 Preview 11 September 2026.
- Kimi Code: keanggotaan, kuota bersama, jendela 5 jam, dan penggunaan ekstra.
- Platform terbuka Kimi: daftar model dan model yang dihentikan.
- Platform terbuka Kimi: harga inferensi model.
- Diskusi Hacker News yang dikutip di atas: 48935342, 49065752, 48999291, 48969291.
- Katalog harga langsung APIMaster dan kartu marketplace, diperiksa 17 September 2026. Ketersediaan dan harga rute dapat berubah setelah publikasi.
Mulai dengan Kimi K3 di APIMaster.ai
K2.8 Preview adalah model yang perlu diperhatikan; K3 adalah model yang dapat Anda panggil sekarang. Di APIMaster.ai satu kunci yang kompatibel dengan OpenAI mencakup Kimi K3 dengan harga 25% di bawah harga resmi Kimi, bersama dengan rute Claude, GPT, DeepSeek, Gemini, dan GLM, sehingga Anda dapat melakukan benchmark model unggulan terhadap seluruh tumpukan Anda sebelum K2.8 Preview hadir.
Buat akun APIMaster, buat kunci di konsol, arahkan klien Anda ke https://apimaster.ai/v1 dan atur model ke kimi-k3. Setiap saluran Kimi diperiksa sidik jarinya sebelum dicantumkan.