Kimi K2.8 Preview vs Kimi K3: Quale Dovresti Usare?
Kimi K2.8 Preview e Kimi K3 si trovano su superfici diverse: K3 è un modello API pubblico (kimi-k3), K2.8 Preview è una route di Kimi Code (kimi-for-coding). Confronta specifiche, limiti di accesso, prezzi e quando usare ciascuno.
Published 2026-09-17
Kimi K2.8 Preview e Kimi K3 non sono due opzioni sullo stesso scaffale. K3 è un modello API pubblico, e K2.8 Preview è una route all'interno di Kimi Code. Sulla piattaforma aperta di Kimi il modello di punta risponde a kimi-k3; all'interno di Kimi Code lo stesso modello di punta risponde a k3, mentre K2.8 Preview mantiene il vecchio ID kimi-for-coding.
K2.8 Preview è il livello più leggero e a costo inferiore: ogni livello di abbonamento Kimi Code può usarlo, inclusa la finestra da 1M token, e Moonshot descrive le sue prestazioni complessive come vicine a quelle di K3. K3 è il modello di punta con 2,8 trilioni di parametri, ma richiede Moderato o superiore, e la sua finestra da 1M richiede Allegretto o superiore.
Moonshot non ha pubblicato alcun prezzo per token per K2.8 Preview, quindi non c'è nulla da confrontare con il prezzo ufficiale di K3 di $3,00 per milione di token di input e $15,00 per milione di token di output. Su APIMaster puoi usare kimi-k3 oggi con una singola chiave compatibile OpenAI; K2.8 Preview non è ancora un modello API pubblico, e lo elencheremo appena Moonshot lo aprirà al mercato aperto.
Lo stesso modello ha ID diversi su superfici diverse
Questa è la parte che confonde le persone. Kimi gestisce due prodotti separati, e ciascuno nomina i modelli a modo suo.
| Superficie | Cos'è | ID Kimi K3 | ID Kimi K2.8 Preview |
|---|---|---|---|
| Piattaforma aperta Kimi | API pay-as-you-go per qualsiasi sviluppatore | kimi-k3 |
— non offerto |
| Kimi Code | Servizio di coding incluso in un abbonamento Kimi | k3, k3-256k |
kimi-for-coding |
Kimi Code espone attualmente quattro ID modello da tre modelli: k3 e k3-256k (le varianti da 1M e 262.144 token di K3), kimi-for-coding (K2.8 Preview) e kimi-for-coding-highspeed (K2.7 Code HighSpeed).
Due conseguenze pratiche:
- Non inviare
kimi-k2.8a un'API. Quell'identificatore non esiste da nessuna parte. Sulla piattaforma aperta di Kimi, gli unici modelli Kimi attuali sonokimi-k3,kimi-k2.7-code,kimi-k2.7-code-highspeedekimi-k2.6. - Un gateway che elenca un vecchio nome Kimi non è diventato automaticamente K2.8. La piattaforma aperta di Kimi ha interrotto la serie
kimi-k2a maggio 2026 ekimi-k2.5più la famigliamoonshot-v1ad agosto 2026. Nessuno di questi ID ora risolve a K2.8 Preview.
Posizionamento ufficiale di ciascun modello
Kimi K3 è il modello più capace di Moonshot. La lista dei modelli di Kimi lo descrive come progettato per "scenari di intelligenza di frontiera come ingegneria del software, lavoro di conoscenza e ragionamento profondo", costruito su 2,8 trilioni di parametri con comprensione visiva nativa e una finestra di contesto di 1.048.576 token. Copriamo la sua superficie API, il tool calling e i limiti operativi nella guida al lancio di Kimi K3.
Kimi K2.8 Preview è posizionato per lo sviluppo quotidiano piuttosto che per il lavoro di frontiera. Le note di rilascio di Kimi dicono che migliora le capacità di coding e agente con un'efficienza di pensiero notevolmente migliore rispetto a K2.7 Code, ed è adatto a completamento del codice e attività di sviluppo di routine. È stato rilasciato l'11 settembre 2026 come rollout completo all'interno di Kimi Code — e l'ID modello non è cambiato, quindi le configurazioni esistenti kimi-for-coding lo hanno recepito senza modifiche al client. La nostra guida a Kimi K2.8 Preview illustra come collegare Kimi Code a una chiave di terze parti.
La relazione tra i due è deliberata: K2.8 Preview è il modello di lavoro predefinito, K3 è il percorso di escalation.
Confronto specifiche
Tutto ciò che segue è la specifica ufficiale pubblicata da Kimi per Kimi Code, dove entrambi i modelli sono attualmente disponibili fianco a fianco.
| Kimi K2.8 Preview | Kimi K3 | |
|---|---|---|
| ID modello | kimi-for-coding |
k3 / k3-256k |
| Numero di parametri | Non pubblicato | 2,8 trilioni |
| Finestra di contesto | 1.048.576 token | 1.048.576 token (k3) / 262.144 (k3-256k) |
| Sforzo di ragionamento | low / high / max, default max |
low / high / max, default high |
| Input multimodale | Immagini e video | Immagini e video (k3) / solo immagini (k3-256k) |
| Chi può chiamarlo | Ogni livello di abbonamento | Moderato e superiore; finestra 1M richiede Allegretto e superiore |
| Consumo relativo | Standard | k3 (1M) costa circa il doppio di k3-256k |
| Prezzo API pubblico | Non pubblicato | $0,30 input cache / $3,00 input / $15,00 output per 1M token |
Una regola di routing vale la pena di essere memorizzata perché cambia silenziosamente quale modello serve la tua richiesta: all'interno di Kimi Code, disattivare il pensiero instrada sia le richieste K3 che K2.8 Preview a K2.8 Preview senza pensiero. Una richiesta che hai configurato come K3 può quindi essere risolta da K2.8. Questo è il comportamento di Kimi Code; non dare per scontato che la stessa regola si applichi alla piattaforma aperta o a un gateway di terze parti.
Cosa Moonshot non ha pubblicato
Tre lacune meritano di essere dichiarate chiaramente, perché la maggior parte dei contenuti di confronto le riempie con supposizioni:
- Numero di parametri. Kimi ha pubblicato 2,8T per K3. Non esiste un numero di parametri pubblicato per K2.8 Preview.
- Benchmark. L'annuncio di K2.8 Preview non pubblica punteggi né una valutazione riproducibile K2.8-contro-K3. "Si avvicina a K3" è la valutazione di Moonshot, non una misurazione indipendente — inclusa la nostra.
- Prezzo. Vedi la sezione successiva.
Prezzi: K3 ha un numero, K2.8 Preview no
La tabella dei prezzi di Kimi elenca quattro modelli. K2.8 Preview non è uno di questi.
| Modello | Input (cache hit) | Input (cache miss) | Output | Contesto |
|---|---|---|---|---|
kimi-k3 |
$0,30/M | $3,00/M | $15,00/M | 1.048.576 |
kimi-k2.7-code |
$0,19/M | $0,95/M | $4,00/M | 262.144 |
kimi-k2.7-code-highspeed |
$0,38/M | $1,90/M | $8,00/M | 262.144 |
kimi-k2.6 |
$0,16/M | $0,95/M | $4,00/M | 262.144 |
| Kimi K2.8 Preview | — | — | — | — |
K2.8 Preview è venduto come parte di un abbonamento Kimi Code, non a token. Kimi Code condivide la stessa quota dell'abbonamento Kimi: la quota si rinnova ogni 7 giorni, c'è una finestra aggiuntiva mobile di 5 ore, e un saldo per utilizzo extra subentra quando la quota è esaurita. Kimi descrive la tariffa per utilizzo extra solo come "vicina al prezzo API ufficiale della piattaforma aperta Kimi, come mostrato sulla piattaforma" — non pubblica una tariffa per K2.8 Preview.
Quindi il confronto onesto non è "K2.8 è più economico di K3 di X" ma "K2.8 è fatturato come abbonamento e K3 come token." Detto questo, tre fatti pubblicati indicano che K2.8 Preview si colloca sotto K3 in termini di costo:
- Ogni livello Kimi Code può chiamare K2.8 Preview, mentre K3 richiede Moderato o superiore.
- K2.8 Preview è posizionato per completamento e sviluppo di routine, non per lavoro di frontiera.
- Il suo sibling pubblicato più vicino sulla piattaforma aperta,
kimi-k2.7-code, è prezzato a $0,95 input / $4,00 output per milione di token — circa un terzo del prezzo di input di K3 e un quarto del suo prezzo di output.
Il prezzo della route APIMaster per K2.8 Preview è uno slot riservato. Non stiamo annunciando un prezzo K2.8 né una disponibilità confermata. Quando Moonshot aprirà il modello all'API pubblica e elencheremo la route, è qui che andrà il numero, e potrai confrontarlo con K3 carta contro carta nello stesso marketplace.
| Route | Input | Output |
|---|---|---|
| Kimi K3 su APIMaster (oggi) | $2,25/M — 25% sotto il prezzo ufficiale Kimi di $3,00/M | $11,25/M — 25% sotto il prezzo ufficiale Kimi di $15,00/M |
| Kimi K2.8 Preview su APIMaster | Riservato — da pubblicare con la route | Riservato — da pubblicare con la route |
I prezzi delle route e la disponibilità dei canali cambiano. Controlla la scheda live nel marketplace prima di spostare traffico di produzione.
Entrambi i modelli appartengono alla stessa famiglia, quindi se stai ancora decidendo tra Kimi e le altre route di frontiera, la pagina API Kimi confronta cosa copre una singola chiave tra Kimi, Claude, GPT e DeepSeek.
Cosa significa in pratica
Oltre alla scheda tecnica, quattro dettagli operativi decidono come si sente la scelta giorno per giorno.
Invalidazione della cache. Cambiare modello o cambiare sforzo di ragionamento invalida la cache di contesto, quindi la richiesta successiva riprecompila la conversazione e costa di più. Kimi raccomanda di iniziare una nuova sessione invece di passare avanti e indietro all'interno di una lunga. Se prevedi di confrontare K2.8 e K3 sullo stesso compito, metti in budget quella prima richiesta costosa su ciascuno.
Gli errori di autorizzazione sembrano errori di autenticazione. Una richiesta che supera il tuo piano restituisce 401, non un messaggio di quota. Chiamare k3 sotto Moderato, richiedere la finestra 1M su Moderato, o chiamare kimi-for-coding-highspeed sotto Allegretto si manifestano tutti come 401. Se la tua chiave funziona per un modello e fallisce per un altro, controlla il piano prima di ruotare le chiavi.
Gli ID differiscono per superficie. Una configurazione k3 è valida solo all'interno di Kimi Code. Sulla piattaforma aperta lo stesso modello è kimi-k3. Copia gli ID dalla superficie che stai effettivamente chiamando, e registra provider, endpoint e ID modello accanto a qualsiasi benchmark che conservi.
Verifica, non dare per scontato. L'affermazione di un modello sulla propria identità non è una prova di quale modello ha servito una richiesta. Questo conta più del solito qui, perché disattivare il pensiero su K3 consegna legittimamente la richiesta a K2.8 Preview — un risultato instradato che sembra un downgrade se non te lo aspettavi.
Come scegliere
- Completamento del codice, piccoli refactor e sviluppo di routine: K2.8 Preview. È disponibile su ogni livello, supporta la finestra completa da 1M, ed è la route più economica.
- Modifiche a scala di repository, lunghe esecuzioni di agenti, ragionamento profondo e lavoro di conoscenza: K3. Il suo livello di punta da 2,8T parametri e il contesto da 1M sono il motivo per pagare di più.
- Hai bisogno di un'API pubblica, compatibilità SDK o fatturazione prevedibile per token: K3 oggi, perché K2.8 Preview non ha un ID API pubblico.
- Vuoi il throughput più alto all'interno di Kimi Code: nessuno dei due —
kimi-for-coding-highspeedfornisce circa 6x velocità di output a 3x consumo, con la stessa capacità di coding di K2.7 Code.
Di cosa parla la community
I due modelli hanno livelli molto diversi di discussione pubblica, e questo è di per sé un segnale utile.
K3 è stato ampiamente discusso da luglio 2026. Su Hacker News, "Kimi K3: Open Frontier Intelligence" ha raggiunto 2.107 punti e 1.214 commenti, "Kimi-K3 on HuggingFace" 1.382 punti, "Kimi K3 Is Competitive with Fable" 877 punti, e "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 punti — quest'ultimo è un promemoria che la capacità, non solo la qualità, ha plasmato il modo in cui Moonshot ha scelto di vendere i suoi modelli. Note sull'architettura, il report tecnico ed esperimenti di inferenza locale (eseguire K3 in 29 GB di RAM) hanno tutti attratto thread sostanziosi.
K2.8 Preview non ha quasi alcuna copertura in inglese: una ricerca su Hacker News per "Kimi K2.8" e "Moonshot K2.8" non restituisce alcuna storia o commento, e i gateway di terze parti mainstream non elencano il modello. La discussione è concentrata nei canali per sviluppatori in lingua cinese, il che è coerente con un modello che attualmente viene distribuito solo all'interno di un prodotto in abbonamento. Tratta l'entusiasmo della community per K3 come evidenza di interesse, non come un verdetto di qualità K2.8-contro-K3.
FAQ
Qual è l'ID modello per Kimi K2.8 Preview?
All'interno di Kimi Code, kimi-for-coding. L'ID non è cambiato quando il modello sottostante è stato aggiornato, quindi le configurazioni esistenti continuano a funzionare. La piattaforma aperta di Kimi non offre K2.8 Preview, quindi non esiste ancora un ID modello API pubblico per esso.
Kimi K2.8 Preview è migliore di Kimi K3?
Moonshot descrive K2.8 Preview come vicino a K3 con un'efficienza di pensiero migliore rispetto a K2.7 Code, ma non pubblica punteggi benchmark per esso. K3 rimane il modello di punta da 2,8T parametri. Per una risposta reale, esegui il tuo compito — un test fallito, una modifica multi-file, una domanda su documento lungo — su entrambi e confronta correttezza, tempo di completamento e costo.
Posso chiamare Kimi K3 da un'API?
Sì. K3 è un modello pubblico sulla piattaforma aperta di Kimi come kimi-k3, ed è disponibile su APIMaster con un endpoint compatibile OpenAI. K2.8 Preview è quello che non è chiamabile come modello API pubblico.
Perché l'ID Kimi Code è k3 quando l'ID API è kimi-k3?
Sono due prodotti con due schemi di denominazione. I quattro ID di Kimi Code sono k3, k3-256k, kimi-for-coding e kimi-for-coding-highspeed; gli ID attuali della piattaforma aperta sono kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed e kimi-k2.6. Copia sempre l'ID dalla superficie che stai chiamando.
Disattivare il pensiero mi dà Kimi K2.8 Preview?
All'interno di Kimi Code, sì: le richieste configurate per K3 o K2.8 Preview con pensiero disattivato sono entrambe servite da K2.8 Preview senza pensiero. Non generalizzare questa regola alla piattaforma aperta o a un gateway di terze parti senza controllare la documentazione di quel provider.
Kimi K2.8 Preview è disponibile su APIMaster?
Non ancora. K2.8 Preview non è un modello API pubblico, quindi non c'è una route o un prezzo da elencare. APIMaster attualmente serve kimi-k3, kimi-k2.6 e kimi-k2.7-code. Elencheremo K2.8 Preview appena Moonshot lo aprirà al mercato aperto, e la stessa chiave API lo coprirà allora.
Fonti e data di verifica
- Kimi Code: configurazione modelli, ID, limiti e routing, verificato il 17 settembre 2026.
- Kimi Code: note di rilascio per il rollout K2.8 Preview dell'11 settembre 2026.
- Kimi Code: abbonamento, quota condivisa, finestra di 5 ore e utilizzo extra.
- Piattaforma aperta Kimi: lista modelli e modelli interrotti.
- Piattaforma aperta Kimi: prezzi di inferenza modelli.
- Discussioni Hacker News citate sopra: 48935342, 49065752, 48999291, 48969291.
- Catalogo prezzi live APIMaster e schede marketplace, verificati il 17 settembre 2026. Disponibilità e prezzi delle route possono cambiare dopo la pubblicazione.
Inizia con Kimi K3 su APIMaster.ai
K2.8 Preview è il modello da tenere d'occhio; K3 è il modello che puoi chiamare subito. Su APIMaster.ai una singola chiave compatibile OpenAI copre Kimi K3 a 25% sotto il prezzo ufficiale Kimi, insieme alle route Claude, GPT, DeepSeek, Gemini e GLM, così puoi confrontare il modello di punta con il resto del tuo stack prima che arrivi K2.8 Preview.
Crea un account APIMaster, genera una chiave nella console, punta il tuo client a https://apimaster.ai/v1 e imposta il modello su kimi-k3. Ogni canale Kimi è verificato tramite impronta digitale prima di essere elencato.