Kimi K2.8 Preview: contesto da un milione di token per il coding quotidiano
Esplora Kimi K2.8 Preview, il suo contesto da 1M, i livelli di ragionamento e il model ID kimi-for-coding. Scopri come collegare Kimi Code ai modelli disponibili di APIMaster.
Published 2026-09-13
Kimi K2.8 Preview è stato lanciato in Kimi Code l'11 settembre 2026. Moonshot afferma che le sue prestazioni complessive si avvicinano a K3, con capacità di coding e agent più solide rispetto a K2.7 Code. Supporta 1.048.576 token di contesto, input di immagini e video e un reasoning effort low / high / max. Tutti i livelli di abbonamento a Kimi Code possono accedere al suo contesto da 1M. Il model ID di Kimi Code rimane kimi-for-coding.
Su APIMaster.ai, vediamo l'attrattiva pratica: più contesto di progetto e ragionamento regolabile per lo sviluppo di routine. Questa guida spiega l'aggiornamento e come collegare Kimi Code al nostro marketplace di modelli. Come verificato il 13 settembre, il catalogo prezzi pubblico di APIMaster elenca kimi-k3, kimi-k2.6 e kimi-k2.7-code, ma non elenca esplicitamente K2.8 Preview. Controlla il marketplace live per la disponibilità attuale prima di scegliere un modello.
Cosa c'è di nuovo in Kimi K2.8 Preview?
K2.8 Preview aggiorna la route kimi-for-coding già esistente di Kimi Code. Gli utenti che già chiamano quell'ID tramite Kimi Code non devono rinominare la propria configurazione del modello. Le note di rilascio ufficiali descrivono capacità di coding, agent e efficienza di pensiero migliorate rispetto a K2.7 Code.
Il cambiamento di accesso più rilevante è la finestra di contesto: ogni livello di abbonamento a Kimi Code può usare fino a 1M di token con K2.8 Preview. L'opzione da 1M di K3 richiede ancora Allegretto o superiore. Il report del 12 settembre di QbitAI afferma inoltre che K2.8 Preview è disponibile in Kimi Work; le impostazioni tecniche in questa guida provengono dalla documentazione di Kimi Code.
Questa è una release di anteprima. L'annuncio non fornisce nuovi punteggi di benchmark né una valutazione riproducibile di K2.8 rispetto a K3. "Si avvicina a K3" è la valutazione di Moonshot, non un risultato di test indipendente di APIMaster.
Kimi K2.8 Preview vs K3: cosa cambia per gli sviluppatori?
Il seguente confronto si applica specificamente al servizio ufficiale di Kimi Code, utilizzando la sua documentazione di configurazione dei modelli.
| Funzionalità | K2.8 Preview | K3 in Kimi Code |
|---|---|---|
| Model ID | kimi-for-coding |
k3 o k3-256k |
| Posizionamento | Completamento del codice e sviluppo di routine; prestazioni descritte come vicine a K3 | Modello di coding di punta per lavori impegnativi |
| Contesto | 1.048.576 token | 1.048.576 per k3; 262.144 per k3-256k |
| Accesso in base all'abbonamento | Tutti i livelli, inclusa la finestra da 1M | Moderato o superiore; 1M richiede Allegretto o superiore |
| Reasoning effort | low, high, max; predefinito max |
low, high, max; predefinito high |
| Input visivo | Immagini e video | Immagini e video per k3; solo immagini per k3-256k |
Kimi Code mantiene inoltre kimi-for-coding-highspeed, che la sua documentazione identifica come K2.7 Code HighSpeed. È una route separata, non una variante ad alta velocità di K2.8.
Per i team, il confronto utile è il costo per attività completata: un modello riesce a risolvere il problema, superare i test e terminare entro un tempo accettabile? Inizia valutando K2.8 su modifiche circoscritte e completamento del codice, poi confronta il lavoro più complesso sul repository con K3. Il solo annuncio di anteprima non può stabilire quale modello vince sul tuo codebase.
Cosa rende possibile una finestra di contesto da 1M?
Una finestra più ampia può mantenere insieme più file sorgente, specifiche, output dei test e cronologia della conversazione. Questo è utile quando una modifica coinvolge diversi pacchetti o quando un assistente di coding deve fare riferimento incrociato tra dettagli di implementazione e un lungo documento di progettazione.
Supporta anche flussi di lavoro visivi: gli screenshot possono aiutare a spiegare un difetto dell'interfaccia, mentre l'input video può fornire contesto per un'interazione registrata. I formati e i limiti effettivi degli allegati dipendono dal client e dalla route.
1M è un limite di contesto, non una promessa di richiamo perfetto, utilizzo illimitato o un milione di token di output. Il contesto pertinente conta comunque. Consigliamo di iniziare con i file necessari per l'attività, aggiungerne altri solo quando aiutano, e misurare l'uso dei token e la qualità del completamento man mano che la sessione cresce.
Come funzionano il reasoning effort e il routing dei modelli?
K2.8 Preview supporta tre livelli di ragionamento in Kimi Code:
low: un punto di partenza utile per modifiche circoscritte e domande semplici.high: un livello da valutare per il debug e modifiche che coinvolgono diversi vincoli.max: il valore predefinito di K2.8; vale la pena confrontarlo su attività di ragionamento difficili rispetto al suo maggiore impiego di tempo e token.
Questi sono suggerimenti di valutazione, non garanzie misurate di velocità o qualità. La documentazione di Kimi Code consiglia inoltre una nuova conversazione quando si cambia modello, perché il cambio invalida la cache del contesto esistente.
C'è un dettaglio di routing importante: in Kimi Code, disattivando il thinking per K3 o K2.8 Preview, la richiesta viene indirizzata a K2.8 Preview senza thinking. Una richiesta configurata come K3 può quindi essere servita da K2.8 in questa condizione documentata.
Quando confronti i modelli, registra il provider, l'endpoint, il model ID, l'impostazione del thinking e la data del test. Il nome del modello restituito o l'affermazione di un modello sulla propria identità non sono prove sufficienti di quale modello abbia servito una richiesta. Questa regola di routing di Kimi Code non descrive automaticamente l'API generale di Moonshot o ogni gateway di terze parti.
Qual è il prezzo API di Kimi K2.8 Preview?
Le due pagine ufficiali di Kimi Code esaminate per questo articolo stabiliscono accesso e capacità, ma non pubblicano una tabella separata dei prezzi per token di input/output di K2.8 Preview. L'accesso tramite un livello di abbonamento è diverso dal prezzo API pay-as-you-go. Un diritto al contesto da 1M non significa nemmeno token gratuiti illimitati.
Il model ID ufficiale di Kimi Code è kimi-for-coding; il nome visualizzato "K2.8 Preview" non è un ID API sostitutivo. Non dare per scontato che un gateway accetti quell'ID o che una vecchia voce Kimi sia automaticamente diventata K2.8.
Per APIMaster, usa il model ID e i prezzi delle route live mostrati nel nostro marketplace. Esamina la tariffa di fatturazione applicabile all'account, la quota disponibile e i registri di utilizzo prima di stimare i costi di produzione. In questo articolo non annunciamo un prezzo di K2.8 né una disponibilità confermata di K2.8 su APIMaster.
Come usare Kimi Code con APIMaster.ai
Kimi Code è un client di coding che può anche usare provider di terze parti. Puoi collegarlo ad APIMaster oggi e selezionare i modelli disponibili per la tua API key, indipendentemente da un abbonamento ai modelli di Kimi Code.
- Crea un account APIMaster, esamina il marketplace dei modelli e aggiungi saldo secondo necessità.
- Genera una API key nella console APIMaster.
- Avvia Kimi Code e inserisci
/provider, poi scegli Custom registry (api.json). - Inserisci
https://apimaster.ai/kimi/registry.jsoncome URL del registry e la tua API key APIMaster come Bearer token. - Seleziona un modello dalla scheda del provider apimaster e invia una piccola attività di coding. Controlla il risultato e l'utilizzo nella console prima di aumentare la scala.

Screenshot della configurazione del provider dalla nostra guida alla CLI di Kimi Code, catturato con la versione 0.31.1. Illustra il flusso di connessione, non la disponibilità di K2.8.
Puoi anche importare il registry da un terminale dopo aver impostato APIMASTER_API_KEY nel tuo ambiente locale:
kimi provider add https://apimaster.ai/kimi/registry.json --api-key "$APIMASTER_API_KEY"
Il registry elenca i modelli compatibili con il coding in base ai permessi della tua key. Se K2.8 non è elencato esplicitamente, scegli un modello attualmente supportato invece di inventare un model ID K2.8. Consulta la nostra guida alla configurazione di Kimi Code per la procedura completa e l'introduzione a Kimi K3 per un'opzione Kimi già esistente.
Perché valutare i tuoi modelli di coding tramite APIMaster?
Riuniamo selezione dei modelli, prezzi delle route live, API key e monitoraggio dell'utilizzo in un unico posto. Puoi confrontare i modelli Kimi disponibili con altre famiglie di modelli tramite un'integrazione API comune, poi usare lo stesso account nei client di coding supportati.
Inizia con un'attività piccola e ripetibile: una correzione di bug con un test che fallisce, una funzione che necessita di copertura, o una modifica documentata su diversi file. Confronta correttezza, tempo di completamento, comportamento degli strumenti e costo totale. Il nostro tester di API key può aiutare a verificare la connettività; una richiesta riuscita da sola non stabilisce l'identità del modello o il supporto al contesto da 1M.
FAQ
Cos'è Kimi K2.8 Preview?
È l'aggiornamento del modello Kimi Code di Moonshot dell'11 settembre 2026, posizionato per attività di coding di routine e agent. Supporta contesto da 1M, immagini, video e tre livelli di ragionamento. Moonshot descrive le prestazioni complessive come vicine a K3, senza pubblicare nuovi punteggi di benchmark in questo annuncio.
Quale model ID devo usare per K2.8 Preview?
Nel servizio ufficiale di Kimi Code, usa kimi-for-coding. L'ID è rimasto lo stesso quando il modello sottostante è stato aggiornato. Su APIMaster o un altro gateway, copia l'ID esatto dall'elenco dei modelli attuale di quel provider.
Il contesto da 1M è disponibile per tutti i membri di Kimi Code?
Sì, per K2.8 Preview, secondo la documentazione di Kimi. Questo è un diritto massimo di contesto soggetto alle quote del servizio, non un utilizzo API gratuito illimitato. L'opzione da 1M di K3 richiede ancora Allegretto o superiore.
Disattivare il thinking di K3 seleziona K2.8 Preview?
Sì, all'interno di Kimi Code: le richieste K3 e K2.8 con thinking disattivato sono servite da K2.8 Preview senza thinking. Non generalizzare questa regola ad altri endpoint senza verificarne la documentazione.
K2.8 Preview è già disponibile su APIMaster?
La nostra verifica del catalogo pubblico del 13 settembre 2026 non ha trovato una voce esplicita di K2.8 Preview. Ha trovato kimi-k3, kimi-k2.6 e kimi-k2.7-code. Controlla il marketplace live per aggiornamenti; un vecchio nome di modello da solo non conferma un aggiornamento a K2.8.
Posso usare APIMaster in Kimi Code adesso?
Sì. Importa https://apimaster.ai/kimi/registry.json con una API key APIMaster e scegli un modello disponibile per quella key. L'utilizzo dell'API di terze parti viene fatturato tramite APIMaster anziché tramite il diritto di abbonamento a Kimi Code.
Fonti e data di verifica
- Kimi Code: note di rilascio dell'11 settembre.
- Kimi Code: specifiche dei modelli, ragionamento e routing.
- QbitAI, 12 settembre 2026: "Kimi突发K2.8:性能逼近K3,百万上下文全员开放". Usato per il rollout segnalato di Kimi Work; le affermazioni tecniche sono state verificate rispetto alle pagine ufficiali sopra.
- Catalogo prezzi pubblico di APIMaster, verificato il 13 settembre 2026. La disponibilità può cambiare dopo la pubblicazione.
Inizia a costruire con APIMaster.ai
K2.8 Preview rende il coding a contesto lungo meritevole di un nuovo sguardo. Porta un'attività reale su APIMaster.ai, confronta le route attualmente disponibili e collega il modello scelto a Kimi Code. Crea il tuo account APIMaster per ottenere una API key e iniziare con il tuo primo flusso di lavoro di coding.