Kimi K2.8 Preview: contexto de um milhão de tokens para codificação do dia a dia
Explore o Kimi K2.8 Preview, seu contexto de 1M, níveis de raciocínio e o ID de modelo kimi-for-coding. Veja como conectar o Kimi Code aos modelos disponíveis na APIMaster.
Published 2026-09-13
O Kimi K2.8 Preview foi lançado no Kimi Code em 11 de setembro de 2026. A Moonshot afirma que seu desempenho geral se aproxima do K3, com capacidades de codificação e de agente mais fortes que o K2.7 Code. Ele oferece suporte a 1.048.576 tokens de contexto, entrada de imagem e vídeo e esforço de raciocínio low / high / max. Todos os níveis de assinatura do Kimi Code podem acessar seu contexto de 1M. O ID de modelo do Kimi Code permanece kimi-for-coding.
Na APIMaster.ai, vemos o apelo prático: mais contexto de projeto e raciocínio ajustável para o desenvolvimento rotineiro. Este guia explica a atualização e como conectar o Kimi Code ao nosso marketplace de modelos. Conforme verificado em 13 de setembro, o catálogo público de preços da APIMaster lista kimi-k3, kimi-k2.6 e kimi-k2.7-code, mas não lista explicitamente o K2.8 Preview. Consulte o marketplace ao vivo para verificar a disponibilidade atual antes de escolher um modelo.
O que há de novo no Kimi K2.8 Preview?
O K2.8 Preview atualiza a rota kimi-for-coding já existente no Kimi Code. Usuários que já chamam esse ID por meio do Kimi Code não precisam renomear sua configuração de modelo. As notas de versão oficiais descrevem codificação, capacidade de agente e eficiência de raciocínio aprimoradas em comparação com o K2.7 Code.
A maior mudança de acesso é a janela de contexto: todos os níveis de assinatura do Kimi Code podem usar até 1M de tokens com o K2.8 Preview. A opção de 1M do K3 ainda exige Allegretto ou superior. O relatório da QbitAI de 12 de setembro também afirma que o K2.8 Preview está disponível no Kimi Work; as configurações técnicas deste guia vêm da documentação do Kimi Code.
Este é um lançamento de pré-visualização. O anúncio não fornece novas pontuações de benchmark nem uma avaliação reproduzível de K2.8 versus K3. "Aproxima-se do K3" é a avaliação da Moonshot, não um resultado de teste independente da APIMaster.
Kimi K2.8 Preview vs K3: o que muda para os desenvolvedores?
A comparação a seguir se aplica especificamente ao serviço oficial do Kimi Code, usando sua documentação de configuração de modelos.
| Recurso | K2.8 Preview | K3 no Kimi Code |
|---|---|---|
| ID do modelo | kimi-for-coding |
k3 ou k3-256k |
| Posicionamento | Conclusão de código e desenvolvimento rotineiro; desempenho descrito como próximo ao K3 | Modelo de codificação carro-chefe para trabalhos exigentes |
| Contexto | 1.048.576 tokens | 1.048.576 para k3; 262.144 para k3-256k |
| Acesso por assinatura | Todos os níveis, incluindo a janela de 1M | Moderato ou superior; 1M exige Allegretto ou superior |
| Esforço de raciocínio | low, high, max; padrão max |
low, high, max; padrão high |
| Entrada visual | Imagens e vídeo | Imagens e vídeo para k3; somente imagens para k3-256k |
O Kimi Code também mantém o kimi-for-coding-highspeed, que sua documentação identifica como K2.7 Code HighSpeed. É uma rota separada, não uma variante de alta velocidade do K2.8.
Para as equipes, a comparação útil é o custo por tarefa concluída: o modelo consegue corrigir o problema, passar nos testes e terminar em um tempo aceitável? Comece avaliando o K2.8 em mudanças delimitadas e conclusão de código, depois compare trabalhos mais difíceis de repositório com o K3. O anúncio de pré-visualização por si só não consegue estabelecer qual modelo vence no seu código.
O que uma janela de contexto de 1M torna possível?
Uma janela maior pode manter mais arquivos-fonte, especificações, saída de testes e histórico de conversa juntos. Isso é útil quando uma mudança abrange vários pacotes ou quando um assistente de codificação precisa fazer referência cruzada de detalhes de implementação com um documento de design longo.
Também oferece suporte a fluxos de trabalho visuais: capturas de tela podem ajudar a explicar um defeito de UI, enquanto a entrada de vídeo pode fornecer contexto para uma interação gravada. Os formatos e limites reais de anexo dependem do cliente e da rota.
1M é um limite de contexto, não uma promessa de recall perfeito, uso ilimitado ou um milhão de tokens de saída. O contexto relevante ainda importa. Recomendamos começar com os arquivos necessários para a tarefa, adicionar mais apenas quando ajudarem e medir o uso de tokens e a qualidade da conclusão à medida que a sessão cresce.
Como funcionam o esforço de raciocínio e o roteamento de modelos?
O K2.8 Preview oferece suporte a três níveis de raciocínio no Kimi Code:
low: um ponto de partida útil para edições estreitas e perguntas diretas.high: um nível a ser avaliado para depuração e mudanças que envolvem várias restrições.max: o padrão do K2.8; vale a pena comparar em tarefas de raciocínio difíceis em relação ao seu tempo e uso de tokens adicionais.
Estas são sugestões de avaliação, não garantias medidas de velocidade ou qualidade. A documentação do Kimi Code também recomenda uma nova conversa ao trocar de modelo, porque a troca invalida o cache de contexto existente.
Há um detalhe importante de roteamento: no Kimi Code, desativar o thinking para o K3 ou para o K2.8 Preview encaminha a solicitação para o K2.8 Preview sem thinking. Uma solicitação configurada como K3 pode, portanto, ser atendida pelo K2.8 sob essa condição documentada.
Ao comparar modelos, registre o provedor, o endpoint, o ID do modelo, a configuração de thinking e a data do teste. O nome do modelo retornado ou a própria alegação de um modelo sobre sua identidade não é prova suficiente de qual modelo atendeu a uma solicitação. Esta regra de roteamento do Kimi Code não descreve automaticamente a API geral da Moonshot nem todo gateway de terceiros.
Qual é o preço da API do Kimi K2.8 Preview?
As duas páginas oficiais do Kimi Code revisadas para este artigo estabelecem acesso e capacidades, mas não publicam uma tabela separada de preços de tokens de entrada/saída do K2.8 Preview. Acesso por meio de um nível de assinatura é diferente do preço de API pago conforme o uso. Uma titularidade de contexto de 1M também não significa tokens gratuitos ilimitados.
O ID de modelo oficial do Kimi Code é kimi-for-coding; o nome de exibição "K2.8 Preview" não substitui um ID de API. Não presuma que um gateway aceita esse ID ou que uma listagem mais antiga do Kimi se tornou automaticamente K2.8.
Para a APIMaster, use o ID de modelo e os preços de rota ao vivo mostrados em nosso marketplace. Revise a taxa de cobrança aplicável da conta, a cota disponível e os registros de uso antes de estimar custos de produção. Não estamos anunciando um preço do K2.8 nem disponibilidade confirmada do K2.8 na APIMaster neste artigo.
Como usar o Kimi Code com a APIMaster.ai
O Kimi Code é um cliente de codificação que também pode usar provedores de terceiros. Você pode conectá-lo à APIMaster hoje e selecionar modelos disponíveis para sua chave de API, independentemente de uma assinatura de modelo do Kimi Code.
- Crie uma conta na APIMaster, revise o marketplace de modelos e adicione saldo conforme necessário.
- Gere uma chave de API no console da APIMaster.
- Inicie o Kimi Code e digite
/provider, depois escolha Custom registry (api.json). - Insira
https://apimaster.ai/kimi/registry.jsoncomo URL do registry e sua chave de API da APIMaster como Bearer token. - Selecione um modelo na aba do provedor apimaster e envie uma pequena tarefa de codificação. Verifique o resultado e o uso no console antes de escalar.

Captura de tela da configuração de provedor do nosso guia da CLI do Kimi Code, capturada com a versão 0.31.1. Ela ilustra o fluxo de conexão, não a disponibilidade do K2.8.
Você também pode importar o registry a partir de um terminal após definir APIMASTER_API_KEY em seu ambiente local:
kimi provider add https://apimaster.ai/kimi/registry.json --api-key "$APIMASTER_API_KEY"
O registry lista modelos compatíveis com codificação de acordo com as permissões da sua chave. Se o K2.8 não estiver listado explicitamente, escolha um modelo atualmente suportado em vez de inventar um ID de modelo K2.8. Consulte nosso guia de configuração do Kimi Code para o passo a passo completo e a introdução ao Kimi K3 para uma opção Kimi já existente.
Por que avaliar seus modelos de codificação pela APIMaster?
Reunimos seleção de modelos, preços de rota ao vivo, chaves de API e rastreamento de uso em um só lugar. Você pode comparar os modelos Kimi disponíveis com outras famílias de modelos por meio de uma integração de API comum e depois usar a mesma conta em clientes de codificação compatíveis.
Comece com uma tarefa pequena e repetível: uma correção de bug com um teste que falha, uma função que precisa de cobertura ou uma mudança documentada em vários arquivos. Compare correção, tempo até a conclusão, comportamento das ferramentas e custo total. Nosso testador de chave de API pode ajudar a verificar a conectividade; uma solicitação bem-sucedida por si só não estabelece a identidade do modelo nem o suporte a contexto de 1M.
FAQ
O que é o Kimi K2.8 Preview?
É a atualização de modelo do Kimi Code da Moonshot de 11 de setembro de 2026, posicionada para codificação rotineira e tarefas de agente. Ele oferece suporte a contexto de 1M, imagens, vídeo e três níveis de raciocínio. A Moonshot descreve o desempenho geral como próximo ao K3, sem publicar novas pontuações de benchmark neste anúncio.
Qual ID de modelo devo usar para o K2.8 Preview?
No serviço oficial do Kimi Code, use kimi-for-coding. O ID permaneceu o mesmo quando o modelo subjacente foi atualizado. Na APIMaster ou em outro gateway, copie o ID exato da listagem de modelos atual desse provedor.
O contexto de 1M está disponível para todos os membros do Kimi Code?
Sim, para o K2.8 Preview, de acordo com a documentação da Kimi. Esta é uma titularidade de contexto máximo sujeita às cotas do serviço, não uso de API gratuito ilimitado. A opção de 1M do K3 ainda exige Allegretto ou superior.
Desativar o thinking do K3 seleciona o K2.8 Preview?
Sim, dentro do Kimi Code: solicitações K3 e K2.8 com o thinking desativado são atendidas pelo K2.8 Preview sem thinking. Não generalize esta regra para outros endpoints sem verificar a documentação deles.
O K2.8 Preview já está disponível na APIMaster?
Nossa verificação do catálogo público de 13 de setembro de 2026 não encontrou uma listagem explícita do K2.8 Preview. Ela encontrou kimi-k3, kimi-k2.6 e kimi-k2.7-code. Consulte o marketplace ao vivo para atualizações; um nome de modelo mais antigo por si só não confirma uma atualização para K2.8.
Posso usar a APIMaster no Kimi Code agora?
Sim. Importe https://apimaster.ai/kimi/registry.json com uma chave de API da APIMaster e escolha um modelo disponível para essa chave. O uso de API de terceiros é cobrado pela APIMaster, e não pela titularidade da assinatura do Kimi Code.
Fontes e data de verificação
- Kimi Code: notas de versão de 11 de setembro.
- Kimi Code: especificações de modelo, raciocínio e roteamento.
- QbitAI, 12 de setembro de 2026: "Kimi突发K2.8:性能逼近K3,百万上下文全员开放". Usado para o lançamento relatado no Kimi Work; as alegações técnicas foram verificadas nas páginas oficiais acima.
- Catálogo público de preços da APIMaster, verificado em 13 de setembro de 2026. A disponibilidade pode mudar após a publicação.
Comece a construir com a APIMaster.ai
O K2.8 Preview torna a codificação de contexto longo digna de uma nova olhada. Traga uma tarefa real para a APIMaster.ai, compare as rotas atualmente disponíveis e conecte o modelo escolhido ao Kimi Code. Crie sua conta na APIMaster para obter uma chave de API e começar com seu primeiro fluxo de trabalho de codificação.