Kimi K2.8 Preview vs Kimi K3: Qual Você Deve Usar?
Kimi K2.8 Preview e Kimi K3 estão em superfícies diferentes: K3 é um modelo de API pública (kimi-k3), K2.8 Preview é uma rota do Kimi Code (kimi-for-coding). Compare especificações, limites de acesso, preços e quando usar cada um.
Published 2026-09-17
Kimi K2.8 Preview e Kimi K3 não são duas opções na mesma prateleira. K3 é um modelo de API pública, e K2.8 Preview é uma rota dentro do Kimi Code. Na plataforma aberta da Kimi, o modelo principal responde a kimi-k3; dentro do Kimi Code, esse mesmo modelo principal responde a k3, enquanto o K2.8 Preview mantém o ID mais antigo kimi-for-coding.
O K2.8 Preview é o nível mais leve e de menor custo: todos os níveis de assinatura do Kimi Code podem usá-lo, incluindo a janela de 1M de tokens, e a Moonshot descreve seu desempenho geral como se aproximando do K3. O K3 é o modelo principal com 2,8 trilhões de parâmetros, mas exige Moderato ou superior, e sua janela de 1M exige Allegretto ou superior.
A Moonshot não publicou nenhum preço por token para o K2.8 Preview, então não há nada para comparar com o preço oficial do K3 de US$ 3,00 por milhão de tokens de entrada e US$ 15,00 por milhão de tokens de saída. No APIMaster, você pode usar kimi-k3 hoje com uma única chave compatível com OpenAI; o K2.8 Preview ainda não é um modelo de API pública, e nós o listaremos assim que a Moonshot o abrir para o mercado aberto.
O mesmo modelo tem IDs diferentes em superfícies diferentes
Esta é a parte que confunde as pessoas. A Kimi opera dois produtos separados, e cada um nomeia os modelos à sua maneira.
| Superfície | O que é | ID do Kimi K3 | ID do Kimi K2.8 Preview |
|---|---|---|---|
| Plataforma aberta da Kimi | API pré-paga para qualquer desenvolvedor | kimi-k3 |
— não oferecido |
| Kimi Code | Serviço de codificação incluído na assinatura Kimi | k3, k3-256k |
kimi-for-coding |
O Kimi Code atualmente expõe quatro IDs de modelo de três modelos: k3 e k3-256k (as variantes de 1M e 262.144 tokens do K3), kimi-for-coding (K2.8 Preview) e kimi-for-coding-highspeed (K2.7 Code HighSpeed).
Duas consequências práticas:
- Não envie
kimi-k2.8para uma API. Esse identificador não existe em lugar nenhum. Na plataforma aberta da Kimi, os únicos modelos Kimi atuais sãokimi-k3,kimi-k2.7-code,kimi-k2.7-code-highspeedekimi-k2.6. - Um gateway que lista um nome antigo da Kimi não se tornou automaticamente K2.8. A plataforma aberta da Kimi descontinuou a série
kimi-k2em maio de 2026 e okimi-k2.5junto com a famíliamoonshot-v1em agosto de 2026. Nenhum desses IDs agora resolve para o K2.8 Preview.
Para que cada modelo é oficialmente posicionado
Kimi K3 é o modelo mais capaz da Moonshot. A lista de modelos da Kimi o descreve como projetado para "cenários de inteligência de fronteira, como engenharia de software, trabalho de conhecimento e raciocínio profundo", construído sobre 2,8 trilhões de parâmetros com compreensão visual nativa e uma janela de contexto de 1.048.576 tokens. Cobrimos sua superfície de API, chamadas de ferramentas e limites operacionais no guia de lançamento do Kimi K3.
Kimi K2.8 Preview é posicionado para desenvolvimento cotidiano, não para trabalho de fronteira. As notas de versão da Kimi dizem que ele melhora a capacidade de codificação e agente com eficiência de pensamento visivelmente melhor que o K2.7 Code, e é adequado para conclusão de código e tarefas rotineiras de desenvolvimento. Ele foi lançado em 11 de setembro de 2026 como uma implementação completa dentro do Kimi Code — e o ID do modelo não mudou, então as configurações existentes de kimi-for-coding o adotaram sem alteração no cliente. Nosso guia do Kimi K2.8 Preview explica como conectar o Kimi Code a uma chave de terceiros.
A relação entre os dois é deliberada: o K2.8 Preview é o modelo de trabalho padrão, o K3 é o caminho de escalada.
Comparação de especificações
Tudo abaixo é a especificação oficial publicada pela Kimi para o Kimi Code, onde ambos os modelos estão atualmente disponíveis lado a lado.
| Kimi K2.8 Preview | Kimi K3 | |
|---|---|---|
| ID do modelo | kimi-for-coding |
k3 / k3-256k |
| Número de parâmetros | Não publicado | 2,8 trilhões |
| Janela de contexto | 1.048.576 tokens | 1.048.576 tokens (k3) / 262.144 (k3-256k) |
| Esforço de raciocínio | low / high / max, padrão max |
low / high / max, padrão high |
| Entrada multimodal | Imagens e vídeo | Imagens e vídeo (k3) / apenas imagens (k3-256k) |
| Quem pode chamá-lo | Todos os níveis de assinatura | Moderato e acima; janela de 1M exige Allegretto e acima |
| Consumo relativo | Padrão | k3 (1M) custa aproximadamente o dobro do k3-256k |
| Preço da API pública | Não publicado | US$ 0,30 entrada em cache / US$ 3,00 entrada / US$ 15,00 saída por 1M de tokens |
Uma regra de roteamento vale a pena memorizar porque ela muda silenciosamente qual modelo atende sua solicitação: dentro do Kimi Code, desativar o pensamento roteia tanto as solicitações do K3 quanto do K2.8 Preview para o K2.8 Preview sem pensamento. Uma solicitação que você configurou como K3 pode, portanto, ser respondida pelo K2.8. Este é o comportamento do Kimi Code; não assuma que a mesma regra se aplica à plataforma aberta ou a um gateway de terceiros.
O que a Moonshot não publicou
Três lacunas merecem ser declaradas claramente, porque a maioria dos conteúdos de comparação as preenche com suposições:
- Número de parâmetros. A Kimi publicou 2,8T para o K3. Não há número de parâmetros publicado para o K2.8 Preview.
- Benchmarks. O anúncio do K2.8 Preview não publica pontuações nem avaliações reproduzíveis de K2.8 versus K3. "Aproxima-se do K3" é a avaliação da própria Moonshot, não uma medição independente — incluindo a nossa.
- Preço. Veja a próxima seção.
Preços: K3 tem um número, K2.8 Preview não
A tabela de preços da Kimi lista quatro modelos. O K2.8 Preview não é um deles.
| Modelo | Entrada (cache hit) | Entrada (cache miss) | Saída | Contexto |
|---|---|---|---|---|
kimi-k3 |
US$ 0,30/M | US$ 3,00/M | US$ 15,00/M | 1.048.576 |
kimi-k2.7-code |
US$ 0,19/M | US$ 0,95/M | US$ 4,00/M | 262.144 |
kimi-k2.7-code-highspeed |
US$ 0,38/M | US$ 1,90/M | US$ 8,00/M | 262.144 |
kimi-k2.6 |
US$ 0,16/M | US$ 0,95/M | US$ 4,00/M | 262.144 |
| Kimi K2.8 Preview | — | — | — | — |
O K2.8 Preview é vendido como parte de uma assinatura do Kimi Code, não por token. O Kimi Code compartilha a mesma cota da assinatura Kimi: a cota é renovada a cada 7 dias, há uma janela adicional contínua de 5 horas, e um saldo de uso extra assume quando a cota é esgotada. A Kimi descreve a taxa de uso extra apenas como "próxima ao preço oficial da API da plataforma aberta da Kimi, conforme exibido na plataforma" — ela não publica uma taxa para o K2.8 Preview.
Portanto, a comparação honesta não é "K2.8 é mais barato que K3 por X", mas "K2.8 é cobrado como assinatura e K3 como tokens". Dito isso, três fatos publicados apontam para o K2.8 Preview ficando abaixo do K3 em custo:
- Todos os níveis do Kimi Code podem chamar o K2.8 Preview, enquanto o K3 exige Moderato ou superior.
- O K2.8 Preview é posicionado para conclusão e desenvolvimento rotineiro, não para trabalho de fronteira.
- Seu irmão publicado mais próximo na plataforma aberta,
kimi-k2.7-code, é precificado em US$ 0,95 de entrada / US$ 4,00 de saída por milhão de tokens — aproximadamente um terço do preço de entrada do K3 e um quarto do preço de saída.
O preço da rota APIMaster para o K2.8 Preview é um espaço reservado. Não estamos anunciando um preço do K2.8 nem disponibilidade confirmada. Quando a Moonshot abrir o modelo para a API pública e listarmos a rota, é aqui que o número aparecerá, e você poderá compará-lo com o K3 cartão por cartão no mesmo marketplace.
| Rota | Entrada | Saída |
|---|---|---|
| Kimi K3 no APIMaster (hoje) | US$ 2,25/M — 25% abaixo do preço oficial de US$ 3,00/M da Kimi | US$ 11,25/M — 25% abaixo do preço oficial de US$ 15,00/M da Kimi |
| Kimi K2.8 Preview no APIMaster | Reservado — a ser publicado com a rota | Reservado — a ser publicado com a rota |
Preços de rota e oferta de canais mudam. Verifique o cartão ao vivo no marketplace antes de mover tráfego de produção.
Ambos os modelos pertencem à mesma família, então, se você ainda está decidindo entre Kimi e as outras rotas de fronteira, a página da API Kimi compara o que uma única chave cobre entre Kimi, Claude, GPT e DeepSeek.
O que isso significa na prática
Além da ficha técnica, quatro detalhes operacionais decidem como a escolha se sente no dia a dia.
Invalidação de cache. Alterar o modelo ou o esforço de raciocínio invalida o cache de contexto, então a próxima solicitação re-preenche a conversa e custa mais. A Kimi recomenda iniciar uma nova sessão em vez de alternar entre modelos dentro de uma sessão longa. Se você planeja comparar K2.8 e K3 na mesma tarefa, reserve orçamento para essa primeira solicitação cara em cada um.
Erros de permissão parecem erros de autenticação. Uma solicitação que excede seu plano retorna 401, não uma mensagem de cota. Chamar k3 abaixo do Moderato, solicitar a janela de 1M no Moderato ou chamar kimi-for-coding-highspeed abaixo do Allegretto todos aparecem como 401. Se sua chave funciona para um modelo e falha para outro, verifique o plano antes de rotacionar chaves.
IDs diferem por superfície. Uma configuração k3 só é válida dentro do Kimi Code. Na plataforma aberta, o mesmo modelo é kimi-k3. Copie IDs da superfície que você está realmente chamando e registre provedor, endpoint e ID do modelo junto com qualquer benchmark que você mantiver.
Verifique, não assuma. A afirmação de um modelo sobre sua própria identidade não é prova de qual modelo atendeu uma solicitação. Isso importa mais do que o normal aqui, porque desativar o pensamento no K3 legitimanente entrega a solicitação ao K2.8 Preview — um resultado roteado que parece um downgrade se você não esperava.
Como escolher
- Conclusão de código, pequenos refactors e desenvolvimento rotineiro: K2.8 Preview. Está disponível em todos os níveis, suporta a janela completa de 1M e é a rota mais barata.
- Mudanças em escala de repositório, execuções longas de agente, raciocínio profundo e trabalho de conhecimento: K3. Seu nível principal de 2,8T de parâmetros e contexto de 1M são o motivo para pagar mais.
- Você precisa de uma API pública, compatibilidade com SDK ou cobrança previsível por token: K3 hoje, porque o K2.8 Preview não tem ID de API pública.
- Você quer o maior throughput dentro do Kimi Code: nenhum dos dois —
kimi-for-coding-highspeedfornece aproximadamente 6x a velocidade de saída a 3x o consumo, com a mesma capacidade de codificação do K2.7 Code.
O que a comunidade está comentando
Os dois modelos têm níveis muito diferentes de discussão pública, e isso por si só é um sinal útil.
O K3 tem sido amplamente discutido desde julho de 2026. No Hacker News, "Kimi K3: Open Frontier Intelligence" alcançou 2.107 pontos e 1.214 comentários, "Kimi-K3 on HuggingFace" 1.382 pontos, "Kimi K3 Is Competitive with Fable" 877 pontos, e "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 pontos — o último é um lembrete de que capacidade, não apenas qualidade, moldou como a Moonshot escolheu vender seus modelos. Notas de arquitetura, o relatório técnico e experimentos de inferência local (executando K3 em 29 GB de RAM) todos atraíram discussões substanciais.
O K2.8 Preview tem quase nenhuma cobertura em inglês: uma busca no Hacker News por "Kimi K2.8" e "Moonshot K2.8" não retorna nenhuma história ou comentário, e gateways de terceiros mainstream não listam o modelo. A discussão está concentrada em canais de desenvolvedores em chinês, o que é consistente com um modelo que atualmente é distribuído apenas dentro de um produto de assinatura. Trate o entusiasmo da comunidade pelo K3 como evidência de interesse, não como um veredito de qualidade K2.8-versus-K3.
FAQ
Qual é o ID do modelo para o Kimi K2.8 Preview?
Dentro do Kimi Code, kimi-for-coding. O ID não mudou quando o modelo subjacente foi atualizado, então as configurações existentes continuam funcionando. A plataforma aberta da Kimi não oferece o K2.8 Preview, então ainda não há um ID de modelo de API pública para ele.
O Kimi K2.8 Preview é melhor que o Kimi K3?
A Moonshot descreve o K2.8 Preview como se aproximando do K3 com melhor eficiência de pensamento que o K2.7 Code, mas não publica pontuações de benchmark para ele. O K3 continua sendo o modelo principal de 2,8T de parâmetros. Para uma resposta real, execute sua própria tarefa — um teste falhando, uma mudança em vários arquivos, uma pergunta sobre documento longo — em ambos e compare correção, tempo de conclusão e custo.
Posso chamar o Kimi K3 de uma API?
Sim. O K3 é um modelo público na plataforma aberta da Kimi como kimi-k3, e está disponível no APIMaster com um endpoint compatível com OpenAI. O K2.8 Preview é o que não pode ser chamado como modelo de API pública.
Por que o ID no Kimi Code é k3 quando o ID da API é kimi-k3?
São dois produtos com dois esquemas de nomenclatura. Os quatro IDs do Kimi Code são k3, k3-256k, kimi-for-coding e kimi-for-coding-highspeed; os IDs atuais da plataforma aberta são kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed e kimi-k2.6. Sempre copie o ID da superfície que você está chamando.
Desativar o pensamento me dá o Kimi K2.8 Preview?
Dentro do Kimi Code, sim: solicitações configuradas para K3 ou K2.8 Preview com pensamento desativado são ambas atendidas pelo K2.8 Preview sem pensamento. Não generalize essa regra para a plataforma aberta ou para um gateway de terceiros sem verificar a documentação desse provedor.
O Kimi K2.8 Preview está disponível no APIMaster?
Ainda não. O K2.8 Preview não é um modelo de API pública, então não há rota ou preço para listar. O APIMaster atualmente serve kimi-k3, kimi-k2.6 e kimi-k2.7-code. Listaremos o K2.8 Preview assim que a Moonshot o abrir para o mercado aberto, e a mesma chave de API passará a cobri-lo.
Fontes e data de verificação
- Kimi Code: configuração de modelos, IDs, limites e roteamento, verificado em 17 de setembro de 2026.
- Kimi Code: notas de versão para a implementação do K2.8 Preview em 11 de setembro de 2026.
- Kimi Code: assinatura, cota compartilhada, janela de 5 horas e uso extra.
- Plataforma aberta da Kimi: lista de modelos e modelos descontinuados.
- Plataforma aberta da Kimi: preços de inferência de modelos.
- Discussões do Hacker News citadas acima: 48935342, 49065752, 48999291, 48969291.
- Catálogo de preços ao vivo do APIMaster e cartões do marketplace, verificados em 17 de setembro de 2026. Disponibilidade e preços de rota podem mudar após a publicação.
Comece com o Kimi K3 no APIMaster.ai
O K2.8 Preview é o modelo para observar; o K3 é o modelo que você pode chamar agora. No APIMaster.ai uma única chave compatível com OpenAI cobre o Kimi K3 a 25% abaixo do preço oficial da Kimi, junto com rotas Claude, GPT, DeepSeek, Gemini e GLM, para que você possa comparar o modelo principal com o resto da sua stack antes do K2.8 Preview chegar.
Crie uma conta no APIMaster, gere uma chave no console, aponte seu cliente para https://apimaster.ai/v1 e defina o modelo como kimi-k3. Cada canal Kimi é verificado por impressão digital antes de ser listado.