APIMaster.ai
Back to Blog
APIMaster Blog

Kimi K2.8 Preview vs Kimi K3: ¿Cuál deberías usar?

Kimi K2.8 Preview y Kimi K3 se encuentran en superficies diferentes: K3 es un modelo de API pública (kimi-k3), K2.8 Preview es una ruta de Kimi Code (kimi-for-coding). Compara especificaciones, límites de acceso, precios y cuándo usar cada uno.

Kimi K2.8 PreviewKimi K3Kimi APIKimi CodeMoonshot AIAPIMaster

Published 2026-09-17

Quick Answer

Kimi K2.8 Preview y Kimi K3 no son dos opciones en el mismo estante. K3 es un modelo de API pública, y K2.8 Preview es una ruta dentro de Kimi Code. En la plataforma abierta de Kimi, el modelo insignia responde a kimi-k3; dentro de Kimi Code, ese mismo modelo insignia responde a k3, mientras que K2.8 Preview mantiene el ID más antiguo kimi-for-coding.

K2.8 Preview es el nivel más ligero y de menor costo: todos los niveles de membresía de Kimi Code pueden usarlo, incluida la ventana de 1M de tokens, y Moonshot describe su rendimiento general como cercano al de K3. K3 es el modelo insignia con 2.8 billones de parámetros, pero requiere Moderato o superior, y su ventana de 1M necesita Allegretto o superior.

Moonshot no ha publicado ningún precio por token para K2.8 Preview, por lo que no hay nada que comparar con el precio oficial de K3 de $3.00 por millón de tokens de entrada y $15.00 por millón de tokens de salida. En APIMaster puedes usar kimi-k3 hoy con una sola clave compatible con OpenAI; K2.8 Preview aún no es un modelo de API pública, y lo listaremos en cuanto Moonshot lo abra al mercado abierto.

El mismo modelo tiene IDs diferentes en superficies diferentes

Esta es la parte que confunde a la gente. Kimi ejecuta dos productos separados, y cada uno nombra los modelos a su manera.

Superficie Qué es ID de Kimi K3 ID de Kimi K2.8 Preview
Plataforma abierta de Kimi API de pago por uso para cualquier desarrollador kimi-k3 — no ofrecido
Kimi Code Servicio de codificación incluido con una membresía de Kimi k3, k3-256k kimi-for-coding

Kimi Code actualmente expone cuatro IDs de modelo de tres modelos: k3 y k3-256k (las variantes de 1M y 262,144 tokens de K3), kimi-for-coding (K2.8 Preview) y kimi-for-coding-highspeed (K2.7 Code HighSpeed).

Dos consecuencias prácticas:

  • No envíes kimi-k2.8 a una API. Ese identificador no existe en ningún lugar. En la plataforma abierta de Kimi, los únicos modelos Kimi actuales son kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed y kimi-k2.6.
  • Una pasarela que lista un nombre antiguo de Kimi no se ha convertido automáticamente en K2.8. La plataforma abierta de Kimi descontinuó la serie kimi-k2 en mayo de 2026 y kimi-k2.5 junto con la familia moonshot-v1 en agosto de 2026. Ninguno de esos IDs se resuelve ahora a K2.8 Preview.

Para qué está posicionado oficialmente cada modelo

Kimi K3 es el modelo más capaz de Moonshot. La lista de modelos de Kimi lo describe como diseñado para "escenarios de inteligencia fronteriza como ingeniería de software, trabajo de conocimiento y razonamiento profundo", construido sobre 2.8 billones de parámetros con comprensión visual nativa y una ventana de contexto de 1,048,576 tokens. Cubrimos su superficie de API, llamadas a herramientas y límites operativos en la guía de lanzamiento de Kimi K3.

Kimi K2.8 Preview está posicionado para el desarrollo cotidiano en lugar del trabajo fronterizo. Las notas de versión de Kimi dicen que mejora la capacidad de codificación y de agente con una eficiencia de pensamiento notablemente mejor que K2.7 Code, y es adecuado para completar código y tareas de desarrollo rutinarias. Se lanzó el 11 de septiembre de 2026 como un despliegue completo dentro de Kimi Code — y el ID del modelo no cambió, por lo que las configuraciones existentes de kimi-for-coding lo adoptaron sin necesidad de cambios en el cliente. Nuestra guía de Kimi K2.8 Preview explica cómo conectar Kimi Code a una clave de terceros.

La relación entre ambos es deliberada: K2.8 Preview es el modelo de trabajo predeterminado, K3 es la ruta de escalada.

Comparación de especificaciones

Todo lo siguiente es la especificación publicada por el propio Kimi para Kimi Code, donde ambos modelos están actualmente disponibles lado a lado.

Kimi K2.8 Preview Kimi K3
ID de modelo kimi-for-coding k3 / k3-256k
Número de parámetros No publicado 2.8 billones
Ventana de contexto 1,048,576 tokens 1,048,576 tokens (k3) / 262,144 (k3-256k)
Esfuerzo de razonamiento low / high / max, predeterminado max low / high / max, predeterminado high
Entrada multimodal Imágenes y video Imágenes y video (k3) / solo imágenes (k3-256k)
Quién puede llamarlo Todos los niveles de membresía Moderato y superior; la ventana de 1M requiere Allegretto y superior
Consumo relativo Estándar k3 (1M) cuesta aproximadamente el doble que k3-256k
Precio de API pública No publicado $0.30 entrada en caché / $3.00 entrada / $15.00 salida por 1M de tokens

Vale la pena memorizar una regla de enrutamiento porque cambia silenciosamente qué modelo atiende tu solicitud: dentro de Kimi Code, desactivar el pensamiento enruta tanto las solicitudes de K3 como las de K2.8 Preview a K2.8 Preview sin pensamiento. Una solicitud que configuraste como K3 puede, por tanto, ser respondida por K2.8. Este es el comportamiento de Kimi Code; no asumas que la misma regla se aplica a la plataforma abierta o a una pasarela de terceros.

Lo que Moonshot no ha publicado

Hay tres vacíos que vale la pena señalar claramente, porque la mayoría del contenido comparativo los rellena con suposiciones:

  • Número de parámetros. Kimi publicó 2.8T para K3. No hay un número de parámetros publicado para K2.8 Preview.
  • Benchmarks. El anuncio de K2.8 Preview no publica puntuaciones ni una evaluación reproducible de K2.8 frente a K3. "Se acerca a K3" es la propia evaluación de Moonshot, no una medición independiente — tampoco la nuestra.
  • Precio. Ver la siguiente sección.

Precios: K3 tiene un número, K2.8 Preview no

La tabla de precios de Kimi lista cuatro modelos. K2.8 Preview no es uno de ellos.

Modelo Entrada (acierto de caché) Entrada (fallo de caché) Salida Contexto
kimi-k3 $0.30/M $3.00/M $15.00/M 1,048,576
kimi-k2.7-code $0.19/M $0.95/M $4.00/M 262,144
kimi-k2.7-code-highspeed $0.38/M $1.90/M $8.00/M 262,144
kimi-k2.6 $0.16/M $0.95/M $4.00/M 262,144
Kimi K2.8 Preview

K2.8 Preview se vende como parte de una membresía de Kimi Code, no por token. Kimi Code comparte la misma cuota que la membresía de Kimi: la cuota se renueva cada 7 días, hay una ventana adicional móvil de 5 horas, y un saldo de uso extra se activa cuando la cuota se agota. Kimi describe la tarifa de uso extra solo como "cercana al precio oficial de API de la plataforma abierta de Kimi, como se muestra en la plataforma" — no publica una tarifa para K2.8 Preview.

Así que la comparación honesta no es "K2.8 es más barato que K3 por X" sino "K2.8 se factura como suscripción y K3 como tokens." Dicho esto, tres hechos publicados apuntan a que K2.8 Preview se sitúa por debajo de K3 en costo:

  1. Todos los niveles de Kimi Code pueden llamar a K2.8 Preview, mientras que K3 requiere Moderato o superior.
  2. K2.8 Preview está posicionado para completar código y desarrollo rutinario, no para trabajo fronterizo.
  3. Su hermano publicado más cercano en la plataforma abierta, kimi-k2.7-code, tiene un precio de $0.95 de entrada / $4.00 de salida por millón de tokens — aproximadamente un tercio del precio de entrada de K3 y una cuarta parte de su precio de salida.

El precio de ruta de APIMaster para K2.8 Preview es una ranura reservada. No estamos anunciando un precio de K2.8 ni disponibilidad confirmada. Cuando Moonshot abra el modelo a la API pública y listemos la ruta, aquí es donde irá el número, y podrás compararlo con K3 tarjeta por tarjeta en el mismo mercado.

Ruta Entrada Salida
Kimi K3 en APIMaster (hoy) $2.25/M — 25% por debajo del precio oficial de Kimi de $3.00/M $11.25/M — 25% por debajo del precio oficial de Kimi de $15.00/M
Kimi K2.8 Preview en APIMaster Reservado — se publicará con la ruta Reservado — se publicará con la ruta

Los precios de ruta y el suministro de canales cambian. Consulta la tarjeta en vivo en el marketplace antes de mover tráfico de producción.

Ambos modelos pertenecen a la misma familia, así que si todavía estás decidiendo entre Kimi y las otras rutas fronterizas, la página de API de Kimi compara lo que cubre una sola clave entre Kimi, Claude, GPT y DeepSeek.

Qué significa esto en la práctica

Más allá de la hoja de especificaciones, cuatro detalles operativos deciden cómo se siente la elección en el día a día.

Invalidación de caché. Cambiar de modelo o cambiar el esfuerzo de razonamiento invalida la caché de contexto, por lo que la siguiente solicitud re-precarga la conversación y cuesta más. Kimi recomienda iniciar una nueva sesión en lugar de alternar dentro de una conversación larga. Si planeas comparar K2.8 y K3 en la misma tarea, presupuesta esa primera solicitud costosa en cada uno.

Los errores de permisos parecen errores de autenticación. Una solicitud que excede tu plan devuelve 401, no un mensaje de cuota. Llamar a k3 por debajo de Moderato, solicitar la ventana de 1M en Moderato, o llamar a kimi-for-coding-highspeed por debajo de Allegretto se manifiestan todos como 401. Si tu clave funciona para un modelo y falla para otro, verifica el plan antes de rotar claves.

Los IDs difieren según la superficie. Una configuración de k3 solo es válida dentro de Kimi Code. En la plataforma abierta, el mismo modelo es kimi-k3. Copia los IDs de la superficie que realmente estás llamando, y registra proveedor, endpoint e ID de modelo junto con cualquier benchmark que mantengas.

Verifica, no asumas. La afirmación de un modelo sobre su propia identidad no es prueba de qué modelo atendió una solicitud. Esto importa más de lo habitual aquí, porque desactivar el pensamiento en K3 legítimamente entrega la solicitud a K2.8 Preview — un resultado enrutado que parece una degradación si no lo esperabas.

Cómo elegir

  • Completar código, refactorizaciones pequeñas y desarrollo rutinario: K2.8 Preview. Está disponible en todos los niveles, soporta la ventana completa de 1M y es la ruta más barata.
  • Cambios a escala de repositorio, ejecuciones largas de agentes, razonamiento profundo y trabajo de conocimiento: K3. Su nivel insignia de 2.8T de parámetros y su contexto de 1M son la razón para pagar más.
  • Necesitas una API pública, compatibilidad con SDK o facturación predecible por token: K3 hoy, porque K2.8 Preview no tiene ID de API pública.
  • Quieres el mayor rendimiento dentro de Kimi Code: ninguno de los anteriores — kimi-for-coding-highspeed proporciona aproximadamente 6x de velocidad de salida a 3x de consumo, con la misma capacidad de codificación que K2.7 Code.

De qué habla la comunidad

Los dos modelos tienen niveles muy diferentes de discusión pública, y eso en sí mismo es una señal útil.

K3 ha sido ampliamente discutido desde julio de 2026. En Hacker News, "Kimi K3: Open Frontier Intelligence" alcanzó 2,107 puntos y 1,214 comentarios, "Kimi-K3 on HuggingFace" 1,382 puntos, "Kimi K3 Is Competitive with Fable" 877 puntos, y "Moonshot AI suspends new subscriptions due to Kimi K3 demand" 284 puntos — el último es un recordatorio de que la capacidad, no solo la calidad, moldeó cómo Moonshot eligió vender sus modelos. Notas de arquitectura, el informe técnico y experimentos de inferencia local (ejecutando K3 en 29 GB de RAM) atrajeron hilos sustanciales.

K2.8 Preview casi no tiene cobertura en inglés: una búsqueda en Hacker News de "Kimi K2.8" y "Moonshot K2.8" no devuelve ninguna historia ni comentario, y las pasarelas de terceros convencionales no listan el modelo. La discusión se concentra en canales de desarrolladores en chino, lo que es consistente con un modelo que actualmente solo se distribuye dentro de un producto de suscripción. Trata el entusiasmo de la comunidad por K3 como evidencia de interés, no como un veredicto de calidad K2.8 frente a K3.

FAQ

¿Cuál es el ID de modelo para Kimi K2.8 Preview?

Dentro de Kimi Code, kimi-for-coding. El ID no cambió cuando se actualizó el modelo subyacente, por lo que las configuraciones existentes siguen funcionando. La plataforma abierta de Kimi no ofrece K2.8 Preview, por lo que aún no hay un ID de modelo de API pública para él.

¿Es Kimi K2.8 Preview mejor que Kimi K3?

Moonshot describe K2.8 Preview como cercano a K3 con mejor eficiencia de pensamiento que K2.7 Code, pero no publica puntuaciones de benchmark para él. K3 sigue siendo el modelo insignia de 2.8T de parámetros. Para una respuesta real, ejecuta tu propia tarea — una prueba que falla, un cambio de varios archivos, una pregunta sobre un documento largo — en ambos y compara corrección, tiempo de finalización y costo.

¿Puedo llamar a Kimi K3 desde una API?

Sí. K3 es un modelo público en la plataforma abierta de Kimi como kimi-k3, y está disponible en APIMaster con un endpoint compatible con OpenAI. K2.8 Preview es el que no se puede llamar como modelo de API pública.

¿Por qué el ID de Kimi Code es k3 cuando el ID de API es kimi-k3?

Son dos productos con dos esquemas de nombres. Los cuatro IDs de Kimi Code son k3, k3-256k, kimi-for-coding y kimi-for-coding-highspeed; los IDs actuales de la plataforma abierta son kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed y kimi-k2.6. Siempre copia el ID de la superficie que estás llamando.

¿Desactivar el pensamiento me da Kimi K2.8 Preview?

Dentro de Kimi Code, sí: las solicitudes configuradas para K3 o K2.8 Preview con el pensamiento desactivado son atendidas ambas por K2.8 Preview sin pensamiento. No generalices esta regla a la plataforma abierta o a una pasarela de terceros sin verificar la documentación de ese proveedor.

¿Está Kimi K2.8 Preview disponible en APIMaster?

Todavía no. K2.8 Preview no es un modelo de API pública, por lo que no hay ruta ni precio que listar. APIMaster actualmente sirve kimi-k3, kimi-k2.6 y kimi-k2.7-code. Listaremos K2.8 Preview en cuanto Moonshot lo abra al mercado abierto, y la misma clave de API lo cubrirá entonces.

Fuentes y fecha de verificación

Empieza con Kimi K3 en APIMaster.ai

K2.8 Preview es el modelo a observar; K3 es el modelo que puedes llamar ahora mismo. En APIMaster.ai una sola clave compatible con OpenAI cubre Kimi K3 a 25% por debajo del precio oficial de Kimi, junto con rutas de Claude, GPT, DeepSeek, Gemini y GLM, para que puedas comparar el modelo insignia con el resto de tu stack antes de que llegue K2.8 Preview.

Crea una cuenta en APIMaster, genera una clave en la consola, apunta tu cliente a https://apimaster.ai/v1 y configura el modelo como kimi-k3. Cada canal de Kimi se verifica por huella digital antes de ser listado.