Kimi K2.8 Preview: contexto de un millón de tokens para la programación diaria
Explora Kimi K2.8 Preview, su contexto de 1M, sus niveles de razonamiento y el ID de modelo kimi-for-coding. Descubre cómo conectar Kimi Code a los modelos disponibles de APIMaster.
Published 2026-09-13
Kimi K2.8 Preview se lanzó en Kimi Code el 11 de septiembre de 2026. Moonshot afirma que su rendimiento general se acerca a K3, con capacidades de programación y de agente superiores a K2.7 Code. Admite 1.048.576 tokens de contexto, entrada de imágenes y vídeo, y esfuerzo de razonamiento low / high / max. Todos los niveles de membresía de Kimi Code pueden acceder a su contexto de 1M. El ID de modelo de Kimi Code sigue siendo kimi-for-coding.
En APIMaster.ai, vemos el atractivo práctico: más contexto de proyecto y razonamiento ajustable para el desarrollo rutinario. Esta guía explica la actualización y cómo conectar Kimi Code a nuestro marketplace de modelos. Según la comprobación del 13 de septiembre, el catálogo público de precios de APIMaster incluye kimi-k3, kimi-k2.6 y kimi-k2.7-code, pero no incluye explícitamente K2.8 Preview. Consulta el marketplace en vivo para ver la disponibilidad actual antes de elegir un modelo.
¿Qué hay de nuevo en Kimi K2.8 Preview?
K2.8 Preview actualiza la ruta kimi-for-coding ya existente de Kimi Code. Los usuarios que ya llaman a ese ID a través de Kimi Code no necesitan cambiar el nombre de su configuración de modelo. Las notas de la versión oficiales describen mejoras en programación, capacidad de agente y eficiencia de pensamiento en comparación con K2.7 Code.
El mayor cambio de acceso es la ventana de contexto: todos los niveles de membresía de Kimi Code pueden usar hasta 1M de tokens con K2.8 Preview. La opción de 1M de K3 sigue requiriendo Allegretto o superior. El informe de QbitAI del 12 de septiembre también indica que K2.8 Preview está disponible en Kimi Work; los ajustes técnicos de esta guía provienen de la documentación de Kimi Code.
Esta es una versión preliminar. El anuncio no proporciona nuevas puntuaciones de benchmark ni una evaluación reproducible de K2.8 frente a K3. "Se acerca a K3" es la valoración de Moonshot, no un resultado de prueba independiente de APIMaster.
Kimi K2.8 Preview vs K3: ¿qué cambia para los desarrolladores?
La siguiente comparación se aplica específicamente al servicio oficial de Kimi Code, usando su documentación de configuración de modelos.
| Característica | K2.8 Preview | K3 en Kimi Code |
|---|---|---|
| ID de modelo | kimi-for-coding |
k3 o k3-256k |
| Posicionamiento | Autocompletado de código y desarrollo rutinario; rendimiento descrito como cercano a K3 | Modelo de programación insignia para trabajo exigente |
| Contexto | 1.048.576 tokens | 1.048.576 para k3; 262.144 para k3-256k |
| Acceso por membresía | Todos los niveles, incluida la ventana de 1M | Moderato o superior; 1M requiere Allegretto o superior |
| Esfuerzo de razonamiento | low, high, max; predeterminado max |
low, high, max; predeterminado high |
| Entrada visual | Imágenes y vídeo | Imágenes y vídeo para k3; solo imágenes para k3-256k |
Kimi Code también conserva kimi-for-coding-highspeed, que su documentación identifica como K2.7 Code HighSpeed. Es una ruta separada, no una variante de alta velocidad de K2.8.
Para los equipos, la comparación útil es el coste por tarea completada: ¿puede un modelo corregir el problema, pasar las pruebas y terminar en un tiempo aceptable? Empieza evaluando K2.8 en cambios acotados y autocompletado de código, y luego compara el trabajo más complejo sobre el repositorio con K3. El anuncio de la versión preliminar por sí solo no puede establecer qué modelo gana en tu base de código.
¿Qué hace posible una ventana de contexto de 1M?
Una ventana más grande puede mantener juntos más archivos fuente, especificaciones, resultados de pruebas e historial de conversación. Esto es útil cuando un cambio abarca varios paquetes o cuando un asistente de programación debe contrastar detalles de implementación con un documento de diseño extenso.
También admite flujos de trabajo visuales: las capturas de pantalla pueden ayudar a explicar un defecto de interfaz, mientras que la entrada de vídeo puede aportar contexto sobre una interacción grabada. Los formatos y límites reales de los archivos adjuntos dependen del cliente y de la ruta.
1M es un límite de contexto, no una promesa de recuerdo perfecto, uso ilimitado ni un millón de tokens de salida. El contexto relevante sigue importando. Recomendamos empezar con los archivos necesarios para la tarea, añadir más solo cuando ayuden, y medir el uso de tokens y la calidad de finalización a medida que crece la sesión.
¿Cómo funcionan el esfuerzo de razonamiento y el enrutamiento de modelos?
K2.8 Preview admite tres niveles de razonamiento en Kimi Code:
low: un punto de partida útil para ediciones acotadas y preguntas sencillas.high: un nivel que conviene evaluar para depuración y cambios que implican varias restricciones.max: el valor predeterminado de K2.8; merece compararse en tareas de razonamiento difíciles frente a su tiempo y uso de tokens adicionales.
Estas son sugerencias de evaluación, no garantías medidas de velocidad o calidad. La documentación de Kimi Code también recomienda iniciar una conversación nueva al cambiar de modelo, porque el cambio invalida la caché de contexto existente.
Hay un detalle de enrutamiento importante: en Kimi Code, desactivar el pensamiento para K3 o para K2.8 Preview enruta la solicitud a K2.8 Preview sin pensamiento. Por lo tanto, una solicitud configurada como K3 puede ser atendida por K2.8 bajo esta condición documentada.
Al comparar modelos, registra el proveedor, el endpoint, el ID de modelo, la configuración de pensamiento y la fecha de la prueba. El nombre del modelo devuelto o la propia afirmación de un modelo sobre su identidad no son prueba suficiente de qué modelo atendió una solicitud. Esta regla de enrutamiento de Kimi Code no describe automáticamente la API general de Moonshot ni todas las pasarelas de terceros.
¿Cuál es el precio de la API de Kimi K2.8 Preview?
Las dos páginas oficiales de Kimi Code revisadas para este artículo establecen el acceso y las capacidades, pero no publican una tabla de precios separada de tokens de entrada/salida para K2.8 Preview. El acceso a través de un nivel de membresía es distinto del precio de la API de pago por uso. Una asignación de contexto de 1M tampoco significa tokens gratuitos ilimitados.
El ID de modelo oficial de Kimi Code es kimi-for-coding; el nombre visible "K2.8 Preview" no es un ID de API sustituto. No asumas que una pasarela acepta ese ID ni que un listado antiguo de Kimi se ha convertido automáticamente en K2.8.
Para APIMaster, usa el ID de modelo y los precios de ruta en vivo que se muestran en nuestro marketplace. Revisa la tarifa de facturación de la cuenta aplicable, la cuota disponible y los registros de uso antes de estimar los costes de producción. En este artículo no anunciamos un precio de K2.8 ni la disponibilidad confirmada de K2.8 en APIMaster.
Cómo usar Kimi Code con APIMaster.ai
Kimi Code es un cliente de programación que también puede usar proveedores de terceros. Puedes conectarlo a APIMaster hoy mismo y seleccionar los modelos disponibles para tu clave de API, independientemente de una suscripción de modelo de Kimi Code.
- Crea una cuenta de APIMaster, revisa el marketplace de modelos y añade saldo según sea necesario.
- Genera una clave de API en la consola de APIMaster.
- Inicia Kimi Code e introduce
/provider, luego elige Custom registry (api.json). - Introduce
https://apimaster.ai/kimi/registry.jsoncomo URL del registro y tu clave de API de APIMaster como token Bearer. - Selecciona un modelo en la pestaña del proveedor apimaster y envía una pequeña tarea de programación. Comprueba el resultado y el uso en la consola antes de escalar.

Captura de pantalla de la configuración del proveedor de nuestra guía de la CLI de Kimi Code, tomada con la versión 0.31.1. Ilustra el flujo de conexión, no la disponibilidad de K2.8.
También puedes importar el registro desde un terminal después de configurar APIMASTER_API_KEY en tu entorno local:
kimi provider add https://apimaster.ai/kimi/registry.json --api-key "$APIMASTER_API_KEY"
El registro lista modelos compatibles con programación según los permisos de tu clave. Si K2.8 no aparece explícitamente, elige un modelo compatible actualmente en lugar de inventar un ID de modelo K2.8. Consulta nuestra guía de configuración de Kimi Code para el recorrido completo y la introducción a Kimi K3 para una opción de Kimi ya existente.
¿Por qué evaluar tus modelos de programación a través de APIMaster?
Reunimos la selección de modelos, los precios de ruta en vivo, las claves de API y el seguimiento de uso en un solo lugar. Puedes comparar los modelos de Kimi disponibles con otras familias de modelos mediante una integración de API común y luego usar la misma cuenta en los clientes de programación compatibles.
Empieza con una tarea pequeña y repetible: una corrección de error con una prueba fallida, una función que necesita cobertura o un cambio documentado en varios archivos. Compara la corrección, el tiempo hasta la finalización, el comportamiento de las herramientas y el coste total. Nuestro probador de claves de API puede ayudar a comprobar la conectividad; una solicitud exitosa por sí sola no establece la identidad del modelo ni la compatibilidad con contexto de 1M.
FAQ
¿Qué es Kimi K2.8 Preview?
Es la actualización del modelo de Kimi Code de Moonshot del 11 de septiembre de 2026, posicionada para tareas rutinarias de programación y de agente. Admite contexto de 1M, imágenes, vídeo y tres niveles de razonamiento. Moonshot describe el rendimiento general como cercano a K3, sin publicar nuevas puntuaciones de benchmark en este anuncio.
¿Qué ID de modelo debo usar para K2.8 Preview?
En el servicio oficial de Kimi Code, usa kimi-for-coding. El ID se mantuvo igual cuando se actualizó el modelo subyacente. En APIMaster u otra pasarela, copia el ID exacto del listado de modelos actual de ese proveedor.
¿Está el contexto de 1M disponible para todos los miembros de Kimi Code?
Sí, para K2.8 Preview, según la documentación de Kimi. Es una asignación máxima de contexto sujeta a las cuotas del servicio, no un uso de API gratuito ilimitado. La opción de 1M de K3 sigue requiriendo Allegretto o superior.
¿Desactivar el pensamiento de K3 selecciona K2.8 Preview?
Sí, dentro de Kimi Code: las solicitudes de K3 y K2.8 con el pensamiento desactivado son atendidas por K2.8 Preview sin pensamiento. No generalices esta regla a otros endpoints sin consultar su documentación.
¿K2.8 Preview ya está disponible en APIMaster?
Nuestra comprobación del catálogo público del 13 de septiembre de 2026 no encontró un listado explícito de K2.8 Preview. Sí encontró kimi-k3, kimi-k2.6 y kimi-k2.7-code. Consulta el marketplace en vivo para ver novedades; un nombre de modelo antiguo por sí solo no confirma una actualización a K2.8.
¿Puedo usar APIMaster en Kimi Code ahora?
Sí. Importa https://apimaster.ai/kimi/registry.json con una clave de API de APIMaster y elige un modelo disponible para esa clave. El uso de la API de terceros se factura a través de APIMaster en lugar de a través de la asignación de membresía de Kimi Code.
Fuentes y fecha de verificación
- Kimi Code: notas de la versión del 11 de septiembre.
- Kimi Code: especificaciones de modelos, razonamiento y enrutamiento.
- QbitAI, 12 de septiembre de 2026: "Kimi突发K2.8:性能逼近K3,百万上下文全员开放". Usado para el despliegue reportado en Kimi Work; las afirmaciones técnicas se comprobaron con las páginas oficiales anteriores.
- Catálogo público de precios de APIMaster, comprobado el 13 de septiembre de 2026. La disponibilidad puede cambiar después de la publicación.
Empieza a construir con APIMaster.ai
K2.8 Preview hace que la programación con contexto largo merezca otra mirada. Trae una tarea real a APIMaster.ai, compara las rutas disponibles actualmente y conecta el modelo que elijas a Kimi Code. Crea tu cuenta de APIMaster para obtener una clave de API y empezar con tu primer flujo de trabajo de programación.