APIMaster.ai
Back to Blog
APIMaster Blog

Kimi K2.8 Preview vs Kimi K3 : Lequel devriez-vous utiliser ?

Kimi K2.8 Preview et Kimi K3 se situent sur des surfaces différentes : K3 est un modèle d'API public (kimi-k3), K2.8 Preview est une route Kimi Code (kimi-for-coding). Comparez les spécifications, les limites d'accès, les tarifs et quand utiliser chacun.

Kimi K2.8 PreviewKimi K3Kimi APIKimi CodeMoonshot AIAPIMaster

Published 2026-09-17

Quick Answer

Kimi K2.8 Preview et Kimi K3 ne sont pas deux options sur le même rayon. K3 est un modèle d'API public, et K2.8 Preview est une route au sein de Kimi Code. Sur la plateforme ouverte de Kimi, le modèle phare répond à kimi-k3 ; au sein de Kimi Code, ce même modèle phare répond à k3, tandis que K2.8 Preview conserve l'ancien identifiant kimi-for-coding.

K2.8 Preview est le niveau plus léger et moins coûteux : chaque niveau d'abonnement Kimi Code peut l'utiliser, y compris la fenêtre de 1M de tokens, et Moonshot décrit ses performances globales comme approchant celles de K3. K3 est le modèle phare avec 2,8 billions de paramètres, mais il nécessite Moderato ou supérieur, et sa fenêtre de 1M nécessite Allegretto ou supérieur.

Moonshot n'a publié aucun prix par token pour K2.8 Preview, il n'y a donc rien à comparer au tarif officiel de K3 de 3,00 $ par million de tokens en entrée et 15,00 $ par million de tokens en sortie. Sur APIMaster, vous pouvez utiliser kimi-k3 dès aujourd'hui avec une seule clé compatible OpenAI ; K2.8 Preview n'est pas encore un modèle d'API public, et nous le listerons dès que Moonshot l'ouvrira au marché ouvert.

Le même modèle a des identifiants différents selon les surfaces

C'est ce qui déroute les utilisateurs. Kimi gère deux produits distincts, et chacun nomme ses modèles à sa manière.

Surface Ce que c'est Identifiant Kimi K3 Identifiant Kimi K2.8 Preview
Plateforme ouverte Kimi API à la carte pour tout développeur kimi-k3 — non proposé
Kimi Code Service de codage inclus dans un abonnement Kimi k3, k3-256k kimi-for-coding

Kimi Code expose actuellement quatre identifiants de modèles issus de trois modèles : k3 et k3-256k (les variantes 1M et 262 144 tokens de K3), kimi-for-coding (K2.8 Preview), et kimi-for-coding-highspeed (K2.7 Code HighSpeed).

Deux conséquences pratiques :

  • N'envoyez pas kimi-k2.8 à une API. Cet identifiant n'existe nulle part. Sur la plateforme ouverte de Kimi, les seuls modèles Kimi actuels sont kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed et kimi-k2.6.
  • Une passerelle listant un ancien nom Kimi n'est pas automatiquement devenue K2.8. La plateforme ouverte de Kimi a abandonné la série kimi-k2 en mai 2026 et kimi-k2.5 ainsi que la famille moonshot-v1 en août 2026. Aucun de ces identifiants ne résout désormais vers K2.8 Preview.

Le positionnement officiel de chaque modèle

Kimi K3 est le modèle le plus performant de Moonshot. La liste des modèles de Kimi le décrit comme conçu pour « les scénarios d'intelligence de pointe tels que l'ingénierie logicielle, le travail de connaissance et le raisonnement approfondi », construit sur 2,8 billions de paramètres avec une compréhension visuelle native et une fenêtre de contexte de 1 048 576 tokens. Nous couvrons son interface API, ses capacités d'appel d'outils et ses limites opérationnelles dans le guide de lancement de Kimi K3.

Kimi K2.8 Preview est positionné pour le développement quotidien plutôt que pour le travail de pointe. Les notes de version de Kimi indiquent qu'il améliore les capacités de codage et d'agent avec une efficacité de réflexion nettement meilleure que K2.7 Code, et qu'il convient à la complétion de code et aux tâches de développement courantes. Il a été déployé le 11 septembre 2026 en tant que déploiement complet au sein de Kimi Code — et l'identifiant du modèle n'a pas changé, de sorte que les configurations kimi-for-coding existantes l'ont adopté sans modification côté client. Notre guide Kimi K2.8 Preview explique comment connecter Kimi Code à une clé tierce.

La relation entre les deux est délibérée : K2.8 Preview est le modèle de travail par défaut, K3 est la voie d'escalade.

Comparaison des spécifications

Tout ce qui suit est la spécification officielle publiée par Kimi pour Kimi Code, où les deux modèles sont actuellement disponibles côte à côte.

Kimi K2.8 Preview Kimi K3
Identifiant du modèle kimi-for-coding k3 / k3-256k
Nombre de paramètres Non publié 2,8 billions
Fenêtre de contexte 1 048 576 tokens 1 048 576 tokens (k3) / 262 144 (k3-256k)
Effort de raisonnement low / high / max, défaut max low / high / max, défaut high
Entrée multimodale Images et vidéo Images et vidéo (k3) / images uniquement (k3-256k)
Qui peut l'appeler Chaque niveau d'abonnement Moderato et supérieur ; fenêtre 1M nécessite Allegretto et supérieur
Consommation relative Standard k3 (1M) coûte environ deux fois k3-256k
Prix API public Non publié 0,30 $ entrée en cache / 3,00 $ entrée / 15,00 $ sortie par 1M de tokens

Une règle de routage mérite d'être mémorisée car elle change silencieusement quel modèle sert votre requête : au sein de Kimi Code, désactiver la réflexion route à la fois les requêtes K3 et K2.8 Preview vers K2.8 Preview sans réflexion. Une requête que vous avez configurée comme K3 peut donc être répondue par K2.8. C'est un comportement de Kimi Code ; ne supposez pas que la même règle s'applique à la plateforme ouverte ou à une passerelle tierce.

Ce que Moonshot n'a pas publié

Trois lacunes méritent d'être énoncées clairement, car la plupart des contenus comparatifs les comblent avec des suppositions :

  • Nombre de paramètres. Kimi a publié 2,8T pour K3. Il n'existe aucun nombre de paramètres publié pour K2.8 Preview.
  • Benchmarks. L'annonce de K2.8 Preview ne publie aucun score et aucune évaluation reproductible K2.8 contre K3. « Approche K3 » est l'évaluation propre de Moonshot, pas une mesure indépendante — y compris la nôtre.
  • Prix. Voir la section suivante.

Tarifs : K3 a un chiffre, K2.8 Preview n'en a pas

Le tableau des prix de Kimi liste quatre modèles. K2.8 Preview n'en fait pas partie.

Modèle Entrée (cache hit) Entrée (cache miss) Sortie Contexte
kimi-k3 0,30 $/M 3,00 $/M 15,00 $/M 1 048 576
kimi-k2.7-code 0,19 $/M 0,95 $/M 4,00 $/M 262 144
kimi-k2.7-code-highspeed 0,38 $/M 1,90 $/M 8,00 $/M 262 144
kimi-k2.6 0,16 $/M 0,95 $/M 4,00 $/M 262 144
Kimi K2.8 Preview

K2.8 Preview est vendu dans le cadre d'un abonnement Kimi Code, pas au token. Kimi Code partage le même quota que l'abonnement Kimi : le quota se renouvelle tous les 7 jours, il existe une fenêtre glissante supplémentaire de 5 heures, et un solde d'utilisation supplémentaire prend le relais lorsque le quota est épuisé. Kimi décrit le tarif d'utilisation supplémentaire uniquement comme « proche du prix API officiel de la plateforme ouverte Kimi, tel qu'affiché sur la plateforme » — il ne publie pas de tarif pour K2.8 Preview.

La comparaison honnête n'est donc pas « K2.8 est moins cher que K3 de X » mais « K2.8 est facturé en abonnement et K3 en tokens ». Cela dit, trois faits publiés indiquent que K2.8 Preview se situe en dessous de K3 en termes de coût :

  1. Chaque niveau Kimi Code peut appeler K2.8 Preview, tandis que K3 nécessite Moderato ou supérieur.
  2. K2.8 Preview est positionné pour la complétion et le développement courant, pas pour le travail de pointe.
  3. Son frère publié le plus proche sur la plateforme ouverte, kimi-k2.7-code, est tarifé à 0,95 $ en entrée / 4,00 $ en sortie par million de tokens — environ un tiers du prix d'entrée de K3 et un quart de son prix de sortie.

Le prix de la route APIMaster pour K2.8 Preview est un emplacement réservé. Nous n'annonçons pas de prix K2.8 ni de disponibilité confirmée. Lorsque Moonshot ouvrira le modèle à l'API publique et que nous listerons la route, c'est ici que le chiffre apparaîtra, et vous pourrez le comparer avec K3 carte contre carte dans le même marketplace.

Route Entrée Sortie
Kimi K3 sur APIMaster (aujourd'hui) 2,25 $/M — 25 % sous le tarif officiel de Kimi à 3,00 $/M 11,25 $/M — 25 % sous le tarif officiel de Kimi à 15,00 $/M
Kimi K2.8 Preview sur APIMaster Réservé — à publier avec la route Réservé — à publier avec la route

Les prix des routes et l'offre des canaux changent. Vérifiez la carte en direct dans le marketplace avant de déplacer du trafic de production.

Les deux modèles appartiennent à la même famille, donc si vous hésitez encore entre Kimi et les autres routes de pointe, la page API Kimi compare ce qu'une seule clé couvre entre Kimi, Claude, GPT et DeepSeek.

Ce que cela signifie en pratique

Au-delà de la fiche technique, quatre détails opérationnels déterminent la sensation du choix au quotidien.

Invalidation du cache. Changer de modèle ou changer l'effort de raisonnement invalide le cache de contexte, de sorte que la requête suivante re-préremplit la conversation et coûte plus cher. Kimi recommande de démarrer une nouvelle session plutôt que de basculer d'avant en arrière dans une session longue. Si vous prévoyez de comparer K2.8 et K3 sur la même tâche, prévoyez ce premier appel coûteux pour chacun.

Les erreurs de permission ressemblent à des erreurs d'authentification. Une requête qui dépasse votre plan renvoie 401, pas un message de quota. Appeler k3 sous Moderato, demander la fenêtre 1M sur Moderato, ou appeler kimi-for-coding-highspeed sous Allegretto se manifeste tous par un 401. Si votre clé fonctionne pour un modèle et échoue pour un autre, vérifiez le plan avant de faire pivoter les clés.

Les identifiants diffèrent selon la surface. Une configuration k3 n'est valide qu'au sein de Kimi Code. Sur la plateforme ouverte, le même modèle est kimi-k3. Copiez les identifiants depuis la surface que vous appelez réellement, et enregistrez le fournisseur, l'endpoint et l'identifiant du modèle à côté de tout benchmark que vous conservez.

Vérifiez, ne supposez pas. L'affirmation d'un modèle sur sa propre identité n'est pas une preuve de quel modèle a servi une requête. Cela importe plus que d'habitude ici, car désactiver la réflexion sur K3 remet légitimement la requête à K2.8 Preview — un résultat routé qui ressemble à une dégradation si vous ne vous y attendiez pas.

Comment choisir

  • Complétion de code, petits refactorings et développement courant : K2.8 Preview. Il est disponible sur chaque niveau, prend en charge la fenêtre complète de 1M, et est la route la moins chère.
  • Changements à l'échelle du dépôt, longues exécutions d'agents, raisonnement approfondi et travail de connaissance : K3. Son niveau phare de 2,8T de paramètres et son contexte de 1M sont la raison de payer plus.
  • Vous avez besoin d'une API publique, d'une compatibilité SDK ou d'une facturation prévisible par token : K3 aujourd'hui, car K2.8 Preview n'a pas d'identifiant d'API public.
  • Vous voulez le débit le plus élevé au sein de Kimi Code : ni l'un ni l'autre — kimi-for-coding-highspeed fournit environ 6x la vitesse de sortie à 3x la consommation, avec la même capacité de codage que K2.7 Code.

Ce dont parle la communauté

Les deux modèles ont des niveaux de discussion publique très différents, et c'est en soi un signal utile.

K3 est largement discuté depuis juillet 2026. Sur Hacker News, « Kimi K3: Open Frontier Intelligence » a atteint 2 107 points et 1 214 commentaires, « Kimi-K3 on HuggingFace » 1 382 points, « Kimi K3 Is Competitive with Fable » 877 points, et « Moonshot AI suspends new subscriptions due to Kimi K3 demand » 284 points — ce dernier rappelant que la capacité, pas seulement la qualité, a façonné la façon dont Moonshot a choisi de vendre ses modèles. Les notes d'architecture, le rapport technique et les expériences d'inférence locale (exécution de K3 dans 29 Go de RAM) ont tous attiré des fils substantiels.

K2.8 Preview n'a presque aucune couverture en anglais : une recherche Hacker News pour « Kimi K2.8 » et « Moonshot K2.8 » ne renvoie aucune histoire ni aucun commentaire, et les passerelles tierces grand public ne listent pas le modèle. La discussion est concentrée dans les canaux de développeurs en langue chinoise, ce qui est cohérent avec un modèle qui n'est actuellement disponible que dans un produit par abonnement. Traitez l'enthousiasme communautaire pour K3 comme une preuve d'intérêt, pas comme un verdict de qualité K2.8 contre K3.

FAQ

Quel est l'identifiant du modèle pour Kimi K2.8 Preview ?

Au sein de Kimi Code, kimi-for-coding. L'identifiant n'a pas changé lorsque le modèle sous-jacent a été mis à niveau, de sorte que les configurations existantes continuent de fonctionner. La plateforme ouverte de Kimi ne propose pas K2.8 Preview, il n'existe donc pas encore d'identifiant de modèle d'API public pour lui.

Kimi K2.8 Preview est-il meilleur que Kimi K3 ?

Moonshot décrit K2.8 Preview comme approchant K3 avec une meilleure efficacité de réflexion que K2.7 Code, mais ne publie aucun score de benchmark pour lui. K3 reste le modèle phare de 2,8T de paramètres. Pour une réponse réelle, exécutez votre propre tâche — un test qui échoue, un changement multi-fichiers, une question sur un long document — sur les deux et comparez l'exactitude, le temps d'achèvement et le coût.

Puis-je appeler Kimi K3 depuis une API ?

Oui. K3 est un modèle public sur la plateforme ouverte de Kimi sous le nom kimi-k3, et il est disponible sur APIMaster avec un endpoint compatible OpenAI. K2.8 Preview est celui qui ne peut pas être appelé comme modèle d'API public.

Pourquoi l'identifiant Kimi Code est-il k3 alors que l'identifiant API est kimi-k3 ?

Ce sont deux produits avec deux schémas de nommage. Les quatre identifiants de Kimi Code sont k3, k3-256k, kimi-for-coding et kimi-for-coding-highspeed ; les identifiants actuels de la plateforme ouverte sont kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed et kimi-k2.6. Copiez toujours l'identifiant depuis la surface que vous appelez.

Désactiver la réflexion me donne-t-il Kimi K2.8 Preview ?

Au sein de Kimi Code, oui : les requêtes configurées pour K3 ou K2.8 Preview avec la réflexion désactivée sont toutes deux servies par K2.8 Preview sans réflexion. Ne généralisez pas cette règle à la plateforme ouverte ou à une passerelle tierce sans vérifier la documentation de ce fournisseur.

Kimi K2.8 Preview est-il disponible sur APIMaster ?

Pas encore. K2.8 Preview n'est pas un modèle d'API public, il n'y a donc ni route ni prix à lister. APIMaster sert actuellement kimi-k3, kimi-k2.6 et kimi-k2.7-code. Nous listerons K2.8 Preview dès que Moonshot l'ouvrira au marché ouvert, et la même clé API le couvrira alors.

Sources et date de vérification

Commencez avec Kimi K3 sur APIMaster.ai

K2.8 Preview est le modèle à surveiller ; K3 est le modèle que vous pouvez appeler dès maintenant. Sur APIMaster.ai, une seule clé compatible OpenAI couvre Kimi K3 à 25 % sous le prix officiel de Kimi, aux côtés des routes Claude, GPT, DeepSeek, Gemini et GLM, afin que vous puissiez comparer le modèle phare au reste de votre pile avant l'arrivée de K2.8 Preview.

Créez un compte APIMaster, générez une clé dans la console, pointez votre client vers https://apimaster.ai/v1 et définissez le modèle sur kimi-k3. Chaque canal Kimi est vérifié par empreinte avant d'être listé.