APIMaster.ai
ブログに戻る
APIMaster ブログ

Kimi K2.8 Preview vs Kimi K3: どちらを使うべきか?

Kimi K2.8 PreviewとKimi K3は異なるレイヤーに位置します。K3は公開APIモデル(kimi-k3)、K2.8 PreviewはKimi Codeのルート(kimi-for-coding)です。仕様、アクセス制限、料金、それぞれの使いどころを比較します。

Kimi K2.8 PreviewKimi K3Kimi APIKimi CodeMoonshot AIAPIMaster

公開 2026-09-17

クイック回答

Kimi K2.8 PreviewとKimi K3は、同じ棚に並ぶ2つの選択肢ではありません。K3は公開APIモデルであり、K2.8 PreviewはKimi Code内のルートです。 Kimiのオープンプラットフォームでは、フラッグシップモデルは kimi-k3 というIDで応答します。Kimi Code内では、同じフラッグシップが k3 というIDで応答し、K2.8 Previewは従来のID kimi-for-coding を維持しています。

K2.8 Previewは、より軽量で低コストなティアです。Kimi Codeのすべてのメンバーシップティアで利用でき、1Mトークンウィンドウも含まれます。Moonshotは、その総合的なパフォーマンスがK3に近づいていると説明しています。K3は 2.8兆パラメータ を備えたフラッグシップですが、Moderato以上 が必要で、1Mウィンドウを利用するには Allegretto以上 が必要です。

MoonshotはK2.8 Previewの トークン単位の料金を公開していない ため、K3の公式料金である 入力100万トークンあたり$3.00、出力100万トークンあたり$15.00 と並べて比較できる数字はありません。APIMasterでは、OpenAI互換のキー1つで今日から kimi-k3 を利用できます。K2.8 Previewはまだ公開APIモデルではないため、Moonshotがオープンマーケットに公開し次第、リストに追加します。

同じモデルでも、利用面によってIDが異なる

ここが混乱しやすいポイントです。Kimiは2つの別々のプロダクトを運営しており、それぞれが独自の方法でモデルを命名しています。

利用面 概要 Kimi K3 ID Kimi K2.8 Preview ID
Kimiオープンプラットフォーム 開発者向けの従量課金API kimi-k3 — 提供なし
Kimi Code Kimiメンバーシップにバンドルされたコーディングサービス k3, k3-256k kimi-for-coding

Kimi Codeは現在、3つのモデルから4つのモデルIDを公開しています。k3k3-256k(K3の1Mおよび262,144トークン版)、kimi-for-coding(K2.8 Preview)、kimi-for-coding-highspeed(K2.7 Code HighSpeed)です。

実務上の2つの重要なポイント:

  • APIに kimi-k2.8 を送信しないでください。 その識別子はどこにも存在しません。Kimiのオープンプラットフォームで現在利用可能なKimiモデルは、kimi-k3kimi-k2.7-codekimi-k2.7-code-highspeedkimi-k2.6 のみです。
  • 古いKimi名をリストしているゲートウェイが、自動的にK2.8になったわけではありません。 Kimiのオープンプラットフォームは、2026年5月に kimi-k2 シリーズを、2026年8月に kimi-k2.5moonshot-v1 ファミリーを廃止しました。これらのIDはいずれも現在K2.8 Previewに解決されません。

各モデルの公式な位置づけ

Kimi K3 はMoonshotの最も高性能なモデルです。Kimiのモデルリストでは、「ソフトウェアエンジニアリング、ナレッジワーク、深い推論などのフロンティアインテリジェンスシナリオ」向けに設計され、2.8兆パラメータ、ネイティブな視覚理解、1,048,576トークンのコンテキストウィンドウを備えていると説明されています。APIサーフェス、ツール呼び出し、運用上の制限については、Kimi K3ローンチガイド で詳しく解説しています。

Kimi K2.8 Preview は、フロンティアワークではなく、日常的な開発向けに位置づけられています。Kimiのリリースノートによると、K2.7 Codeと比較して思考効率が顕著に向上し、コーディングとエージェント機能が改善されており、コード補完や日常的な開発タスク に適しています。2026年9月11日 にKimi Code内でフルロールアウトとしてリリースされましたが、モデルIDは変更されていないため、既存の kimi-for-coding 設定はクライアントの変更なしに新しいモデルを利用できます。Kimi K2.8 Previewガイド では、Kimi Codeをサードパーティキーに接続する方法を解説しています。

両者の関係は意図的です。K2.8 Previewがデフォルトの作業モデルであり、K3がエスカレーションパスです。

仕様比較

以下はすべて、両モデルが現在並行して利用可能な Kimi Code に関するKimi自身の公開仕様です。

Kimi K2.8 Preview Kimi K3
モデルID kimi-for-coding k3 / k3-256k
パラメータ数 非公開 2.8兆
コンテキストウィンドウ 1,048,576トークン 1,048,576トークン(k3)/ 262,144(k3-256k
推論努力 low / high / max、デフォルト max low / high / max、デフォルト high
マルチモーダル入力 画像と動画 画像と動画(k3)/ 画像のみ(k3-256k
呼び出し可能なユーザー すべてのメンバーシップティア Moderato以上。1MウィンドウはAllegretto以上
相対的な消費量 標準 k3(1M)は k3-256k の約2倍のコスト
公開API料金 非公開 キャッシュ入力$0.30 / 入力$3.00 / 出力$15.00(100万トークンあたり)

1つのルーティングルールは、リクエストを処理するモデルを静かに変更するため、覚えておく価値があります。Kimi Code内で思考をオフにすると、K3とK2.8 Previewの両方のリクエストが、思考なしのK2.8 Previewにルーティングされます。 K3として設定したリクエストでも、K2.8が応答することがあります。これはKimi Codeの動作です。オープンプラットフォームやサードパーティのゲートウェイにも同じルールが適用されるとは想定しないでください。

Moonshotが公開していない情報

3つのギャップを明確に述べておきます。ほとんどの比較コンテンツは、これらを推測で埋めているからです。

  • パラメータ数。 KimiはK3について2.8Tを公開しています。K2.8 Previewのパラメータ数は公開されていません。
  • ベンチマーク。 K2.8 Previewの発表には、スコアも再現可能なK2.8対K3の評価も含まれていません。「K3に近づく」というのはMoonshot自身の評価であり、独立した測定(私たちのものも含む)ではありません。
  • 料金。 次のセクションを参照してください。

料金: K3には数字があり、K2.8 Previewにはない

Kimiの料金表には4つのモデルがリストされています。K2.8 Previewはその中にありません。

モデル 入力(キャッシュヒット) 入力(キャッシュミス) 出力 コンテキスト
kimi-k3 $0.30/M $3.00/M $15.00/M 1,048,576
kimi-k2.7-code $0.19/M $0.95/M $4.00/M 262,144
kimi-k2.7-code-highspeed $0.38/M $1.90/M $8.00/M 262,144
kimi-k2.6 $0.16/M $0.95/M $4.00/M 262,144
Kimi K2.8 Preview

K2.8 Previewは、トークン単位ではなく Kimi Codeメンバーシップ の一部として販売されています。Kimi CodeはKimiメンバーシップと同じクォータを共有します。クォータは7日ごとにリフレッシュされ、追加のローリング5時間ウィンドウがあり、クォータを使い切ると追加利用残高が引き継がれます。Kimiは追加利用率について「プラットフォームに表示されているKimiオープンプラットフォームの公式API価格に近い」とだけ説明しており、K2.8 Previewのレートは公開していません。

したがって、正直な比較は「K2.8はK3よりXだけ安い」ではなく、「K2.8はサブスクリプションとして請求され、K3はトークンとして請求される」です。とはいえ、公開されている3つの事実は、K2.8 Previewがコスト面でK3の に位置することを示しています。

  1. すべてのKimi CodeティアがK2.8 Previewを呼び出せるのに対し、K3はModerato以上が必要です。
  2. K2.8 Previewは、フロンティアワークではなく、補完と日常的な開発向けに位置づけられています。
  3. オープンプラットフォームで最も近い公開兄弟モデルである kimi-k2.7-code は、入力$0.95 / 出力$4.00(100万トークンあたり)で、K3の入力価格の約3分の1、出力価格の4分の1です。

K2.8 PreviewのAPIMasterルート価格は予約枠です。 K2.8の価格や確定した利用可能性を発表するものではありません。Moonshotがモデルを公開APIに開放し、ルートをリストに追加した際に、この場所に数字が入り、同じマーケットプレイスでK3とカード単位で比較できるようになります。

ルート 入力 出力
APIMasterのKimi K3(本日) $2.25/M — Kimi公式の$3.00/Mより25%安 $11.25/M — Kimi公式の$15.00/Mより25%安
APIMasterのKimi K2.8 Preview 予約済み — ルートとともに公開予定 予約済み — ルートとともに公開予定

ルート価格とチャネル供給は変動します。本番トラフィックを移行する前に、マーケットプレイス のライブカードを確認してください。

両モデルは同じファミリーに属しているため、Kimiと他のフロンティアルートの間でまだ迷っている場合は、Kimi APIページ で、1つのキーがKimi、Claude、GPT、DeepSeekにわたってカバーする内容を比較できます。

実務上の意味

スペックシート以外に、4つの運用上の詳細が、選択の日々の感覚を左右します。

キャッシュ無効化。 モデルを変更するか、推論努力を変更すると、コンテキストキャッシュが無効になり、次のリクエストで会話が再プリフィルされ、コストが増加します。Kimiは、長い会話の中で行き来するのではなく、新しいセッションを開始することを推奨しています。同じタスクでK2.8とK3を比較する予定がある場合は、それぞれの最初の高コストなリクエストに予算を組み込んでください。

権限エラーは認証エラーのように見えます。 プランを超えるリクエストは、クォータメッセージではなく 401 を返します。Moderato未満で k3 を呼び出す、Moderatoで1Mウィンドウを要求する、Allegretto未満で kimi-for-coding-highspeed を呼び出す — これらはすべて401として表示されます。キーが1つのモデルでは機能し、別のモデルでは失敗する場合は、キーをローテーションする前にプランを確認してください。

IDは利用面ごとに異なります。 k3 設定はKimi Code内でのみ有効です。オープンプラットフォームでは、同じモデルは kimi-k3 です。実際に呼び出している利用面からIDをコピーし、保持しているベンチマークとともにプロバイダー、エンドポイント、モデルIDを記録してください。

検証し、推測しないでください。 モデル自身のアイデンティティに関する主張は、どのモデルがリクエストを処理したかの証明にはなりません。これはここで特に重要です。K3で思考を無効にすると、正当にリクエストがK2.8 Previewに渡されるからです。これは、予期していなかった場合、ダウングレードのように見えるルーティング結果です。

選択方法

  • コード補完、小規模なリファクタリング、日常的な開発: K2.8 Preview。すべてのティアで利用可能で、フル1Mウィンドウをサポートし、より安価なルートです。
  • リポジトリ規模の変更、長時間のエージェント実行、深い推論、ナレッジワーク: K3。2.8Tパラメータのフラッグシップティアと1Mコンテキストが、より高いコストを支払う理由です。
  • 公開API、SDK互換性、予測可能なトークン単位の請求が必要な場合: 本日はK3。K2.8 Previewには公開API IDがないためです。
  • Kimi Code内で最高のスループットを求める場合: 上記のどちらでもありません — kimi-for-coding-highspeed は、K2.7 Codeと同じコーディング能力で、約6倍の出力速度を3倍の消費量で提供します。

コミュニティで話題になっていること

2つのモデルは、公開討論のレベルが大きく異なります。それ自体が有用なシグナルです。

K3は2026年7月以降、盛んに議論されています。Hacker Newsでは、「Kimi K3: Open Frontier Intelligence」が2,107ポイント、1,214コメントに達し、「Kimi-K3 on HuggingFace」が1,382ポイント、「Kimi K3 Is Competitive with Fable」が877ポイント、「Moonshot AI suspends new subscriptions due to Kimi K3 demand」が284ポイントを獲得しました。最後のものは、品質だけでなくキャパシティが、Moonshotがモデルの販売方法を形作ったことを思い出させます。アーキテクチャノート、テクニカルレポート、ローカル推論実験(29 GBのRAMでK3を実行)はすべて、かなりのスレッドを集めました。

K2.8 Previewには、英語での報道がほとんどありません。Hacker Newsで「Kimi K2.8」と「Moonshot K2.8」を検索しても、ストーリーもコメントも返ってきません。主流のサードパーティゲートウェイもモデルをリストしていません。議論は中国語の開発者チャネルに集中しており、これは現在サブスクリプション製品内でのみ提供されているモデルと一致しています。K3へのコミュニティの熱意は、関心の証拠として扱ってください。K2.8対K3の品質判定としてではありません。

FAQ

Kimi K2.8 PreviewのモデルIDは何ですか?

Kimi Code内では、kimi-for-coding です。基盤モデルがアップグレードされたときもIDは変更されなかったため、既存の設定はそのまま機能します。KimiのオープンプラットフォームはK2.8 Previewを提供していないため、公開APIモデルIDはまだありません。

Kimi K2.8 PreviewはKimi K3より優れていますか?

MoonshotはK2.8 PreviewがK2.7 Codeより優れた思考効率でK3に近づいていると説明していますが、ベンチマークスコアは公開していません。K3は依然としてフラッグシップの2.8Tパラメータモデルです。実際の答えを得るには、自分のタスク(失敗するテスト、複数ファイルの変更、長文ドキュメントの質問など)を両方で実行し、正確性、完了時間、コストを比較してください。

APIからKimi K3を呼び出せますか?

はい。K3はKimiのオープンプラットフォームで kimi-k3 として公開モデルであり、APIMasterでOpenAI互換エンドポイントを通じて利用できます。公開APIモデルとして呼び出せないのはK2.8 Previewの方です。

API IDが kimi-k3 なのに、Kimi CodeのIDが k3 なのはなぜですか?

2つのプロダクトに2つの命名スキームがあるからです。Kimi Codeの4つのIDは k3k3-256kkimi-for-codingkimi-for-coding-highspeed です。オープンプラットフォームの現在のIDは kimi-k3kimi-k2.7-codekimi-k2.7-code-highspeedkimi-k2.6 です。呼び出している利用面からIDをコピーしてください。

思考を無効にするとKimi K2.8 Previewが使えますか?

Kimi Code内では、はい。K3またはK2.8 Preview用に設定されたリクエストで思考をオフにすると、両方とも思考なしのK2.8 Previewが処理します。このルールをオープンプラットフォームやサードパーティのゲートウェイに一般化せず、そのプロバイダーのドキュメントを確認してください。

Kimi K2.8 PreviewはAPIMasterで利用できますか?

まだです。K2.8 Previewは公開APIモデルではないため、リストするルートや価格はありません。APIMasterは現在、kimi-k3kimi-k2.6kimi-k2.7-code を提供しています。Moonshotがオープンマーケットに公開し次第、K2.8 Previewをリストに追加します。同じAPIキーがそのままカバーします。

ソースと検証日

APIMaster.aiでKimi K3を始める

K2.8 Previewは注目すべきモデルであり、K3は今すぐ呼び出せるモデルです。APIMaster.ai では、1つのOpenAI互換キーで、Kimi K3を Kimi公式価格より25%安く、Claude、GPT、DeepSeek、Gemini、GLMルートとともにカバーできるため、K2.8 Previewが登場する前に、フラッグシップを残りのスタックとベンチマークできます。

APIMasterアカウントを作成 し、コンソール でキーを生成し、クライアントを https://apimaster.ai/v1 にポイントして、モデルを kimi-k3 に設定してください。すべてのKimiチャネルは、リストされる前にフィンガープリントチェックが行われます。