APIMaster.ai
返回博客
APIMaster 博客

Kimi K2.8 Preview 与 Kimi K3:你应该选择哪一个?

Kimi K2.8 Preview 和 Kimi K3 位于不同的产品层面:K3 是公开 API 模型(kimi-k3),K2.8 Preview 是 Kimi Code 中的路由(kimi-for-coding)。对比规格、访问限制、定价以及各自的适用场景。

Kimi K2.8 PreviewKimi K3Kimi APIKimi CodeMoonshot AIAPIMaster

发布于 2026-09-17

快速结论

Kimi K2.8 Preview 和 Kimi K3 并不是同一货架上的两个选项。K3 是公开 API 模型,而 K2.8 Preview 是 Kimi Code 内部的一条路由。 在 Kimi 开放平台上,旗舰模型对应 kimi-k3;在 Kimi Code 内部,同一旗舰模型对应 k3,而 K2.8 Preview 则保留旧 ID kimi-for-coding

K2.8 Preview 是更轻量、成本更低的层级:所有 Kimi Code 会员层级均可使用,包括 1M token 窗口,Moonshot 称其整体性能接近 K3。K3 是拥有 2.8 万亿参数的旗舰模型,但需要 Moderato 及以上会员等级,其 1M 窗口需要 Allegretto 及以上会员等级。

Moonshot 未公布 K2.8 Preview 的按 token 定价,因此无法与 K3 官方 每百万输入 token $3.00、每百万输出 token $15.00 的价格进行对比。在 APIMaster 上,你可以立即使用一个兼容 OpenAI 的密钥调用 kimi-k3;K2.8 Preview 目前还不是公开 API 模型,一旦 Moonshot 向开放市场开放,我们将立即上架。

同一模型在不同产品面上有不同的 ID

这是最容易让人困惑的地方。Kimi 运行着两个独立的产品,每个产品都有自己的模型命名方式。

产品面 是什么 Kimi K3 ID Kimi K2.8 Preview ID
Kimi 开放平台 面向任何开发者的按量付费 API kimi-k3 — 未提供
Kimi Code 与 Kimi 会员捆绑的编程服务 k3, k3-256k kimi-for-coding

Kimi Code 目前暴露了来自三个模型的四个模型 ID:k3k3-256k(K3 的 1M 和 262,144 token 变体)、kimi-for-coding(K2.8 Preview)以及 kimi-for-coding-highspeed(K2.7 Code HighSpeed)。

两个实际后果:

  • 不要向 API 发送 kimi-k2.8 该标识符在任何地方都不存在。在 Kimi 开放平台上,当前唯一的 Kimi 模型是 kimi-k3kimi-k2.7-codekimi-k2.7-code-highspeedkimi-k2.6
  • 网关中列出的旧 Kimi 名称不会自动变成 K2.8。 Kimi 开放平台已于 2026 年 5 月停用 kimi-k2 系列,并于 2026 年 8 月停用 kimi-k2.5moonshot-v1 系列。这些 ID 目前均不会解析到 K2.8 Preview。

每个模型的官方定位

Kimi K3 是 Moonshot 最强大的模型。Kimi 的模型列表将其描述为专为“软件工程、知识工作和深度推理等前沿智能场景”而设计,基于 2.8 万亿参数构建,具备原生视觉理解和 1,048,576 token 的上下文窗口。我们在 Kimi K3 发布指南中详细介绍了其 API 接口、工具调用和运营限制。

Kimi K2.8 Preview 定位为日常开发而非前沿工作。Kimi 的发布说明称,它提升了编码和智能体能力,思考效率明显优于 K2.7 Code,适用于代码补全和日常开发任务。它于 2026 年 9 月 11 日在 Kimi Code 内全面上线——模型 ID 未变,因此现有的 kimi-for-coding 配置无需修改客户端即可自动使用。我们的 Kimi K2.8 Preview 指南介绍了如何将 Kimi Code 连接到第三方密钥。

两者之间的关系是经过设计的:K2.8 Preview 是默认工作模型,K3 是升级路径。

规格对比

以下均为 Kimi 官方发布的 Kimi Code 规格,目前两个模型在该产品中并存。

Kimi K2.8 Preview Kimi K3
模型 ID kimi-for-coding k3 / k3-256k
参数数量 未公布 2.8 万亿
上下文窗口 1,048,576 tokens 1,048,576 tokens(k3)/ 262,144(k3-256k
推理强度 low / high / max,默认 max low / high / max,默认 high
多模态输入 图片和视频 图片和视频(k3)/ 仅图片(k3-256k
谁可以调用 所有会员层级 Moderato 及以上;1M 窗口需要 Allegretto 及以上
相对消耗 标准 k3(1M)的消耗约为 k3-256k 的两倍
公开 API 价格 未公布 每 1M tokens:$0.30 缓存输入 / $3.00 输入 / $15.00 输出

有一条路由规则值得牢记,因为它会静默改变实际服务你请求的模型:在 Kimi Code 内部,关闭思考会将 K3 和 K2.8 Preview 的请求都路由到不带思考的 K2.8 Preview。 因此,你配置为 K3 的请求可能由 K2.8 来回答。这是 Kimi Code 的行为;不要假设同样的规则适用于开放平台或第三方网关。

Moonshot 未公布的信息

有三个信息缺口值得明确说明,因为大多数对比内容都会用猜测来填补:

  • 参数数量。 Kimi 公布了 K3 的 2.8T 参数。K2.8 Preview 没有公布参数数量。
  • 基准测试。 K2.8 Preview 的公告未发布任何分数,也没有可复现的 K2.8 与 K3 对比评估。“接近 K3”是 Moonshot 自己的评估,而非独立测量——包括我们自己的评估。
  • 价格。 见下一节。

定价:K3 有数字,K2.8 Preview 没有

Kimi 的价格表列出了四个模型。K2.8 Preview 不在其中。

模型 输入(缓存命中) 输入(缓存未命中) 输出 上下文
kimi-k3 $0.30/M $3.00/M $15.00/M 1,048,576
kimi-k2.7-code $0.19/M $0.95/M $4.00/M 262,144
kimi-k2.7-code-highspeed $0.38/M $1.90/M $8.00/M 262,144
kimi-k2.6 $0.16/M $0.95/M $4.00/M 262,144
Kimi K2.8 Preview

K2.8 Preview 作为 Kimi Code 会员的一部分销售,而非按 token 计费。Kimi Code 与 Kimi 会员共享同一配额:配额每 7 天刷新一次,另有滚动 5 小时窗口,配额用尽后由额外用量余额接管。Kimi 仅将额外用量费率描述为“接近 Kimi 开放平台的官方 API 价格,以平台显示为准”——并未公布 K2.8 Preview 的费率。

因此,诚实的对比不是“K2.8 比 K3 便宜 X”,而是“K2.8 按订阅计费,K3 按 token 计费”。话虽如此,三个已公布的事实表明 K2.8 Preview 在成本上低于 K3:

  1. 所有 Kimi Code 层级都可以调用 K2.8 Preview,而 K3 需要 Moderato 及以上。
  2. K2.8 Preview 定位为补全和日常开发,而非前沿工作。
  3. 其在开放平台上最接近的已公布同类模型 kimi-k2.7-code 定价为每百万 token 输入 $0.95 / 输出 $4.00——约为 K3 输入价格的三分之一、输出价格的四分之一。

APIMaster 上 K2.8 Preview 的路由价格是预留位。 我们尚未公布 K2.8 的价格或确认可用性。当 Moonshot 向公开 API 开放该模型且我们上架路由后,价格将显示在此处,届时你可以在同一市场中与 K3 逐项对比。

路由 输入 输出
APIMaster 上的 Kimi K3(当前) $2.25/M — 比 Kimi 官方 $3.00/M 低 25% $11.25/M — 比 Kimi 官方 $15.00/M 低 25%
APIMaster 上的 Kimi K2.8 Preview 预留 — 随路由发布时公布 预留 — 随路由发布时公布

路由价格和渠道供应会变化。在迁移生产流量之前,请查看市场中的实时卡片。

两个模型属于同一系列,因此如果你仍在 Kimi 与其他前沿路由之间做选择,Kimi API 页面对比了单个密钥在 Kimi、Claude、GPT 和 DeepSeek 之间的覆盖范围。

实际使用中的影响

除了规格表之外,还有四个运营细节决定了日常使用体验的差异。

缓存失效。 更改模型或更改推理强度会使上下文缓存失效,因此下一个请求会重新预填充对话并产生更高成本。Kimi 建议开启新会话,而不是在长会话中来回切换。如果你计划在同一任务上对比 K2.8 和 K3,请为每个模型的首次高成本请求做好预算。

权限错误看起来像认证错误。 超出套餐限制的请求返回 401,而不是配额提示消息。在 Moderato 以下调用 k3、在 Moderato 上请求 1M 窗口、或在 Allegretto 以下调用 kimi-for-coding-highspeed,都会显示为 401。如果你的密钥对一个模型有效但对另一个模型失败,请先检查套餐再轮换密钥。

不同产品面的 ID 不同。 k3 配置仅在 Kimi Code 内部有效。在开放平台上,同一模型是 kimi-k3。从你实际调用的产品面复制 ID,并在保存任何基准测试时同时记录提供商、端点和模型 ID。

验证,不要假设。 模型自称的身份并不能证明实际服务请求的是哪个模型。这一点在这里比平时更重要,因为关闭 K3 的思考会合法地将请求交给 K2.8 Preview——如果你没有预料到,这个路由结果看起来就像降级。

如何选择

  • 代码补全、小型重构和日常开发:选择 K2.8 Preview。它在所有层级上可用,支持完整的 1M 窗口,且是更便宜的路径。
  • 仓库级变更、长时智能体运行、深度推理和知识工作:选择 K3。其 2.8T 参数旗舰层级和 1M 上下文是支付更高价格的理由。
  • 你需要公开 API、SDK 兼容性或可预测的按 token 计费:现在选择 K3,因为 K2.8 Preview 没有公开 API ID。
  • 你希望在 Kimi Code 内获得最高吞吐量:以上两者都不是——kimi-for-coding-highspeed 提供约 6 倍输出速度、3 倍消耗,编码能力与 K2.7 Code 相同。

社区在讨论什么

这两个模型的公开讨论程度差异很大,这本身就是一个有用的信号。

自 2026 年 7 月以来,K3 一直受到大量讨论。在 Hacker News 上,“Kimi K3: Open Frontier Intelligence”获得了 2,107 分和 1,214 条评论,“Kimi-K3 on HuggingFace”获得 1,382 分,“Kimi K3 Is Competitive with Fable”获得 877 分,“Moonshot AI suspends new subscriptions due to Kimi K3 demand”获得 284 分——最后一条提醒我们,容量而非仅仅是质量,塑造了 Moonshot 销售其模型的方式。架构笔记、技术报告和本地推理实验(在 29 GB RAM 中运行 K3)都吸引了大量讨论。

K2.8 Preview 几乎没有英文报道:在 Hacker News 上搜索“Kimi K2.8”和“Moonshot K2.8”完全没有返回任何帖子或评论,主流第三方网关也未列出该模型。讨论集中在中文开发者渠道,这与目前仅在订阅产品内提供的模型一致。将社区对 K3 的热情视为兴趣的证据,而非 K2.8 与 K3 质量对比的结论。

FAQ

Kimi K2.8 Preview 的模型 ID 是什么?

在 Kimi Code 内部是 kimi-for-coding。底层模型升级时 ID 未变,因此现有配置可以继续使用。Kimi 开放平台不提供 K2.8 Preview,因此目前还没有公开 API 模型 ID。

Kimi K2.8 Preview 比 Kimi K3 更好吗?

Moonshot 称 K2.8 Preview 接近 K3,思考效率优于 K2.7 Code,但未发布任何基准测试分数。K3 仍然是 2.8T 参数的旗舰模型。要获得真实答案,请在两个模型上运行你自己的任务——一个失败的测试、一个多文件变更、一个长文档问题——并比较正确性、完成时间和成本。

我可以从 API 调用 Kimi K3 吗?

可以。K3 是 Kimi 开放平台上的公开模型,ID 为 kimi-k3,也可在 APIMaster 上通过兼容 OpenAI 的端点使用。K2.8 Preview 才是不能作为公开 API 模型调用的那个。

为什么 Kimi Code 的 ID 是 k3 而 API 的 ID 是 kimi-k3

它们是两个产品,采用两套命名方案。Kimi Code 的四个 ID 是 k3k3-256kkimi-for-codingkimi-for-coding-highspeed;开放平台当前的 ID 是 kimi-k3kimi-k2.7-codekimi-k2.7-code-highspeedkimi-k2.6。始终从你正在调用的产品面复制 ID。

关闭思考会让我获得 Kimi K2.8 Preview 吗?

在 Kimi Code 内部,是的:配置为 K3 或 K2.8 Preview 且关闭思考的请求都由不带思考的 K2.8 Preview 服务。不要将此规则推广到开放平台或第三方网关,除非你已查看该提供商的文档。

Kimi K2.8 Preview 在 APIMaster 上可用吗?

目前不可用。K2.8 Preview 不是公开 API 模型,因此没有可上架的路由或价格。APIMaster 目前提供 kimi-k3kimi-k2.6kimi-k2.7-code。一旦 Moonshot 向开放市场开放 K2.8 Preview,我们将立即上架,届时同一个 API 密钥即可覆盖它。

来源与核验日期

从 APIMaster.ai 上的 Kimi K3 开始

K2.8 Preview 是值得关注的模型;K3 是现在就可以调用的模型。在 APIMaster.ai 上,一个兼容 OpenAI 的密钥即可覆盖 Kimi K3,价格比 Kimi 官方价格低 25%,同时还有 Claude、GPT、DeepSeek、Gemini 和 GLM 路由,让你在 K2.8 Preview 上线之前就能将旗舰模型与你技术栈中的其他模型进行基准对比。

创建 APIMaster 账户,在控制台中生成密钥,将客户端指向 https://apimaster.ai/v1 并将模型设置为 kimi-k3。每个 Kimi 渠道在上架前都经过指纹验证。