Kimi K2.8 Preview:把百万上下文带入日常开发
Kimi K2.8 Preview 带来百万上下文、三档思考强度,沿用 kimi-for-coding 模型 ID。了解它与 K3 的区别,以及通过 APIMaster 使用 Kimi Code 的方法。
发布于 2026-09-13
Kimi K2.8 Preview 于 2026 年 9 月 11 日在 Kimi Code 全量上线。 月之暗面表示,其综合性能接近 K3,编程与智能体能力较 K2.7 Code 进一步提升。它支持 1,048,576 token 上下文、图片与视频输入,以及 low / high / max 三档思考强度。所有 Kimi Code 会员档位均可使用百万上下文,模型 ID 仍为 kimi-for-coding。
我们在 APIMaster.ai 更关注这次更新对日常开发的意义:能放入更多项目资料,也能按任务难度调节思考强度。下面一起看清 K2.8 的变化,并了解如何将 Kimi Code 接入 APIMaster。截至 9 月 13 日核查,APIMaster 的公开定价目录列出了 kimi-k3、kimi-k2.6 和 kimi-k2.7-code,尚未明确列出 K2.8 Preview。 当前可用模型请以模型广场为准。
Kimi K2.8 Preview 更新了什么?
K2.8 Preview 升级了 Kimi Code 现有的 kimi-for-coding 路由。已经通过 Kimi Code 调用该 ID 的用户无需重命名其模型配置。官方发布说明称,相比 K2.7 Code,其编程、智能体能力和思考效率均有所提升。
最大的权限变化是上下文窗口:K2.8 Preview 的百万上下文对所有 Kimi Code 会员档位开放,而 K3 的百万上下文仍需 Allegretto 及以上会员。量子位 9 月 12 日的报道还提到,Kimi Work 也已上线 K2.8 Preview;本文的技术配置以 Kimi Code 官方文档为依据。
这仍然是预览版本。公告未附新的基准测试分数或可复现的 K2.8 与 K3 对比方案,因此“接近 K3”是月之暗面的官方描述,不能当作 APIMaster 的独立实测结论。
Kimi K2.8 Preview 与 K3:对开发者而言有何变化?
以下对比专门针对 Kimi Code 官方服务,依据其模型配置文档。
| 特性 | K2.8 Preview | Kimi Code 中的 K3 |
|---|---|---|
| 模型 ID | kimi-for-coding |
k3 或 k3-256k |
| 定位 | 代码补全与日常开发;性能被描述为接近 K3 | 面向高要求工作的旗舰编程模型 |
| 上下文 | 1,048,576 个 token | k3 为 1,048,576;k3-256k 为 262,144 |
| 会员权限 | 所有档位,包括 100 万窗口 | Moderato 或更高;100 万需 Allegretto 或更高 |
| 推理强度 | low、high、max;默认 max |
low、high、max;默认 high |
| 视觉输入 | 图像与视频 | k3 支持图像与视频;k3-256k 仅支持图像 |
Kimi Code 还保留了 kimi-for-coding-highspeed,其文档将其标识为 K2.7 Code HighSpeed。这是一条独立路由,并非 K2.8 的高速版本。
对团队而言,更有用的比较是每个已完成任务的成本:模型能否修复问题、通过测试并在可接受的时间内完成?可以先在有限范围的改动和代码补全上评估 K2.8,再用 K3 对比更复杂的仓库级工作。仅凭预览公告无法确定哪个模型在你的代码库上更胜一筹。
100 万上下文窗口能带来哪些可能?
更大的窗口可以同时容纳更多源文件、规格说明、测试输出和对话历史。当一项改动跨越多个包,或编程助手需要将实现细节与长篇设计文档交叉参照时,这非常有用。
它还支持视觉工作流:截图有助于说明 UI 缺陷,而视频输入可为录制的交互提供上下文。实际的附件格式和限制取决于客户端和路由。
100 万是上下文上限,并不承诺完美记忆、无限用量或 100 万输出 token。 相关上下文仍然重要。我们建议从任务所需的文件开始,仅在有助于任务时再添加更多内容,并随着会话增长衡量 token 用量和完成质量。
推理强度与模型路由如何工作?
K2.8 Preview 在 Kimi Code 中支持三档推理等级:
low: 适用于窄范围编辑和简单问题的实用起点。high: 可用于评估调试和涉及多项约束的改动。max: K2.8 的默认档位;在困难推理任务上值得与其额外耗时和 token 用量进行对比。
这些是评估建议,并非实测的速度或质量保证。Kimi Code 文档还建议在切换模型时开启新对话,因为切换会使现有上下文缓存失效。
有一个重要的路由细节:在 Kimi Code 中,对 K3 或 K2.8 Preview 关闭思考都会将请求路由到不带思考的 K2.8 Preview。 因此,一个配置为 K3 的请求在此文档所述条件下可能由 K2.8 提供服务。
在比较模型时,请记录提供商、端点、模型 ID、思考设置和测试日期。返回的模型名称或模型对自身身份的声明,不足以证明是哪个模型服务了该请求。此 Kimi Code 路由规则并不自动适用于 Moonshot 的通用 API 或每一个第三方网关。
Kimi K2.8 Preview API 价格是多少?
本文查阅的两个 Kimi Code 官方页面说明了使用权限和模型能力,但未公布独立的 K2.8 Preview 输入、输出 token 价表。会员套餐权益与按量付费 API 定价需要分开看。 百万上下文也不等于可以无限免费调用。
Kimi Code 的官方模型 ID 是 kimi-for-coding;显示名称“K2.8 Preview”不能替代 API ID。不要假设某个网关接受该 ID,也不要假设某个旧的 Kimi 列表已自动变为 K2.8。
在 APIMaster 接入时,请使用模型广场展示的准确 ID 和实时渠道价格,并结合账户费率、可用额度和用量记录估算成本。目前本文没有可确认的 APIMaster K2.8 上架信息或报价。
如何在 Kimi Code 中使用 APIMaster.ai?
Kimi Code 是一个编程客户端,也可以使用第三方提供商。 你现在就可以将其接入 APIMaster,并选择你的 API key 可用的模型,无需依赖 Kimi Code 模型订阅。
- 创建 APIMaster 账户,查看模型市场,并按需充值。
- 在 APIMaster 控制台生成 API key。
- 启动 Kimi Code,输入
/provider,然后选择 Custom registry (api.json)。 - 输入
https://apimaster.ai/kimi/registry.json作为注册表 URL,并将你的 APIMaster API key 作为 Bearer token。 - 从 apimaster 提供商标签页中选择一个模型,并发送一个小型编程任务。在扩大规模前,先在控制台中检查结果和用量。

来自我们 Kimi Code CLI 指南的提供商设置截图,使用 0.31.1 版本截取。它展示的是连接工作流,而非 K2.8 的可用性。
你也可以在本地环境中设置 APIMASTER_API_KEY 后,从终端导入注册表:
kimi provider add https://apimaster.ai/kimi/registry.json --api-key "$APIMASTER_API_KEY"
注册表会根据你的 key 权限列出兼容编程的模型。如果未明确列出 K2.8,请选择一个当前受支持的模型,而不是自行编造 K2.8 模型 ID。完整操作步骤请参阅我们的 Kimi Code 设置指南,现有 Kimi 选项请参阅 Kimi K3 介绍。
为什么通过 APIMaster 评估你的编程模型?
我们将模型选择、实时路由定价、API key 和用量追踪集中在一处。你可以通过统一的 API 集成,将可用的 Kimi 模型与其他模型系列进行比较,然后在受支持的编程客户端中使用同一账户。
可以从一个小型、可重复的任务开始:修复一个能用测试复现的 bug、为函数补充测试,或按照明确需求修改多个文件。比较结果是否正确、完成耗时、工具调用表现和总费用。我们的 API Key 测试工具可以帮助检查连通性;请求成功本身不能证明模型身份或百万上下文支持。
FAQ
什么是 Kimi K2.8 Preview?
这是 Moonshot 于 2026 年 9 月 11 日发布的 Kimi Code 模型更新,定位于日常编程和智能体任务。它支持 100 万上下文、图像、视频和三档推理等级。Moonshot 称其整体性能接近 K3,但在此公告中未发布新的基准测试分数。
K2.8 Preview 应使用哪个模型 ID?
在 Kimi Code 官方服务中,请使用 kimi-for-coding。底层模型升级时该 ID 保持不变。在 APIMaster 或其他网关上,请从该提供商当前的模型列表中复制准确的 ID。
100 万上下文是否对所有 Kimi Code 会员开放?
是的,根据 Kimi 文档,K2.8 Preview 对所有会员开放。这是受服务配额约束的最大上下文权益,并非无限免费 API 用量。K3 的 100 万选项仍需 Allegretto 或更高档位。
禁用 K3 思考是否会选择 K2.8 Preview?
是的,在 Kimi Code 内:禁用思考的 K3 和 K2.8 请求都会由不带思考的 K2.8 Preview 提供服务。在未查阅其他端点文档前,请勿将此规则推广到其他端点。
K2.8 Preview 是否已在 APIMaster 上可用?
截至 2026 年 9 月 13 日,公开目录中尚未明确列出 K2.8 Preview,已列出的 Kimi 模型包括 kimi-k3、kimi-k2.6 和 kimi-k2.7-code。请查看模型广场的最新信息;不能仅凭旧模型名称判断它已升级为 K2.8。
我现在可以在 Kimi Code 中使用 APIMaster 吗?
可以。使用 APIMaster API key 导入 https://apimaster.ai/kimi/registry.json,并选择一个该 key 可用的模型。第三方 API 用量通过 APIMaster 计费,而非通过 Kimi Code 会员权益。
来源与核查日期
- Kimi Code:9 月 11 日发布说明。
- Kimi Code:模型规格、推理与路由。
- QbitAI,2026 年 9 月 12 日:“Kimi突发K2.8:性能逼近K3,百万上下文全员开放”。用于报道的 Kimi Work 上线信息;技术性说法已对照上述官方页面核查。
- APIMaster 公开定价目录,核查于 2026 年 9 月 13 日。可用性可能在发布后发生变化。
来 APIMaster.ai 开始你的编程任务
K2.8 Preview 让百万上下文更接近日常开发。带着你的真实项目来 APIMaster.ai,比较当前可用的模型和渠道,把选好的模型接入 Kimi Code。立即注册 APIMaster,创建 API Key,从第一个编程任务开始。