9 月 11 日,Kimi K2.8 Preview 在 Kimi Code 与 Kimi Work 全量上线。官方说法是综合性能接近旗舰 K3,Coding 与 Agent 能力全面提升,思考效率较 K2.7 Code 显著改善。

变了什么

  • 支持 low / high / max 三档 reasoning effort,与 K3 的思考等级对齐
  • 支持图片与视频输入,上下文窗口为 1M
  • 所有会员档位(含免费的 Adagio)都能用上 1M 上下文,而 K3 的百万上下文此前需要 199 元档的 Allegretto 及以上
  • 本次预览更新未公布任何 benchmark 数据

流量怎么接管

在 Kimi Code 里,原有的 kimi-for-coding 会被无感知升级为 K2.8 Preview,Model ID 保持不变;K3 系列关闭 thinking 后,请求也会被转给 K2.8 的无思考版本。Kimi Work 同步上线了 K2.8 Preview。也就是说,同名的模型端点背后已经是另一个模型。

为什么现在必须推一个主力模型

这轮更新很难和商业化节奏分开看。据彭博社消息,月之暗面 ARR 从 3 月的约 1 亿美元涨到 6 月超 3 亿,8 月突破 10 亿美元,公司内部希望年底冲到 20 亿。K3 定价为每百万 token 输入 3 美元、输出 15 美元,约为对手的三分之一,但一个高成本旗舰撑不起从 10 亿到 20 亿的斜率,必须有单位成本更低、能大规模铺开的主力模型接力。同期,公司已以保密形式向港交所递交 A1 上市申请文件。

需要主动验证的两点

一是没有 benchmark,「接近 K3」接近到什么程度尚未可知;二是月之暗面在 K3 技术博客中提到,K3 对历史 thinking 内容较敏感——若 Agent 框架没有完整回传此前的思考记录,或在会话中途从其他模型切到 K3,生成质量可能明显不稳定。K2.8 接管这些请求后,同样的风险依然存在。

模型 ID 不变、后端已换,是你这次最需要主动验证的地方。