Kimi K2.7-Code 发布说明:具有增强 Token 效率的开源权重编码模型

Moonshot AI 发布了 Kimi K2.7-Code,这是一款专注于编码的智能体模型,旨在提高复杂软件工程工作流中的端到端任务完成能力。基于 Kimi K2.6 构建,新模型通过将“思考 Token”的使用量减少约 30%,显著提升了 Token 效率。

模型架构与技术规格

Kimi K2.7-Code 采用混合专家(Mixture-of-Experts, MoE)架构,以平衡高容量与推理效率。它拥有 1 万亿的总参数量,但在每个 Token 时仅激活 320 亿参数。

规格 详情
架构 Mixture-of-Experts (MoE)
总参数量 1T
激活参数量 32B
层数 61 (包括 1 个稠密层)
专家数 总计 384 个 (每个 Token 选择 8 个,1 个共享专家)
上下文长度 256K
注意力机制 MLA
激活函数 SwiGLU
视觉编码器 MoonViT (400M 参数)
词表大小 160K

性能基准测试

Kimi K2.7-Code 相比其前身 K2.6 显示出显著的改进,特别是在智能体和编码任务方面,缩小了与 GPT-5.5 和 Claude Opus 4.8 等闭源模型的差距。

编码与智能体结果

基准测试 Kimi K2.6 Kimi K2.7 Code GPT-5.5 Claude Opus 4.8
Kimi Code Bench v2 50.9 62.0 69.0 67.4
Program Bench 48.3 53.6 69.1 63.8
MLS Bench Lite 26.7 35.1 35.5 42.8
Kimi Claw 24/7 Bench 42.9 46.9 52.8 50.4
MCP Atlas 69.4 76.0 79.4 81.3
MCP Mark Verified 72.8 81.1 92.9 76.4

核心功能与能力

原生 INT4 量化

Kimi K2.7-Code 实现了与 Kimi-K2-Thinking 相同的原生 INT4 量化方法,从而在不显著损失精度的情况下实现更高效的部署。

多模态输入

该模型支持图像和视频输入,使其能够处理视觉上下文与代码。虽然通过官方 API 进行视频内容对话目前仍是一项实验性功能,但图像支持已完全集成。

强制思考与保留思考

Kimi K2.7-Code 以强制“思考”模式运行。它强制 preserve_thinking 为 True,这意味着模型在多轮交互中会保留完整的推理内容。这专门设计用于增强在复杂编码智能体场景下的性能,其中历史推理对于任务完成至关重要。

交替思考与工具使用

该模型支持交替思考与多步工具调用,允许智能体通过推理解决问题并在提供最终答案之前按顺序执行工具。

部署与使用

Kimi K2.7-Code 根据 Modified MIT License 发布。建议使用以下推理引擎进行部署:

  • vLLM
  • SGLang
  • KTransformers

技术要求:

  • transformers 版本: >=4.57.1, <5.0.0
  • 推荐 temperature: 1.0 (用于思考模式)
  • 推荐 top_p: 0.95

社区洞察与讨论

社区反馈强调了一个日益增长的趋势:开源权重模型正在达到一个性能阈值,使得在许多工作流中,顶尖闭源模型与高质量开源模型之间的差异变得微乎其微。

关于成本与性能

用户指出,虽然像 Claude Opus 这样的闭源模型明显更贵,但性能差距正在缩小。 一位用户观察到:

"I think there is some threshold after which 'best' model doesn't matter... at some point, it will just do the thing you want it to do, and then the race to the bottom will start."

关于智能体行为

一些用户报告称,K2.7-Code 相比 K2.6 在指令遵循和智能体行为方面表现出改进,特别是在自定义工具调用格式方面:

"Finally follows custom tool call format (k2.6 couldn't). It's a good indicator of instructions following and agentic behaviour."

关于许可协议

社区成员将 Modified MIT license 描述为一项合理的请求,本质上是增加了一个类似于旧版 BSD license 的条款,要求用户在产品中使用该模型时注明其来源。

Sources