2026-06-15-星期一 · 智能体

收录于 第 4 期(2026-06-15) · 本期共 9 条

❯ Kimi K2.7-Code发布,公司称相较 K2.6 可减少 30% 推理 token 用量

模型发布Moonshot AI 发布 Kimi K2.7-Code,公司称相较 K2.6 可减少 30% 推理 token 用量,并采用修改版 MIT 许可证。重点不只是代码能力升级,而是把推理成本压到更可用的位置。

成本改进对代码模型来说,推理 token 用量直接影响延迟、账单和并发容量。Kimi K2.7-Code 选择在版本号里突出 Code,说明月之暗面继续把长上下文、代码生成和智能体任务作为重点场景;修改版 MIT 许可证则会影响企业能否在内网部署、二次开发和商用集成。此前 K2.6 已经在中文长文本和代码任务里获得开发者讨论,按公司口径,新版本若能在同等任务下少用三成推理 token,就等于把成本曲线和响应速度同时往前推。

开发者选择国内开发者和工具厂商需要重新判断代码模型选型:不只比较榜单分数,还要把单任务 token 消耗、上下文长度、许可证限制和本地化支持放在一起算。对 IDE 插件、代码审查、自动修复和多步骤智能体来说,推理过程越长,成本差距越容易放大。Kimi 如果能把“少想三成还保持质量”做实,中文代码助手市场会多一个可谈成本的强选项。

signal: 代码模型的竞争正在从“能不能写”走向“能不能以可承受成本连续完成多步任务”。