2026-07-17-星期五 · KimiK3 · 月之暗面

收录于 第 34 期(2026-07-17) · 本期共 11 条

❯ 月之暗面发布 Kimi K3:2.8 万亿参数,登顶前端代码竞技场

最大开源模型月之暗面(Moonshot AI)7 月 16 日发布 Kimi K3,2.8 万亿参数、100 万 token 上下文,在前端代码竞技场(Frontend Code Arena)拿下 1679 分登顶,压过 Claude Fable 5 和 GPT-5.6 Sol,权重定于 7 月 27 日前开源。这是迄今参数规模最大的开源权重模型,官方对标口径是 Opus 4.8 和 GPT-5.5。模型当天已在网页端和 API 上线,原生支持文本、图像、视频输入,思考模式默认常开。

稀疏度与定价架构上 K3 走的是极端稀疏路线:896 个专家每次只激活 16 个,约 1.8% 的激活率,配合自研的 Kimi Delta Attention 与 LatentMoE。此前的开源旗舰普遍在千亿参数量级打转,K3 把总参数堆到 2.8 万亿的同时把激活率压到 2% 以下。据 VentureBeat 报道,GPQA Diamond 93.5%、BrowseComp 91.2% 均为发布时的最强公开成绩;Terminal-Bench 2.1 拿到 88.3 分,仍略低于 GPT-5.6 Sol 的 88.8。在覆盖 44 个职业的 GDPval-AA v2 上,K3 得 1687 分排第三,落在 Fable 5 Max(1815)和 GPT-5.6 Sol Max(1747.8)之后,高于 Opus 4.8 的 1600。真正扎人的是价格:据公开定价,每百万输入 token 3 美元、输出 15 美元,卡在 Sonnet 5 的档位上。

每美元智能把分数和价格放进同一张图,故事就变了。研究者 nrehiew_ 测完给出的判断是,K3 的每单位智能成本平均略低于 GPT-5.6 Sol 划出的帕累托前沿,优于 Opus 甚至 Fable。K3 没在任何单项上拿第一,却在”同样的钱能买到多少智能”这条线上挤进最前排。约束也实在:模型聚合平台 OpenRouter 上 K3 目前只跑到每秒 26 个 token,约为 Opus 的一半,看上去还没上投机解码。对正在给产品选底座的团队,K3 把”开源只能当降级备胎”这个默认前提拆了——中间那档预算里,闭源的溢价第一次需要单独解释。

signal: K3 卖的不是榜首,是每美元能买到的智能——这条线被压低一次,整个中间档的定价就得重排。