2026-07-18-星期六 · Anthropic · KimiK3 · 月之暗面 · 智谱 · OpenAI · ClaudeFable5

收录于 第 35 期(2026-07-18) · 本期共 9 条

❯ 月之暗面发布2.8万亿参数Kimi K3,前端代码榜超过Claude Fable 5

榜单夺魁月之暗面发布Kimi K3,以1679分登顶Arena前端代码竞技场,力压Claude Fable 5和GPT-5.6 Sol;Terminal Bench 2.1拿下88.3分,仅差GPT-5.6 Sol的88.8分半分。据VentureBeat报道,这是一个2.8万亿参数的模型,月之暗面称其为迄今全球最大的开源模型,多项基准与Anthropic、OpenAI的最强闭源系统贴身缠斗。开源权重定于7月27日放出。

追赶提速这被从业者社区普遍称作”DeepSeek 2.0时刻”。理由不只是分数:一是开源——2.8万亿参数全量放权重,任何人都能拿去蒸馏、微调;二是成本,中国模型延续了低算力、低价打法。同期另一条线索是智谱GLM-5.2在长周期网络安全评测中,追平了闭源前沿约4个月前的水平,开源与闭源的差距从2025年的6–10个月收窄到4–7个月。有开发者分别用Kimi K3和GPT-5.6重建了一版桌面操作系统界面,直呼K3那版”好得不是一个量级”。

闭源承压需要冷处理的是围绕它的传言:有单一账号推测Anthropic会很快推出Opus 5、Fable 5本周日到期,目前没有官方佐证,属未证实。但K3的分数本身已经够硬。真正被顶到台前的,是闭源大厂的定价逻辑——当一个免费开源模型能在前端代码上排到人类盲评第一,“闭源=更强所以更贵”这个默认前提就开始松动。接下来一个月要盯的具体变量,是几家闭源厂”凭什么按token收费”的底气,以及开发者会不会把前端这类任务迁去零成本的K3。

signal: 开源模型排到盲评第一那天,闭源的护城河就从”能不能做到”变成了”还能不能这么收费”。