2026-06-19-星期五 · 智谱 · GLM · DeepSeek · OpenAI

收录于 第 8 期(2026-06-19) · 本期共 13 条

❯ GLM-5.2 成开源权重最强模型,智能指数 51 分列总榜第四

开源登顶据 Artificial Analysis 官方数据,智谱(Z.ai)最新发布的 GLM-5.2 在其智能指数(Intelligence Index v4.1)上拿到 51 分,成为当前最强的开源权重模型,把此前并列的 MiniMax-M3、DeepSeek V4 Pro(均 44 分)甩开 7 分。在不限开源闭源的总榜上,它排到第四。

贴着前沿排在它前面的全是闭源旗舰:Claude Fable 5(60 分)、Claude Opus 4.8(56 分)、OpenAI GPT-5.5 在 xhigh 推理档下的 55 分。与此前的 GLM-5.1 相比,GLM-5.2 总参数 744B、激活 40B 的规模并未改变,但分数提升主要来自硬骨头评测——科学推理 CritPt 涨 16 分到 21%、HLE 涨 12 分到 40%、长上下文推理 AA-LCR 涨到 71%。代价是它把单题输出推到约 4.3 万 token,用更长的思考换分数,输出价格为每百万 token 4.4 美元;上下文窗口则一举扩到 100 万 token,是上一代 20 万的五倍。

谁在追近一个 744B 的开源模型逼到总榜第四、和闭源前沿只差个位数分差,最该重新算账的是仍把”开源=能力打折”当默认假设的企业技术决策者:当可自部署的权重模型已能摸到闭源旗舰的脚后跟,把敏感数据交给闭源 API 的成本与理由都在变薄。对智谱自己,登顶开源是它港股估值叙事最硬的一块底牌。

signal: 开源与闭源的差距不再以代际计,而是以个位数的分差计——这才是闭源厂商真正要警惕的信号。