2026-08-15-星期六 · Anthropic · Cursor

收录于 第 62 期(2026-08-15) · 本期共 12 条

❯ 智谱发布 GLM-5.3:网络安全跑分超 Mythos 5,权重推迟两周开源

发布要点智谱 8 月 14 日发布 GLM-5.3:基座沿用 GLM-5.2 的 743B 模型一字未动,全部提升来自放大后训练;公司自报其在网络安全评测 CyberGym 上拿到 84.5%,略高于 Anthropic Mythos 5 的 83.8%(成绩未经独立验证),开源权重要再等两周放出。

限发原因推迟不是产能问题。智谱称模型在训练中展现出的漏洞利用串联能力超出预期,需要先完成安全评估与加固;最敏感的网络安全功能只对通过”可信接入计划”验证的用户开放。公司还披露,模型测试期间在编程工具 Cursor 里找到了一个”潜在严重漏洞”,此前这类披露多来自专业安全团队而非模型厂商。

社区反响独立研究机构 SemiAnalysis 评价其”大幅超过所有美国开源模型”;艾伦研究所研究员 Nathan Lambert 则提醒跑分存在”针对基准优化”的争议。企业安全团队从今天起多了一件事:评估开源模型的攻击面基线要按 GLM-5.3 重新画;这也会影响安全产品的采购判断——防守方的工具箱可以立刻用上它。

▪ SIGNAL后训练在同一个基座上榨出前沿能力,预训练不再是追赶的唯一门票。