2026-09-16-星期三 · Anthropic · Claude

收录于 第 93 期(2026-09-16) · 本期共 11 条

❯ Claude Opus 5.2被曝灰度测试,内部研发模型数字尚待证实

用户观察新智元报道称,部分开发者在Claude Code中发现疑似Opus 5.2路由,感受到响应加快、输出更简洁、长任务自主迭代更多。截至核验,Anthropic新闻页未见该版本正式公告,现阶段应按灰度测试传闻处理。

探针局限报道提到,用不联网回答Tibo身份的方式辨别模型。但答案不同还可能来自上下文、系统设置或采样,知识问答不能认证版本。是否跳过5.1、何时普遍开放,以及Claude Fable 5.2最快本月底或下月底推出,均尚未官宣。

内部爆料同篇文章援引所谓内部报告,称Model 2在CoBench v2得分62.8%,并已承担公司大量代码工作;又称递归自我改进模型可承担85%研究工作、比Model 2高22分。目前未取得可独立核验的原始报告、测试协议与对应完整成绩。

能力边界这些数字不能作为已实现的人员替代比例,更不能仅由写代码和多轮自检推断递归自我改进已经成立。对使用者,可先记录任务完成率与人工返工,把可重复的体验改进和内部模型传闻分开,等待正式版本与公开评测确认。

▪ SIGNAL路由变化、长任务改善与自动化AI研发是三层不同证据,当前爆料还不足以把它们连成已验证的能力跃迁。