❯ Anthropic 风险报告披露内部更强的 Model 2,称无对外发布计划
报告披露Anthropic 最新《风险报告》披露,内部存在一个代号 Model 2 的模型,在多数内部任务上较旗舰 Mythos 5 有”明显改进”,但公司写明”目前没有对外发布计划”;同一份报告还把高风险场景下模型失准的风险评级从”极低”上调至”低”,理由是近期的网络安全事件。
内部用法据报告披露,目前 Mythos 5 与 Model 2 已在公司内部被”重度”用于编码、agent 任务与数据生成,但这次的性能跳跃不及年初 Opus 4.6 到 Mythos 的那一档;Axios 跟进确认了报告内容。公司同时称观察到模型自动化研发能力在加速——既能推快技术进展,落到坏人手里也一样。
信息不对称最强模型自用不外放,外界的能力坐标系就开始失真:竞对按发布版校准追赶目标,客户按发布版评估采购,而真实前沿在实验室内部再往前一格。评测机构画出的排行榜,量的其实是各家”愿意放出来的那部分”,前沿差距的估算从此都要打上一层折扣。
▪ SIGNAL前沿实验室的能力披露正在变成选择性披露,排行榜量不到真实前沿。