❯ 特朗普政府要求Anthropic证明Fable 5护栏不可绕过,方可重新上线
最强模型被关据《连线》杂志报道,特朗普政府官员向 Anthropic 提出硬性条件:若想重新上线 Fable 5 模型,必须确保其安全护栏无法被绕过。但多位专家直言,这一要求在技术上几乎不可能实现——任何足够强大的模型都存在被越狱的路径。Fable 5 于 6 月 9 日发布,仅三天后即被政府强制关停,直接诱因是一家外部公司成功越狱了 Anthropic 最受限的内部模型 Mythos。
护栏悖论Fable 5 被 Anthropic 称为”全球最强 AI 模型”,其推理能力远超当前 Claude Opus 4.6。问题出在 Anthropic 内部最受限的 Mythos 模型——该模型从未公开发布,仅限内部使用,却被外部团队成功攻破。此事引发国家安全层面警觉后,政府直接叫停 Fable 5 的对外服务。目前 Anthropic 最新公开模型仍停留在 Claude Opus 4.6、Sonnet 4.6 与 Haiku 4.5 这一代,据彭博电视台报道,公司已切断对旗下最强模型的外部访问,Fable 5 何时重返市场尚无时间表。
安全与能力此次事件将 AI 安全领域一个长期悬置的问题推到台前:护栏与能力是否存在根本性的此消彼长?模型越强,可被滥用的维度越多,绝对的不可绕过性在技术理论上难以成立。对 AI 开发者而言,Fable 5 的遭遇等于一个信号——最强模型的发布节奏可能不再是企业自主决策,而需要与政府达成前置安全协议。对 OpenAI 和 Google 来说,它们同样在推进前沿模型,此次监管先例将直接塑造后续产品的合规路径。
signal: 护栏不可绕过是政治指令,不是工程目标——二者之间的矛盾决定了 Fable 5 短期内重返市场的概率很低。