❯ Meta 限制工程师用 Claude Code 和 Codex,怕对手输出污染自研模型训练数据
内部禁令Meta 向工程师下发内部规定,限制使用 Claude Code 和 Codex,理由是担心这两款工具的输出渗进 Meta 自研模型的训练数据,给自家代码助手 MetaCode 埋下”蒸馏”隐患。据 The Information 看到的内部文件,公司明确禁止工程师用外部 AI 输出来生成测试任务或做代码分析,并警告一旦对手模型输出泄入训练集,可能与 Anthropic、OpenAI 触发严重的合同纠纷。
蒸馏陷阱矛盾点在于:Meta 一边想用自研 MetaCode 替换昂贵的外部编码工具省钱,一边又要确保训练和评测环节绝不沾对手模型的输出。这就是被业界称为”蒸馏陷阱”的两难——越依赖前沿模型搭内部 AI 设施,越难自证能力从哪来。这并非孤例:Anthropic 前不久指控阿里实施了已知规模最大的一次蒸馏;马斯克今年 4 月也承认 xAI 的模型部分蒸馏自 OpenAI。当模型输出彼此交叉污染成为常态,“清白的训练数据”本身正变成稀缺资源。
谁要重算对每一家想自研模型、又在日常用对手工具提效的公司,Meta 的禁令是个提前量。它把一个隐性合规风险摆上台面:用 Claude、Codex 写代码很爽,但这些输出一旦混进训练或评测管线,既可能违反服务条款,又会让模型来源说不清。真正被推到前台的,是各家工程团队的工具使用边界——以后用哪款 AI 写代码,不再只看好不好用,还要看它的输出会不会顺着流水线漏进自家训练集。
signal: 省钱用对手工具和自证模型清白,这两件事第一次被摆在同一张桌子上互相打架。