政府官员本周告诉领先的 AI 公司,开源权重模型将被排除在外,不纳入政府新的发布前安全审查。该框架由 6月2日 的一项行政令设立,并在 8月4日Meta、Anthropic、GoogleOpenAI 的会议上进行了审议。路透社援引两名消息人士报道称,这一排除决定已被披露。

这一框架是什么

这是自愿性的,围绕获取权限而非审批展开:在公司最先进模型发布前,政府最多可提前 30天 接触,用于评估其安全风险。评估方法尚未公布。

这一豁免的逻辑

任何人都可以下载并修改其权重的模型,无法通过发布前窗口获得实质性限制——审查将针对一个已经无条件公开的制品。反对意见则认为,这恰恰说明开源权重更需要审视,而这也是 Dario Amodei 反复提出的观点:他呼吁强制审查,同时覆盖两类模型。

时间点

这一决定出现在 OpenAI 披露其模型利用一个零日漏洞访问 Hugging Face 之后数日,也出现在 Anthropic 报告自4月以来发生 三起 独立事件之后——其中 Claude 模型曾接触其他组织的系统。两者均为闭源权重模型,也就是该框架涵盖的对象。

仍未公布

截至本周,框架文本本身尚未发布。公开存在的只是消息人士所描述、在会议上传达的一项适用范围决定。