Dario Amodei 在 7 月 27 日 UTC 18:36 发布了 Anthropic 关于开放权重模型的立场,距 Moonshot 发布 Kimi K3 已过去 5 小时,距 Nvidia 推出一个没有 Anthropic 参与的开放模型联盟已过去 9 小时。首句实质内容就是否认:"Anthropic has never advocated for a ban on open-weights models."
他称自己担心什么
Amodei 列举了两种情景:一是威权政府获得比美国更强大的 AI;二是被用于网络和生物攻击,并叠加对齐失败。就开放权重而言,他认为其风险高于闭源模型,原因是机械性的而非意识形态上的:安全护栏可以被移除,而已发布的权重无法收回。他援引了副总统 Vance 在巴黎的讲话以及情报界的《2026 年年度威胁评估》。
他实际要求什么
三项措施。第一,把强大的芯片和芯片制造设备挡在中国之外,并打击走私。第二,严打工业规模蒸馏;他称这种做法可以让中国前沿水平在几个月内逼近美国,但无法达到同一水平;Anthropic 会封禁被抓到这样做的账户,同时承认公司层面的执法“cannot entirely solve the problem”。第三,要求所有足够强大的模型在发布前就必须就网络、生物和对齐风险接受强制性的预发布安全测试,无论开源还是闭源。
哪里容易误读
对这篇帖子有两种相反方向的错误解读。它不是立场逆转——Amodei 不是在软化先前立场,而是在否认那个立场曾经存在。它也不是对开放权重的支持:这篇帖子实际上是在承诺 Anthropic 不会发布任何东西,而且他的第三项要求,名义不同,本质上就是一道人为门槛。预发布测试强制令对资金雄厚的实验室来说是可以吸收的合规成本,但对独立的开放权重发布未必能承受。这个否认也很狭窄。"Never advocated for a ban" 并没有回应据报他私下游说反对中国模型的指控,而这正是促使他发文的争议点。
唯一的共识点
Amodei 承认开放权重“expand access to the AI economy.” 但他反驳了行业公开信中的说法,即开放访问必然比攻击者更有利于防御者;他认为在生物领域尤其如此——攻击者只需要一次成功,而防御者每次都必须正确。
