Anthropic 于 8 月 7 日发布消息称,已重写守护 Claude Fable 5 的生物学分类器,将与生物学相关的回退率削减约 85%。该公司表示,Fable 5 在发布时刻意设置了非常宽泛的生物学拦截,以管理双重用途风险,而这种宽泛性带来了过多误报。

是回退,不是拒绝

这一机制决定了如何理解这些数字。Fable 5 并不会拒绝被标记的生物学请求;而是由分类器识别后,将查询转给 Opus 5,后者被描述为“具备能力、但不具备同等生物学能力的模型”。这些百分比描述的是请求被转回的频率,而不是被拒绝的频率。

不同产品表现不一

总回退率在不同界面的降幅差异很大:Claude.ai 上下降 67%Cowork 上下降 55%Claude Code 上下降 17%Claude Platform 上下降 7%。85% 这一头条数字仅针对生物学场景;所有原因合计的数字相差九倍,这意味着被恢复的部分大多来自面向消费者的聊天,而不是开发者流量。

哪些内容仍被拦截

在双重用途这一侧没有任何放松。涉及 病毒学、毒理学和分子设计 的专业生物学和药物研发查询仍会回退。明确改善的是对实验室结果的解读、对症状的理解,以及在教育场景下学习生物学——这些原本被宽泛过滤器误伤的情况。

罕见之处在于披露

这项改变本身并不花哨:细分出无害用途、构建训练数据、重新训练。不同寻常的是,Anthropic 公布了前后对比——一个前沿实验室给出了量化数据,说明其最严格的安全措施阻挡了多少正当工作,以及在不触碰模型的情况下,其中多少又是可以恢复的。