Anthropic 于8 月 10 日公布了一项结果:一款未发布的 Claude 研究版本在解析数论中提高了一个下界——被证明位于临界线上的黎曼 zeta 函数非平凡零点所占比例从41.6%提升至67.2%

子代理的分工

这项工作是在 Claude Code 内部由60 个子代理组成的群体完成的。Anthropic 细分了每个子代理的作用:2 个提出了关键思路,13 个贡献了支撑性思路,30 个沿着没有结果的方向推进,13 个验证了论证,2 个帮助撰写论文。整个过程消耗了3100 万个输出 token2400 条 shell 命令,持续约一天半

谁来核验

Anthropic 自己的数学家Levent AlpögeRalph Furman验证了这一论证,另有数论学者Brian ConreyDan Goldston进行外部审阅。正是这一外部环节,使其不同于通常的机器生成数学主张。

它不是什么

并不意味着朝着证明黎曼猜想取得进展,Anthropic 也直接表示了这一点:公司并不认为这些技术会导向证明。该下界的提升只是尝试解决另一问题时的副产品。二手报道还加入了一些不在 Anthropic 说明中的数字,包括“650 种解决方案路径”和“36 小时”,并将这一问题的历史说成 150 年或 160 年——而黎曼的论文发表于1859 年

有意思的是这本账

60 个代理中有 30 个失败了,这一比例也被公开了。这是首次有实验室展示研究群体内部的命中率,而不只是展示最终产出。

没人能重跑它

生成这一结果的系统尚未发布,Anthropic 也没有说明是否会推出。该结果在公司外部无法复现:外部审阅者核查的是数学本身,而不是其生成方式的说法。