Anthropic опубликовала результат 10 августа, в котором не выпущенная исследовательская версия Claude подняла нижнюю границу в аналитической теории чисел: доля нетривиальных нулей дзета-функции Римана, для которых доказано расположение на критической прямой, выросла с 41,6% до 67,2%.
Счет подагентов
Работа шла в виде роя из 60 подагентов внутри Claude Code. Anthropic подробно описывает, что делал каждый: 2 выдвигали ключевые идеи, 13 вносили поддерживающие, 30 проверяли подходы, которые ни к чему не привели, 13 валидировали аргументы и 2 помогали писать статью. На это ушли 31 миллион выходных токенов и 2 400 команд shell примерно за полтора дня.
Кто это проверял
Аргумент валидировали собственные математики Anthropic Levent Alpöge и Ralph Furman, а также внешние рецензенты — специалисты по теории чисел Brian Conrey и Dan Goldston. Именно этот внешний этап отличает работу от обычного заявления о машинно сгенерированной математике.
Чем это не является
Это не продвижение к доказательству гипотезы Римана, и Anthropic говорит об этом прямо: компания не ожидает, что эти методы приведут к доказательству. Улучшение границы стало побочным результатом попытки решить другую задачу. В пересказах также появились цифры, которых нет в публикации Anthropic, включая «650 вариантов решения» и «36 часов», а возраст задачи иногда оценивали в 150 или 160 лет — статья Римана датируется 1859 годом.
Интересна сама ведомость
Тридцать из шестидесяти агентов потерпели неудачу, и эта пропорция опубликована. Это первый случай, когда лаборатория показала внутреннюю эффективность исследовательского роя, а не только его результат.
Повторить это никто не может
Система, которая это сгенерировала, не опубликована, и Anthropic не сообщила, будет ли ее выпускать. Результат невозможно воспроизвести за пределами компании: внешние рецензенты проверяли математику, а не утверждение о том, как она была получена.
