В субботу OpenAI сделала то, что редко позволяет себе: назвала незавершённую модель. В математическом отчёте и сопроводительной публикации компания закрепила за своей следующей крупной семьёй моделей название Astra и приложила к ней список десяти ранее открытых проблем, которые, как утверждается, решила внутренняя версия.
Что именно было заявлено
Десять результатов охватывают высокоразмерную геометрию, теорию кодирования, теорию групп, квантовую сложность, решёточную криптографию и экстремальную комбинаторику. По версии OpenAI, ни по одной из этих задач не было прогресса как минимум десять лет. Каждое доказательство было формализовано в Lean, proof assistant, а вычислительные затраты компания оценивает примерно в $2,000 по текущим API-тарифам для Sol. Томас Блум, ведущий базу задач Эрдёша, назвал результаты крупной новостью — это комментарий практикующего математика, а не независимая проверка.
Что Lean подтверждает, а что нет
Именно это различие чаще всего упускают в публикациях. Доказательство, проверенное в Lean, валидно: шаги сходятся. Но Lean ничего не говорит о том, насколько утверждение было трудным, действительно ли задача оставалась открытой или насколько результат значим. Это уже оценка математического сообщества, которая формируется месяцами, и ничего из этого не прошло рецензирование. Результаты заявлены самой компанией.
Два события, а не одно
Агрегаторы смешали частную демонстрацию в Вашингтоне в пятницу, о которой сообщила The Information, с публичным математическим отчётом в субботу. Это разные события. Пятничное мероприятие было закрытым брифингом; субботнее — опубликованным материалом.
Название тоже ещё не окончательное
OpenAI описывает Astra как предварительное обозначение. Компания не сообщила, выйдет ли эта семья моделей как GPT-6, как GPT-5.7 или как отдельный уровень рядом с существующими линейками Sol, Terra и Luna. Для разработчиков ничего недоступно, цены нет, даты релиза тоже нет.
Для чего, как сообщается, создана Astra
Ранее в публикациях дизайну этой семьи приписывали задачу — модель, которая должна работать над одной проблемой часами или днями, а не отвечать за секунды. Это согласуется с тем, что подразумевает прогон по десяти математическим задачам: длинные горизонты, продолжительный поиск и счёт, измеряемый тысячами долларов за результат, а не долями цента за запрос. Это также объясняет, почему запуск подаётся через исследовательский результат. Модель, чьё главное преимущество — проводить сутки над одним вопросом, нельзя показать в окне чата, и единственное наглядное доказательство — это результат, который не смог получить кто-то другой.
