Британский AI Security Institute (AISI) опубликовал 17 июля измерение, которое должно привлечь внимание служб безопасности: разрыв между свободно загружаемыми open-weight-моделями и лучшими closed frontier-системами в наступательных киберзадачах сократился примерно до четырех–семи месяцев с шести–десяти месяцев годом ранее.
Что показало исследование
AISI сравнил ведущие открытые модели — в частности GLM-5.2 и DeepSeek V4-Pro — с закрытыми frontier-системами и задал простой вопрос: насколько открытая экосистема отстает, если измерять это временем? Ответ таков: запас, на который раньше могли рассчитывать защитники, быстро сокращается.
Как это измеряли
В бенчмарке "Narrow Cyber Tasks" на 70 задачах по четырем уровням сложности, от уровня неэксперта до эксперта, GLM-5.2 показала результат на уровне закрытых моделей, выпущенных примерно четыре месяца назад, а DeepSeek V4-Pro — на уровне моделей примерно пятимесячной давности. AISI также проводил полноценные симуляции атак, а не только отдельные задачи.
Сквозное тестирование
В сценарии "Cyber Ranges" под названием "The Last Ones" — 32-шаговой атаке на смоделированную корпоративную сеть — GLM-5.2 показала сопоставимый результат с Claude Opus 4.5, моделью, выпущенной примерно семь месяцев назад. Построение десятков шагов в единую, согласованную атаку — самая сложная часть, и открытые модели в этом приближаются.
Дилемма открытых моделей
В практическом смысле этот лаг — это фора, которую защитники и регуляторы получают до того, как передовые наступательные возможности становятся практически неограничиваемыми. То, что он сократился примерно с десяти месяцев до четырех, обостряет вопрос политики, над которым размышляет и само правительство AISI: должны ли релизы open-weight моделей проходить через пороги возможностей, и кто должен это решать. Обе выделенные AISI модели — GLM-5.2 и DeepSeek V4-Pro — являются китайскими open-weight-системами, что добавляет геополитический оттенок: возможности, доступные как бесплатная загрузка, нельзя отгородить экспортным контролем так же, как передовые чипы.
