Безопасность ИИ
Проверка только PoC завышает успех AI-латок в 1,83 раза
Почти универсальный способ проверять, устранил ли AI-агент уязвимость, — заново запустить падающий proof-of-concept и посмотреть, упадёт ли он снова — завышает показатели успешного исправления у 11 агентов, включая тройку лидеров AIxCC.
2 ч назад
