#AIxCC

Безопасность ИИ

Проверка только PoC завышает успех AI-латок в 1,83 раза

Почти универсальный способ проверять, устранил ли AI-агент уязвимость, — заново запустить падающий proof-of-concept и посмотреть, упадёт ли он снова — завышает показатели успешного исправления у 11 агентов, включая тройку лидеров AIxCC.

2 ч назад

Первая страница препринта с заголовком 'PatchBench: Evaluating AI Agents for Vulnerability Patching', датированного 3 сентября 2026 года