AI 연구 뉴스

이 허브는 AI 연구의 방대한 흐름을 압축해 보여드립니다. 의미 있는 논문, 연구소 발표, 벤치마크 결과, 그리고 실제로 분야를 움직이는 방법론을 실무자 중심으로 풀어드립니다.

AI 안전

PoC 전용 검증, AI 패치 성공률을 1.83배 부풀린다

AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.

14시간 전

9월 3일자 프리프린트 첫 페이지. 제목은 'PatchBench: Evaluating AI Agents for Vulnerability Patching'이다.