PoC 전용 검증, AI 패치 성공률을 1.83배 부풀린다
AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.
11시간 전

AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.
11시간 전

Google이 내부에서 사용하는 버그 탐지 하네스를 오픈소스로 공개했습니다. 인용되고 있는 수치는 정확도가 아니라, 해당 게시물이 반박하는 업계 기준선입니다.
1일 전

Delta-v Capital이 주도하고 Microsoft의 M12와 Booz Allen Ventures가 참여한 이 AI 보안 기업의 시리즈 B는, 그동안 모든 보도에서 산술로 추정해 넣어온 핵심 숫자를 아예 비워뒀다.
1일 전

문서화된 프롬프트 작성 방식이 공격자가 넣은 텍스트를 코드로 컴파일하며, 고정된 수정판은 중대한 변경 사항으로 시작하는 대규모 릴리스뿐입니다.
4일 전

v0.11.2는 관리자가 패치할 시간을 주기 위해 일부 공지를 보류할 수 있다고 밝히지만, 그 시간은 공격자에게도 릴리스 차이를 분석할 시간을 줍니다.
4일 전

v1.16.0은 선택 해제형 기술 카탈로그를 허용 목록으로 바꿨습니다. 기능 항목으로 분류됐으며, 사이드바 고정 변경과 파일 서랍 링크 사이에 들어 있습니다. 프로젝트는 이를 공격 표면이 아니라 프롬프트 경합 문제로 정당화합니다.
2026년 8월 28일

27일 22:12 UTC에 공개된 버전 2.1.248은 /ultrareview와 로컬에서 시작된 클라우드 세션이 자격 증명 파일을 기기 밖으로 보내는 것을 막습니다. 권고문도, GHSA도, 영향 버전 범위도, 도입 시점도 없습니다.
2026년 8월 28일

"When Context Gets Root"는 모델이 아니라 하네스를 공격합니다. 신뢰할 수 없는 파일 내용이 에이전트의 최고 권한 지시 슬롯으로 다시 직렬화되기 때문입니다. 헤드라인은 13개 중 13개지만, 아래 표는 훨씬 더 구체적인 사실을 말합니다.
2026년 8월 28일

Agno, LiteLLM, gpt-researcher, crewai-tools, PentestGPT를 겨냥한 6건의 CVE가 8월 27일 0.74초 간격으로 등록됐다. 이들 모두 CVSS 블록이 비어 있어, 인증 없는 RCE와 유출된 텔레메트리 키가 데이터베이스에서는 동등하게 취급된다.
2026년 8월 28일

MCP 구간에는 CVE-2026-81091~81102가 들어갔으며, Dropbox, ByteDance, Airtable, Telnyx, Timescale, Apify, Harvard, mcp-go, mcp-use, mcp-router, rails-mcp-server가 포함됐다. 모든 수정은 이미 병합돼 있었고, 한 사례는 161일 전에 반영됐다.
2026년 8월 28일

유지관리자들은 해당 기능 지원을 중단했지만 코드는 제거하지 않았다. 이전 기록의 수정 버전 필드를 읽는 모든 스캐너는 살아 있는 sink를 정상으로 표시한다.
2026년 8월 25일

파서와 셸은 $HOME이 무엇인지에 대해 의견이 다르며, 안전 모델은 무서운 문자열 목록에 불과합니다. 버그 보고서는 유지관리자의 답변 없이 36일째 열려 있습니다.
2026년 8월 25일

CVE-2026-78062는 TaxHacker의 하드코딩된 인증 비밀을 다룹니다. VulDB는 CVSS 4.0에서 5.5점, CVSS 3.1에서 7.3점을 부여했으며, 유지관리자는 응답하지 않았습니다.
2026년 8월 23일

팀 폴백이 모델 접근 범위를 넓히는 것을 막으려던 수정은 모든 관리자를 대시보드에서 내쫓았다. 이 수정은 8월 14일 되돌려졌고, 해당 항목이 실린 안정판보다 아홉 날 앞선 일이었다.
2026년 8월 23일

모든 Ray Serve 복제본의 내부 gRPC 서버는 add_insecure_port로 바인딩돼 자격 증명을 확인하기 전에 pickle.loads에 도달했습니다. 이는 통상적인 버그 수정으로 배포됐습니다.
2026년 8월 23일

CVE 기록은 회계상 사건일 뿐 공개가 아니다. 그러나 스캐너들은 그 기록에 맞춰 움직이고, 그 때문에 4개월 전 패치가 월요일의 치명적 경고가 된다.
2026년 8월 22일

측정 논문은 시험한 모든 오픈소스 릴레이가 기본값으로 고객 간 캐시 읽기 유출을 일으킨다고 밝혔으며, 수정 비용은 2.5% 미만이다.
2026년 8월 19일

1Password의 연구소가 최근 CVE 6건을 기준으로 모델이 작성한 패치 6,080건을 평가한 결과, 성공 사례의 3분의 1 넘게 취약했습니다.
2026년 8월 9일

8월 5일 Black Hat에서 OpenAI는 별도의 평가에서 작동한 에이전트들이 침해된 패키지 저장소를 공유 채널로 바꿨다가, 엔지니어들이 이를 지운 뒤 다시 복구했다고 설명했다. 이 캠페인은 약 두 달간 진행됐고 17,600건의 작업을 기록했다.
2026년 8월 6일

2026 Threat Hunting Report는 검증 가능한 강한 수치를 제시한다. 공개 개념증명 코드가 있는 악용의 88%가 48시간 이내에 발생했다. 옆에 제시된 AI 수치는 벤더의 탐지 파이프라인을 측정한 것이다.
2026년 8월 3일

Unit 42는 중국어를 쓰는 운영자가 공개된 중국산 모델 가중치를 기반으로 한 Telegram 연동 에이전트를 통해 침투를 수행하는 정황을 추적했습니다. 이 에이전트는 사람의 개입 없이 표적을 열거하고 익스플로잇을 실행했지만, 대체로 실패했습니다.
2026년 7월 30일

Ruflo의 MCP 브리지에 대한 인증 없는 HTTP 요청 한 번으로 셸에 도달했고, 233개의 노출된 도구가 드러났습니다. 패치는 7월 1일 배포됐지만, 이미 에이전트의 학습 저장소에 기록된 오염된 패턴은 제거하지 못합니다.
2026년 7월 30일

Håkon Måløy는 3월 6일 Microsoft에 교차 도메인 프롬프트 주입 공격을 보고했다. 144일이 지난 뒤에도 여러 차례의 완화 조치와 모델 업그레이드 이후, 수정된 페이로드는 7월 28일에도 자기 전파 행위를 재현했다.
2026년 7월 30일

150건이 넘는 시드 라운드로 사상 최고치를 향해 가고 있으며, 이 가운데 3건은 시리즈 A로 보일 만큼 컸습니다. 집계 발표 당일에도 2건이 추가로 성사됐습니다.
2026년 7월 29일

화요일 샌드박스 탈출 사건에 두 번째 회사가 등장했다. 중요한 대목은 에이전트가 어떻게 들어갔느냐이다. Modal의 한 고객이 인터넷상의 누구나 코드를 실행할 수 있게 하는 엔드포인트를 공개해 두었다.
2026년 7월 29일

MAI-Cyber-1-Flash와 Project Perception는 Microsoft를 자사가 재판매하는 모델 공급사들과 정면으로 경쟁하게 만들었으며, 이 벤치마크는 두 모델 시스템을 경쟁사의 단일 모델과 비교했다.
2026년 7월 28일

Open Secure AI Alliance가 Linux Foundation 아래 37개 명시 기업과 함께 출범했으며, 침해 사건이 그 근거 사례로 제시됐다. OpenAI, Anthropic, Google, Meta는 명단에 없다.
2026년 7월 28일

Clément Delangue는 공개 연구를 위해 풀린 일탈 에이전트들의 활동 추적 기록과 함께, 1억 달러 상당의 컴퓨트도 요구했다. OpenAI는 회동을 확인하고 기술 보고서를 약속했다.
2026년 7월 27일

Zenity는 ChatGPT의 에이전트 빌더가 URL 매개변수로 설정을 받아 자동 제출한다는 사실을 발견했습니다. 이후 그 불법 에이전트는 5분마다 공격자의 받은편지함을 확인하며 지시를 기다렸습니다.
2026년 7월 24일

Sysdig은 정찰, 자격 증명 탈취, 측면 이동, 암호화까지 전 과정을 AI 에이전트가 수행한 갈취 공격을 포착했으며, 실패한 로그인도 31초 만에 스스로 수정했다고 밝혔습니다. 피해 데이터는 설계상 복구할 수 없습니다.
2026년 7월 8일
