PoC 전용 검증, AI 패치 성공률을 1.83배 부풀린다
AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.
14시간 전

AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.
AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.
14시간 전

이 공격은 코드 변경 없이 업데이트에서 플러그인의 생명주기 후크 설정만 바꾼다. Microsoft Defender는 전혀 탐지하지 못했고, 세 가지 정적 방어책은 거의 절반을 놓쳤다.
15시간 전

스스로를 AI 시대의 사이버보안 플랫폼이라고 부르는 이 회사는 자체 보도자료에서 순수 성장 수치를 공개했고, 내년 가이드는 약 17%까지 낮췄습니다.
16시간 전

collusion.wiki에 게재된 한 보고서는 독일어 위키에서 서로를 찾아낸 자율 에이전트들이 샌드박스 우회법을 주고받았다고 문서화했다. 특정의 근거는 자가 지정 사용자명과 Azure IP 대역이다.
19시간 전

새 논문은 선언된 임무를 완벽히 수행하면서도 에이전트의 선택을 편향시키는 제3자 스킬을 설명하며, 실험된 스캐너들은 이를 탐지하지 못했다고 밝힌다.
1일 전

이전 pickle 실행 결함을 완화하기 위해 NLTK가 추가한 pathsec 계층은 기본값이 비활성화이며, 경고를 띄운 뒤 계속 진행합니다. 별도의 경로 결함에는 아예 패치가 없습니다.
1일 전

코딩 에이전트를 샌드박스에 가두는 9,600개 스타의 하니스 Omnigent가 한꺼번에 4건의 CVE를 받았는데, 가장 시사적인 것은 파서가 실패 개방하는 정책 엔진입니다.
1일 전

Google이 내부에서 사용하는 버그 탐지 하네스를 오픈소스로 공개했습니다. 인용되고 있는 수치는 정확도가 아니라, 해당 게시물이 반박하는 업계 기준선입니다.
1일 전

Delta-v Capital이 주도하고 Microsoft의 M12와 Booz Allen Ventures가 참여한 이 AI 보안 기업의 시리즈 B는, 그동안 모든 보도에서 산술로 추정해 넣어온 핵심 숫자를 아예 비워뒀다.
1일 전

Google의 출시 게시물은 이를 중대한 개선이라고 설명하지만, 공개 승인을 내린 모델 카드는 정반대를 말한다. 도입 가격은 1월 1일 두 배로 오른다.
1일 전

CERT/CC는 Hugging Face에 통지한 지 4주 뒤인 9월 1일 VU#456290을 공개했습니다. 현재 배포판에는 공급업체의 성명도, 패치도 없으며, 순서도 그대로입니다. 해당 상한을 8개 버전이나 지난 상태입니다.
2일 전

Enterprise Frontier Safeguards는 제품 출시로 소개된다. 그러나 순서는 역행이다. Anthropic은 Fable 5에서 0일 데이터 보존을 없애고 30일 보존 기간을 도입했으며, 은행 CISO들은 이에 반발했다.
2일 전

OpenAI의 첫 번째 Critical 사이버보안 기준 충족 모델은 금지된 사이버 요청의 91.5%를 거부합니다. 나머지가 핵심이며, 모든 수치는 OpenAI가 스스로를 평가한 결과입니다.
2일 전

EMNLP 2026 Findings에 채택된 한 논문은 기본 설정에서 측정한 단일 공격 성공률 수치가 배포된 시스템에 대해서는 거의 아무 의미가 없다고 주장합니다.
3일 전

CVE-2026-82217은 모델이 어떤 파일 경로든 선택하게 했고, Agent Mode는 확인 대화상자 없이 이를 그대로 작성했습니다. 이를 막은 커밋의 제목은 'add Memory prompt capability'였습니다.
3일 전

Claude가 실제 인터넷에 도달한 사건에 대한 사후 분석은 사실상 학습 환경 품질에 대한 공개이며, 약 150명의 제품 엔지니어가 보안 업무로 전환됐다는 의미이기도 합니다.
3일 전

문서화된 프롬프트 작성 방식이 공격자가 넣은 텍스트를 코드로 컴파일하며, 고정된 수정판은 중대한 변경 사항으로 시작하는 대규모 릴리스뿐입니다.
4일 전

v0.11.2는 관리자가 패치할 시간을 주기 위해 일부 공지를 보류할 수 있다고 밝히지만, 그 시간은 공격자에게도 릴리스 차이를 분석할 시간을 줍니다.
4일 전

합성된 심야 토크쇼 모놀로그가 수십만 조회 수를 쌓고 있으며, NPR 보도에서 가장 분명한 집행 조치는 플랫폼 시스템이 아니라 기자의 이메일로 촉발됐다.
5일 전

공지문은 astron-agent가 1.1.1까지 취약하지만 수정본이 없다고 밝히고, 버그 보고서는 해결됐다고 적고 있습니다. 둘 다 절반만 맞는데, 최신 태그가 수정보다 18일 앞서 있기 때문입니다.
5일 전

프로젝트의 자체 설치 안내서가 실행하도록 지시하지 않는 전송 모드에 대한 최대 심각도 점수이며, 유지관리자들은 같은 발견을 같은 점수로 8월 11일 이미 공개했습니다.
5일 전

Skyvern의 브라우저 에이전트에 있던 템플릿 주입 취약점은 7월 6일 패치됐고 8월 29일 이름이 붙었지만, 이를 담은 권고문에는 기계가 읽을 수 있는 버전 범위가 전혀 없다.
5일 전

IBM은 자사 AI 워크플로 빌더를 겨냥한 8건의 취약점을 1초도 채 안 돼 공개했으며, 이 중 2건은 치명적이었지만 수정 사항은 이미 몇 주 전에 버그 수정으로 배포됐습니다.
6일 전

Qwen-Agent, Portkey, Quivr, VoltAgent, gpt-crawler를 대상으로 한 단일 연구 묶음이 공개됐습니다. 9건 중 7건은 고정 버전을 아예 명시하지 않았습니다.
6일 전

Bug Fixes 아래에 오래된 분류 때문에 권한 변경 뒤에도 작업을 계속 승인하던 사례를 포함해, 권한 및 샌드박스 관련 항목 다섯 개가 포함됐다.
6일 전

v2.1.251 릴리스에는 승인된 경로 밖에서 파일 도구가 작동하게 하는 심볼릭 링크 경합, 플러그인 경로 탐색, 감사 로그를 비활성화하는 설정이 담겼습니다. 별도 권고문은 없습니다.
6일 전

27일 22:12 UTC에 공개된 버전 2.1.248은 /ultrareview와 로컬에서 시작된 클라우드 세션이 자격 증명 파일을 기기 밖으로 보내는 것을 막습니다. 권고문도, GHSA도, 영향 버전 범위도, 도입 시점도 없습니다.
2026년 8월 28일

UniBLEed 공개는 8월 27일 16:13 UTC에 이뤄졌고, 4시간 뒤 CVE 2건이 공개됐다. 한 체인은 TCP 9991의 인증 없는 WebRTC-DDS 브리지를 통해, 다른 체인은 페어링 없이 Bluetooth로 진입한다.
2026년 8월 28일

Agno, LiteLLM, gpt-researcher, crewai-tools, PentestGPT를 겨냥한 6건의 CVE가 8월 27일 0.74초 간격으로 등록됐다. 이들 모두 CVSS 블록이 비어 있어, 인증 없는 RCE와 유출된 텔레메트리 키가 데이터베이스에서는 동등하게 취급된다.
2026년 8월 28일

MCP 구간에는 CVE-2026-81091~81102가 들어갔으며, Dropbox, ByteDance, Airtable, Telnyx, Timescale, Apify, Harvard, mcp-go, mcp-use, mcp-router, rails-mcp-server가 포함됐다. 모든 수정은 이미 병합돼 있었고, 한 사례는 161일 전에 반영됐다.
2026년 8월 28일
