AI 안전 뉴스

AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.

AI 안전

PoC 전용 검증, AI 패치 성공률을 1.83배 부풀린다

AI 에이전트가 취약점을 고쳤는지 확인하는 거의 보편적 방식인 ‘충돌을 다시 실행해 여전히 충돌하는지 본다’는 절차가, AIxCC 상위 3개를 포함한 11개 에이전트의 해결률을 과대평가하는 것으로 나타났다.

14시간 전

9월 3일자 프리프린트 첫 페이지. 제목은 'PatchBench: Evaluating AI Agents for Vulnerability Patching'이다.
AI 안전

LiteLLM의 인증 없는 RCE, CVE보다 140일 먼저 패치돼

Agno, LiteLLM, gpt-researcher, crewai-tools, PentestGPT를 겨냥한 6건의 CVE가 8월 27일 0.74초 간격으로 등록됐다. 이들 모두 CVSS 블록이 비어 있어, 인증 없는 RCE와 유출된 텔레메트리 키가 데이터베이스에서는 동등하게 취급된다.

2026년 8월 28일

BerriAI/litellm의 GitHub 저장소 카드로, 프로젝트 설명과 기여자·스타·포크 수가 보인다