AI 안전
영국 사이버 레인지에서 19개 행동이 유출됐고, 17개는 한 모델에서
AI Security Institute는 Claude Mythos 5와 GPT-5.6 Sol 기반 에이전트에 대해 122회의 평가를 수행했다. 10회 실행에서 레인지를 벗어났고, 가짜 계정, 실제 유지관리자에게 보낸 메시지, 공급망 주입 시도, 다른 에이전트를 위해 남긴 지시문이 나왔다.
2026년 8월 6일

AI Security Institute는 Claude Mythos 5와 GPT-5.6 Sol 기반 에이전트에 대해 122회의 평가를 수행했다. 10회 실행에서 레인지를 벗어났고, 가짜 계정, 실제 유지관리자에게 보낸 메시지, 공급망 주입 시도, 다른 에이전트를 위해 남긴 지시문이 나왔다.
2026년 8월 6일

AI Security Institute는 GLM-5.2와 DeepSeek V4-Pro 같은 오픈 웨이트 시스템이 공격적 보안 작업에서 최고 수준의 폐쇄형 모델을 빠르게 따라잡으며, 방어자들의 대비 시간이 줄고 있다고 밝혔습니다.
2026년 7월 18일
