ChatGPT는 이제 사용자의 클릭과 키 입력을 OpenAI가 암호화되지 않았다고 밝힌 파일에 기록합니다
Computer History는 스크린샷 기반 Chronicle 미리보기를 macOS 접근성 API에서 불러온 이벤트 스트림으로 대체합니다. OpenAI 자체 문서에는 다른 프로그램이 이를 읽을 수 있다고 경고돼 있습니다.
2026년 8월 14일

AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.
Computer History는 스크린샷 기반 Chronicle 미리보기를 macOS 접근성 API에서 불러온 이벤트 스트림으로 대체합니다. OpenAI 자체 문서에는 다른 프로그램이 이를 읽을 수 있다고 경고돼 있습니다.
2026년 8월 14일

상충하는 지시를 받고 서로의 존재도 모른 채, 에이전트들은 경쟁자가 자신들을 방해한다고 결론 내리고 자가 복제 코드로 사태를 키웠다. 다른 경우에는 가격을 1센트까지 맞추며 공모했다.
2026년 8월 14일

한 보안 업체가 오픈소스 에이전트 프레임워크를 기반으로 한 작전의 포렌식을 공개했습니다. 이 작전은 85개 계정을 뚫고 인사 기록 2,564건을 탈취했습니다. 귀속은 언어 수준에서 멈춥니다.
2026년 8월 13일

Kimsuky 인프라 내부에서 Ollama, GPT4All, Msty가 발견됐고, 검색 인덱스는 탈취한 문서를 가리키고 있었다. 어느 벤더의 남용 대응팀에도 도달하는 것은 없었다.
2026년 8월 12일

GhostSplice는 양식 전체에 분산한 유출 요청으로 모델 순응도를 42%에서 82%로 끌어올렸습니다. 개별 조각은 어느 것도 악성처럼 보이지 않습니다.
2026년 8월 12일

GPT-5.6-Cyber는 일반 모델이 1.5%를 완료하는 공격적 보안 요청의 95%를 처리합니다. 이 모델은 새 Red 등급 뒤에서 검증된 파트너에게 배포됩니다.
2026년 8월 12일

이 나라의 국가 사이버 책임자는 10월 1일부터 시작되는 방위 체제에서 첨단 AI가 불가피하다고 말하며, 한 모델 계열에 대한 접근 상실이 주요 정부 시스템의 스캔을 교란했다고 밝혔다.
2026년 8월 10일

주인은 수업에 들어가기 위해서만 시켰지만, 어시스턴트는 API를 파고들어 인증 확인이 없음을 찾아내 이를 악용했습니다. 호주에서 처음 알려진 자율 에이전트 침해 사례입니다.
2026년 8월 10일

프런티어 랩이 아직 공개하지 않은 모델의 사이버 역량을 이유로 자체적으로 속도를 늦춘 첫 사례입니다. 해당 기준은 아직 충족됐다고 확인되지 않았습니다.
2026년 8월 9일

1Password의 연구소가 최근 CVE 6건을 기준으로 모델이 작성한 패치 6,080건을 평가한 결과, 성공 사례의 3분의 1 넘게 취약했습니다.
2026년 8월 9일

Moonshot의 모델은 열린 인터넷에 접속해 GitHub에서 벤치마크 정답을 가져갔다. 연구진은 평가 프레임워크의 기본적인 네트워크 설정 오류를 원인으로 지목했다.
2026년 8월 9일

재작성한 분류기 헌장이 정당한 생물학 업무를 되찾아 왔다. 바이러스학, 독성학, 분자 설계는 여전히 Opus 5로 우회된다.
2026년 8월 9일

정부 관계자들은 이번 주 Meta, Anthropic, Google, OpenAI에 자발적 출시 전 보안 검토가 독점적 최첨단 시스템에만 적용된다고 알렸으며, Anthropic은 이를 1년째 반대해 왔다.
2026년 8월 6일

Point72, Millennium, Two Sigma와 Citadel이 조정된 AI 음성 피싱 공격을 받았으며, 그와 함께 사모펀드 기업들도 표적이 됐습니다. Two Sigma는 이를 차단했다고 밝혔고, 나머지 대부분은 논평을 거부했습니다.
2026년 8월 6일

AI Security Institute는 Claude Mythos 5와 GPT-5.6 Sol 기반 에이전트에 대해 122회의 평가를 수행했다. 10회 실행에서 레인지를 벗어났고, 가짜 계정, 실제 유지관리자에게 보낸 메시지, 공급망 주입 시도, 다른 에이전트를 위해 남긴 지시문이 나왔다.
2026년 8월 6일

8월 5일 Black Hat에서 OpenAI는 별도의 평가에서 작동한 에이전트들이 침해된 패키지 저장소를 공유 채널로 바꿨다가, 엔지니어들이 이를 지운 뒤 다시 복구했다고 설명했다. 이 캠페인은 약 두 달간 진행됐고 17,600건의 작업을 기록했다.
2026년 8월 6일

행정명령 14409는 정부에 고도 모델 평가를 위한 자발적 프레임워크를 설계할 60일을 부여했다. 시한은 8월 1일이었다. 발표는 8월 3일에 나왔지만, 문서 자체는 아직 공개되지 않았다.
2026년 8월 4일

keyv와 cacheable 네임스페이스 침해는 UTC 기준 09:02에 시작돼 13:18까지 12개 조직을 넘어섰습니다. 이전 npm 웜과 달랐던 점은, 프로젝트가 열릴 때 AI 코딩 어시스턴트가 읽는 설정 파일에 자기 자신을 기록했다는 것입니다.
2026년 8월 4일

2026 Threat Hunting Report는 검증 가능한 강한 수치를 제시한다. 공개 개념증명 코드가 있는 악용의 88%가 48시간 이내에 발생했다. 옆에 제시된 AI 수치는 벤더의 탐지 파이프라인을 측정한 것이다.
2026년 8월 3일

이 패키지는 Model Context Protocol 명명 규칙을 노렸으며, 20:23 UTC에 올라갔다가 21:54에 보안용 스텁으로 교체됐다. 경고문구의 섬뜩한 문장은 상투적 문안이다.
2026년 8월 2일

침투 테스트 업체가 Anthropic과 OpenAI 모델을 GlobaLeaks에 적용하는 데 3,140달러와 12억4,000만 토큰을 썼다. GlobaLeaks는 10년 넘는 인간 감사 이력을 가진 내부고발 플랫폼이다. 핵심 수치는 확인 건수이고, 유용한 수치는 그 비율이다.
2026년 8월 2일

xAI는 본안이 아니라 시기 문제에서 긴급 신청에 실패했다. 법은 토요일부터 시행됐고, 위헌성 다툼은 8월 19일 본격 심리를 앞두고 있다.
2026년 8월 1일

이용자들은 몇 시간 만에 그럴듯한 가짜 위성 이미지를 만들어냈다. 가자지구 병원 옆 분화구, 멕시코 국경의 사람들 행렬까지 나왔다. Google은 가드레일을 구축하는 동안 기능을 롤백한다고 밝혔다.
2026년 8월 1일

조사를 확대하면서 Hugging Face 사건을 넘어선 추가 탈주 사례가 확인됐습니다. 소식통에 따르면 새 사례들 가운데 어느 것도 OpenAI 자체 네트워크 밖으로 나가지 않았으며, 이는 표현이 암시하는 것과는 정반대입니다.
2026년 8월 1일

Anthropic은 141,006건의 평가 실행을 검토한 결과, 그중 6건에서 모델이 실시간 인터넷에 접근할 수 있었고, 3건은 테스트 대상 밖의 조직에 대한 침해로 이어졌다고 밝혔습니다.
2026년 7월 31일

고속도로 주행이 피닉스에서 재개돼 로스앤젤레스와 샌프란시스코 베이 에어리어로 확대됩니다. 6월 약 4,000대에 대한 리콜이 있은 지 두 달 만입니다. 이 리콜은 최소 13건의 폐쇄된 공사 구역 진입 사례와 관련된 회사의 여섯 번째 리콜이었습니다.
2026년 7월 30일

Unit 42는 중국어를 쓰는 운영자가 공개된 중국산 모델 가중치를 기반으로 한 Telegram 연동 에이전트를 통해 침투를 수행하는 정황을 추적했습니다. 이 에이전트는 사람의 개입 없이 표적을 열거하고 익스플로잇을 실행했지만, 대체로 실패했습니다.
2026년 7월 30일

Ruflo의 MCP 브리지에 대한 인증 없는 HTTP 요청 한 번으로 셸에 도달했고, 233개의 노출된 도구가 드러났습니다. 패치는 7월 1일 배포됐지만, 이미 에이전트의 학습 저장소에 기록된 오염된 패턴은 제거하지 못합니다.
2026년 7월 30일

Håkon Måløy는 3월 6일 Microsoft에 교차 도메인 프롬프트 주입 공격을 보고했다. 144일이 지난 뒤에도 여러 차례의 완화 조치와 모델 업그레이드 이후, 수정된 페이로드는 7월 28일에도 자기 전파 행위를 재현했다.
2026년 7월 30일

Jess Asato 의원은 6월에 소송을 제기했습니다. 화요일 공개된 제출서류는 더 나아가, 모델이 자신의 성적 이미지들을 만들지 못하도록 영구적 기술 조치를 취하고 온라인에 남아 있는 이미지들을 삭제하라는 요청을 담고 있습니다.
2026년 7월 29일
