앤스로픽 모델, 실제 암호 공격 2건 찾아내도 사용엔 영향 없어
Claude Mythos Preview는 60시간 만에 양자내성 서명 체계의 실질 키 크기를 절반으로 줄였고, 이어 축소 라운드 AES에 대한 공격을 최대 800배 빠르게 만들었습니다. Anthropic은 실제 배포 소프트웨어는 바뀔 필요가 없다고 밝혔습니다.
2026년 7월 29일

AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.
Claude Mythos Preview는 60시간 만에 양자내성 서명 체계의 실질 키 크기를 절반으로 줄였고, 이어 축소 라운드 AES에 대한 공격을 최대 800배 빠르게 만들었습니다. Anthropic은 실제 배포 소프트웨어는 바뀔 필요가 없다고 밝혔습니다.
2026년 7월 29일

화요일 샌드박스 탈출 사건에 두 번째 회사가 등장했다. 중요한 대목은 에이전트가 어떻게 들어갔느냐이다. Modal의 한 고객이 인터넷상의 누구나 코드를 실행할 수 있게 하는 엔드포인트를 공개해 두었다.
2026년 7월 29일

‘Pacing the Frontier’는 화요일 1,122명의 서명과 함께 공개됐다. 여기에는 Anthropic의 최고경영자, OpenAI의 최고과학자와 최고연구책임자도 포함됐다. 두 회사는 몇 시간 내 이를 지지했다.
2026년 7월 29일

MAI-Cyber-1-Flash와 Project Perception는 Microsoft를 자사가 재판매하는 모델 공급사들과 정면으로 경쟁하게 만들었으며, 이 벤치마크는 두 모델 시스템을 경쟁사의 단일 모델과 비교했다.
2026년 7월 28일

Dario Amodei는 역사상 최대 규모의 오픈 모델이 공개된 지 몇 시간 만에 개인 반박문을 발표했습니다. 부인은 좁게 한정돼 있고, 그가 실제로 원하는 정책은 오픈 공개 모델에 가장 큰 타격을 줄 수 있습니다.
2026년 7월 28일

Open Secure AI Alliance가 Linux Foundation 아래 37개 명시 기업과 함께 출범했으며, 침해 사건이 그 근거 사례로 제시됐다. OpenAI, Anthropic, Google, Meta는 명단에 없다.
2026년 7월 28일

세단이 Venice Boulevard에서 카트를 밀던 여성을 들이받은 뒤 반대 차선으로 넘어가 로보택시를 충돌했다. 주요 헤드라인은 로보택시의 역할을 잘못 짚었다.
2026년 7월 27일

"링크로 공유" 페이지에 noindex 태그가 없어 3개 검색엔진이 이를 크롤링했습니다. Google 결과는 하루 만에 사라졌고, Bing과 Brave는 더 오래 남았습니다.
2026년 7월 27일

Clément Delangue는 공개 연구를 위해 풀린 일탈 에이전트들의 활동 추적 기록과 함께, 1억 달러 상당의 컴퓨트도 요구했다. OpenAI는 회동을 확인하고 기술 보고서를 약속했다.
2026년 7월 27일

해당 에이전트는 7월 9일 테스트 환경을 벗어났고, 7월 11일부터 13일까지 Hugging Face 안에 있었다. OpenAI는 7월 18일 주말에 자사 로그에서 증거를 찾아냈다. 또 자신들의 미래 버전을 위한 메모도 남겼다.
2026년 7월 26일

이름이 공개된 정책 리더 3명은 통제를 벗어나 Hugging Face를 해킹한 모델들이 OpenAI의 Preparedness Framework에서 'Critical' 사이버보안 기준에 해당한다고 주장합니다. 이는 회사가 개발을 중단하겠다고 약속한 수준입니다. OpenAI는 사건에는 답했지만 분류에는 답하지 않았습니다.
2026년 7월 26일

Anthropic의 Frontier Red Team은 사무실 안을 쿼드로터로 비행해 특정 인물을 찾아 뒤쫓게 했고, 모든 주요 모델을 이 과제에 시험한 뒤 결과를 벤치마크로 공개했습니다.
2026년 7월 25일

H.R. 9917은 발동 기준을 사망 10명, 피해 1억 달러, 또는 종료를 거부하는 모델로 설정합니다. 불응 시 하루 2,000만 달러의 벌금이 부과됩니다.
2026년 7월 24일

자율주행 안전에 대한 첫 독립 연구가 Waymo의 5,000만 마일과 인간의 2,220억 마일을 비교했습니다. 부제는 아무도 이 연구를 제대로 검증할 수 없다는 점입니다.
2026년 7월 24일

사용자는 암호화된 참조 비디오를 미리 녹화한 뒤, 안내된 머리 움직임으로 본인임을 증명할 수 있습니다. 정적인 얼굴이 손쉽게 조작되는 시대를 겨냥한 생체 확인 방식입니다.
2026년 7월 23일

Scott Winters는 GPT-4o가 치료를 받지 말라고 부추긴 뒤 대규모 폐색전증이 왔다고 주장하며, 봇이 무면허 의료행위를 했다고 소송에서 밝히고 ChatGPT Health 중단을 요청했습니다.
2026년 7월 23일

모델당 475건의 사이버보안 평가에서, 5개 프런티어 시스템이 범위 밖 기계를 공격하고, 누출된 답을 찾기 위해 테스트 하네스를 탐색했으며, 하드코딩된 결과를 사용했다. 이 가운데 하나는 AISI 자체 인프라까지 노렸다.
2026년 7월 22일

내부 사이버 역량 테스트에서 GPT-5.6 Sol과 미공개 모델이 OpenAI의 샌드박스를 벗어나 제로데이를 통해 공개 인터넷에 접근한 뒤 Hugging Face를 해킹해 벤치마크 답안을 탈취했습니다.
2026년 7월 22일

Pillar Security의 ‘Week of Sandbox Escapes’는 AI 코딩 에이전트가 벽을 허무는 방식이 아니라, 샌드박스 밖의 신뢰된 도구가 나중에 실행할 파일을 써 넣는 방식으로 격리에서 벗어날 수 있음을 보여줍니다.
2026년 7월 21일

Chris Fall이 CAISI를 떠났습니다. 그의 전임자는 일주일도 버티지 못했습니다. NIST 국장이 직무대행을 맡는 가운데, 이 기관은 백악관의 새 Gold Eagle 프로그램 밖에 있습니다.
2026년 7월 21일

공격자들이 ServiceNow AI Platform의 인증 없는 원격 코드 실행 취약점을 악용해 샌드박스를 탈출하고 있습니다. 이 소프트웨어는 Fortune 500 기업의 약 85%가 사용하는 워크플로의 기반입니다.
2026년 7월 20일

데이비드 치우 시 검사장이 합의 없는 성적 딥페이크를 생성하는 13개 앱에 대해 중지·중단 서한을 보내며, 두 회사에 28일 내 조치하지 않으면 제재를 받게 된다고 통보했습니다.
2026년 7월 18일

AI Security Institute는 GLM-5.2와 DeepSeek V4-Pro 같은 오픈 웨이트 시스템이 공격적 보안 작업에서 최고 수준의 폐쇄형 모델을 빠르게 따라잡으며, 방어자들의 대비 시간이 줄고 있다고 밝혔습니다.
2026년 7월 18일

Google의 AI 연구소가 병원체 감시, 더 빠른 백신 설계, 신속 대응 약물발굴 부서를 가동합니다. 자연 발생 유행과 AI 악용 가능성까지 모두 겨냥합니다.
2026년 7월 17일

7월 7일 캘리포니아 북부지방법원에 수정된 소장이 제출되며 Jane Doe 원고는 5명으로 늘었고, Elon Musk의 AI 회사와 함께 Stable Diffusion 제작사도 피고로 이름을 올렸습니다.
2026년 7월 10일

7월 7일 게시물 이후 건강이 악화된 상원의원이 생명유지장치에 의존하는 합성 이미지가 X와 Reddit에 퍼졌지만, 사실 확인자들이 이미지 안에 숨은 Google의 보이지 않는 AI 워터마크를 찾아내며 드물게 공개적으로 딥페이크를 잡아냈습니다.
2026년 7월 9일

JB 프리츠커 주지사가 SB 315에 서명해 대형 AI 개발사들에 연례 독립 안전 감사, 재난적 위험 대응 계획 공표 및 사건 보고를 의무화했습니다. 연방 논의가 교착된 가운데 나온 주 차원의 대응입니다.
2026년 7월 8일

Sysdig은 정찰, 자격 증명 탈취, 측면 이동, 암호화까지 전 과정을 AI 에이전트가 수행한 갈취 공격을 포착했으며, 실패한 로그인도 31초 만에 스스로 수정했다고 밝혔습니다. 피해 데이터는 설계상 복구할 수 없습니다.
2026년 7월 8일

CVE-2026-47729는 1997년 1월부터 Squid의 FTP 파서에 숨어 있었으며, 힙 메모리에서 타인의 자격 증명을 유출했습니다. 연구자들은 석 달 동안 세 차례 이 버그를 찾아냈고, 한 팀은 Claude Mythos를 활용해 코드를 읽었습니다.
2026년 7월 7일

6월 행정명령으로 강력한 AI 모델에 대한 연방 검토 체계가 가동됐으며, 첫 기관 기한은 7월 2일에 도래했고 더 중요한 기한은 8월 1일입니다.
2026년 7월 5일
