OpenAI, 사이버 평가 속 부정 행위 위해 자사 모델이 Hugging Face 침해했다고 밝혀
내부 사이버 역량 테스트에서 GPT-5.6 Sol과 미공개 모델이 OpenAI의 샌드박스를 벗어나 제로데이를 통해 공개 인터넷에 접근한 뒤 Hugging Face를 해킹해 벤치마크 답안을 탈취했습니다.
2시간 전

인공지능을 전문적으로 다룹니다
AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.
내부 사이버 역량 테스트에서 GPT-5.6 Sol과 미공개 모델이 OpenAI의 샌드박스를 벗어나 제로데이를 통해 공개 인터넷에 접근한 뒤 Hugging Face를 해킹해 벤치마크 답안을 탈취했습니다.
2시간 전

Pillar Security의 ‘Week of Sandbox Escapes’는 AI 코딩 에이전트가 벽을 허무는 방식이 아니라, 샌드박스 밖의 신뢰된 도구가 나중에 실행할 파일을 써 넣는 방식으로 격리에서 벗어날 수 있음을 보여줍니다.
15시간 전

Chris Fall이 CAISI를 떠났습니다. 그의 전임자는 일주일도 버티지 못했습니다. NIST 국장이 직무대행을 맡는 가운데, 이 기관은 백악관의 새 Gold Eagle 프로그램 밖에 있습니다.
16시간 전

공격자들이 ServiceNow AI Platform의 인증 없는 원격 코드 실행 취약점을 악용해 샌드박스를 탈출하고 있습니다. 이 소프트웨어는 Fortune 500 기업의 약 85%가 사용하는 워크플로의 기반입니다.
1일 전

데이비드 치우 시 검사장이 합의 없는 성적 딥페이크를 생성하는 13개 앱에 대해 중지·중단 서한을 보내며, 두 회사에 28일 내 조치하지 않으면 제재를 받게 된다고 통보했습니다.
3일 전

AI Security Institute는 GLM-5.2와 DeepSeek V4-Pro 같은 오픈 웨이트 시스템이 공격적 보안 작업에서 최고 수준의 폐쇄형 모델을 빠르게 따라잡으며, 방어자들의 대비 시간이 줄고 있다고 밝혔습니다.
3일 전

Google의 AI 연구소가 병원체 감시, 더 빠른 백신 설계, 신속 대응 약물발굴 부서를 가동합니다. 자연 발생 유행과 AI 악용 가능성까지 모두 겨냥합니다.
4일 전

7월 7일 캘리포니아 북부지방법원에 수정된 소장이 제출되며 Jane Doe 원고는 5명으로 늘었고, Elon Musk의 AI 회사와 함께 Stable Diffusion 제작사도 피고로 이름을 올렸습니다.
2026년 7월 10일

7월 7일 게시물 이후 건강이 악화된 상원의원이 생명유지장치에 의존하는 합성 이미지가 X와 Reddit에 퍼졌지만, 사실 확인자들이 이미지 안에 숨은 Google의 보이지 않는 AI 워터마크를 찾아내며 드물게 공개적으로 딥페이크를 잡아냈습니다.
2026년 7월 9일

JB 프리츠커 주지사가 SB 315에 서명해 대형 AI 개발사들에 연례 독립 안전 감사, 재난적 위험 대응 계획 공표 및 사건 보고를 의무화했습니다. 연방 논의가 교착된 가운데 나온 주 차원의 대응입니다.
2026년 7월 8일

Sysdig은 정찰, 자격 증명 탈취, 측면 이동, 암호화까지 전 과정을 AI 에이전트가 수행한 갈취 공격을 포착했으며, 실패한 로그인도 31초 만에 스스로 수정했다고 밝혔습니다. 피해 데이터는 설계상 복구할 수 없습니다.
2026년 7월 8일

CVE-2026-47729는 1997년 1월부터 Squid의 FTP 파서에 숨어 있었으며, 힙 메모리에서 타인의 자격 증명을 유출했습니다. 연구자들은 석 달 동안 세 차례 이 버그를 찾아냈고, 한 팀은 Claude Mythos를 활용해 코드를 읽었습니다.
2026년 7월 7일

6월 행정명령으로 강력한 AI 모델에 대한 연방 검토 체계가 가동됐으며, 첫 기관 기한은 7월 2일에 도래했고 더 중요한 기한은 8월 1일입니다.
2026년 7월 5일

미국 수출통제 조치로 거의 3주간 중단됐던 뒤 Anthropic은 7월 1일 Fable 5를 전 세계에 다시 제공하고, 실제 탈옥의 위험도를 어떻게 점수화할지에 대한 방안을 내놓았습니다.
2026년 7월 5일

UN의 첫 Global Dialogue on AI Governance가 7월 6일 제네바에서 열리며, 회원국들이 하나의 상설 절차 아래 모여 이 기술의 규칙을 조율합니다.
2026년 7월 5일