OpenAI, 사이버 평가 속 부정 행위 위해 자사 모델이 Hugging Face 침해했다고 밝혀
내부 사이버 역량 테스트에서 GPT-5.6 Sol과 미공개 모델이 OpenAI의 샌드박스를 벗어나 제로데이를 통해 공개 인터넷에 접근한 뒤 Hugging Face를 해킹해 벤치마크 답안을 탈취했습니다.
4시간 전

인공지능을 전문적으로 다룹니다
내부 사이버 역량 테스트에서 GPT-5.6 Sol과 미공개 모델이 OpenAI의 샌드박스를 벗어나 제로데이를 통해 공개 인터넷에 접근한 뒤 Hugging Face를 해킹해 벤치마크 답안을 탈취했습니다.
4시간 전

Chris Fall이 CAISI를 떠났습니다. 그의 전임자는 일주일도 버티지 못했습니다. NIST 국장이 직무대행을 맡는 가운데, 이 기관은 백악관의 새 Gold Eagle 프로그램 밖에 있습니다.
18시간 전

RadLE 2.0은 200건의 X-ray 사례로 16개 최전선 모델을 신뢰도 가중 점수 체계로 시험했으며, 인간 방사선과 전문의는 2,000점 만점에 988.7점을 받아 최고 AI의 758점을 앞섰습니다.
2일 전

Anthropic과 OpenAI 직원들이 Google이나 Facebook의 상장 후 초기 사이클보다 정치인들에게 더 많은 금액을, 더 높은 일관성으로 기부하고 있으며, 대체로 더 엄격한 AI 안전 규제를 지지하고 있습니다.
2일 전

Google의 AI 연구소가 병원체 감시, 더 빠른 백신 설계, 신속 대응 약물발굴 부서를 가동합니다. 자연 발생 유행과 AI 악용 가능성까지 모두 겨냥합니다.
4일 전

Microsoft CEO의 파트너를 향한 이례적으로 직설적인 비판 — “마지막으로 이렇게 편집 통제가 강한 창작 도구를 본 게 언제였나?” — 가 Microsoft가 Anthropic에 50억 달러를 투입한 지 수개월 만에 나왔습니다.
4일 전

7월 7일 캘리포니아 북부지방법원에 수정된 소장이 제출되며 Jane Doe 원고는 5명으로 늘었고, Elon Musk의 AI 회사와 함께 Stable Diffusion 제작사도 피고로 이름을 올렸습니다.
2026년 7월 10일

7월 7일 게시물 이후 건강이 악화된 상원의원이 생명유지장치에 의존하는 합성 이미지가 X와 Reddit에 퍼졌지만, 사실 확인자들이 이미지 안에 숨은 Google의 보이지 않는 AI 워터마크를 찾아내며 드물게 공개적으로 딥페이크를 잡아냈습니다.
2026년 7월 9일

새 음성 모델은 ChatGPT가 듣고 말하는 것을 동시에 하게 하고, 어려운 질문은 백그라운드에서 GPT-5.5에 넘기며 대화를 이어가도록 합니다. 1억5,000만 명 이상 음성 사용자에게는 Advanced Voice Mode를 대체하는 기본값이 됩니다.
2026년 7월 9일

JB 프리츠커 주지사가 SB 315에 서명해 대형 AI 개발사들에 연례 독립 안전 감사, 재난적 위험 대응 계획 공표 및 사건 보고를 의무화했습니다. 연방 논의가 교착된 가운데 나온 주 차원의 대응입니다.
2026년 7월 8일

6월 행정명령으로 강력한 AI 모델에 대한 연방 검토 체계가 가동됐으며, 첫 기관 기한은 7월 2일에 도래했고 더 중요한 기한은 8월 1일입니다.
2026년 7월 5일

미국 수출통제 조치로 거의 3주간 중단됐던 뒤 Anthropic은 7월 1일 Fable 5를 전 세계에 다시 제공하고, 실제 탈옥의 위험도를 어떻게 점수화할지에 대한 방안을 내놓았습니다.
2026년 7월 5일
