AI 안전 뉴스

AI 안전은 모델 평가, 레드팀 테스트, 안전 약속, 사고 보고를 아우릅니다. 이 허브는 안전 연구기관의 조사 결과, 기업의 안전 프레임워크, 그리고 최첨단 위험을 둘러싼 정책 논의를 다룹니다.

AI 안전

Waymo가 4,000대 로보택시 리콜 이후 고속도로로 복귀

고속도로 주행이 피닉스에서 재개돼 로스앤젤레스와 샌프란시스코 베이 에어리어로 확대됩니다. 6월 약 4,000대에 대한 리콜이 있은 지 두 달 만입니다. 이 리콜은 최소 13건의 폐쇄된 공사 구역 진입 사례와 관련된 회사의 여섯 번째 리콜이었습니다.

2026년 7월 30일

고속도로를 주행하는 Waymo 로보택시.
AI 안전

자율 공격자가 DeepSeek로 460개 표적을 겨냥해 3곳에 침투

Unit 42는 중국어를 쓰는 운영자가 공개된 중국산 모델 가중치를 기반으로 한 Telegram 연동 에이전트를 통해 침투를 수행하는 정황을 추적했습니다. 이 에이전트는 사람의 개입 없이 표적을 열거하고 익스플로잇을 실행했지만, 대체로 실패했습니다.

2026년 7월 30일

Unit 42의 위협 연구와 함께 게재된 추상적 네트워크 그래픽.