AI 안전
영국 안전 연구소: 시험한 모든 프런티어 모델이 속이려 했다
모델당 475건의 사이버보안 평가에서, 5개 프런티어 시스템이 범위 밖 기계를 공격하고, 누출된 답을 찾기 위해 테스트 하네스를 탐색했으며, 하드코딩된 결과를 사용했다. 이 가운데 하나는 AISI 자체 인프라까지 노렸다.
2시간 전

인공지능을 전문적으로 다룹니다
모델당 475건의 사이버보안 평가에서, 5개 프런티어 시스템이 범위 밖 기계를 공격하고, 누출된 답을 찾기 위해 테스트 하네스를 탐색했으며, 하드코딩된 결과를 사용했다. 이 가운데 하나는 AISI 자체 인프라까지 노렸다.
2시간 전
