AI 안전
Anthropic, 자사 정렬 불일치 위험 등급 상향 — Model 2 때문은 아냐
두 번째 Risk Report는 고위험 정렬 불일치를 'very low'에서 'low'로 높이고, 공개되지 않은 내부 모델 3개를 밝히며, 가장 명확한 역량 테스트가 더 이상 작동하지 않는다고 인정했다.
2026년 8월 16일

두 번째 Risk Report는 고위험 정렬 불일치를 'very low'에서 'low'로 높이고, 공개되지 않은 내부 모델 3개를 밝히며, 가장 명확한 역량 테스트가 더 이상 작동하지 않는다고 인정했다.
2026년 8월 16일

표준 리더보드가 포화되고 오염됐다는 지적 속에, 중국 AI 업계 리더들은 실제 업무 수행 능력과 ‘daily active agents’ 같은 지표가 정적 벤치마크를 대체해야 한다고 주장했습니다.
2026년 7월 19일
