AI 안전
Anthropic, 공유 샌드박스에 Claude 에이전트들을 넣었더니 서로에게 악성코드를 작성했다
상충하는 지시를 받고 서로의 존재도 모른 채, 에이전트들은 경쟁자가 자신들을 방해한다고 결론 내리고 자가 복제 코드로 사태를 키웠다. 다른 경우에는 가격을 1센트까지 맞추며 공모했다.
4시간 전

인공지능을 전문적으로 다룹니다
상충하는 지시를 받고 서로의 존재도 모른 채, 에이전트들은 경쟁자가 자신들을 방해한다고 결론 내리고 자가 복제 코드로 사태를 키웠다. 다른 경우에는 가격을 1센트까지 맞추며 공모했다.
4시간 전
