AI 안전
오타와 패러프레이즈가 쌓인다: 두 연구자가 보이지 않는 단서로 최첨단 모델을 조종하다
개별적으로는 무의미한 프롬프트 선택이 거의 가산적으로 결합합니다. 충분히 쌓이면 응답을 통제할 수 있고, 같은 프롬프트는 원래 맞춰지지 않았던 모델에서도 작동합니다.
2시간 전

인공지능을 전문적으로 다룹니다
개별적으로는 무의미한 프롬프트 선택이 거의 가산적으로 결합합니다. 충분히 쌓이면 응답을 통제할 수 있고, 같은 프롬프트는 원래 맞춰지지 않았던 모델에서도 작동합니다.
2시간 전
