IA de código aberto
Uma defesa que faz modelos despojados de segurança errarem com confiança em vez de recusar
Mark Russinovich propõe envenenar o retorno da remoção de segurança: quando as proteções são arrancadas, o modelo responde a perguntas perigosas de forma incorreta.
há 2 h
