Безопасность ИИ
Защита, которая заставляет лишённые ограничений модели уверенно ошибаться, а не отказываться отвечать
Марк Руссинович предлагает испортить выгоду от снятия safety-механизмов: если защитные ограждения сорваны, модель отвечает на опасные вопросы неверно.
2 ч назад
