Исследования ИИ
Необученная модель набрала 0.280 по метрике, используемой для доказательства самоулучшения
Проверяя три раунда самообучения LoRA на фоне замороженного контрольного прогона, четыре исследователя выявили семь сбоев измерения — каждый из которых обращает опубликованный вывод вспять, если контроль отсутствует.
1 дн назад
