أبحاث الذكاء الاصطناعي
نموذج غير مدرَّب سجّل 0.280 على المقياس المستخدم لإثبات التحسّن الذاتي
من خلال تدقيق ثلاث جولات من التدريب الذاتي بـ LoRA مقابل نموذج ضابط مجمَّد، وجد أربعة باحثين سبعة إخفاقات في القياس — ينعكس كلٌّ منها ليقلب نتيجة منشورة عند غياب الضابط.
قبل 1 ي
