AI News Today.

أخبار سلامة الذكاء الاصطناعي

تشمل سلامة الذكاء الاصطناعي تقييم النماذج، واختبارات الهجوم، والتزامات السلامة، والإبلاغ عن الحوادث. يغطي هذا القسم نتائج معاهد السلامة، وأطر السلامة لدى الشركات، والنقاش السياسي حول مخاطر النماذج المتقدمة.

سلامة الذكاء الاصطناعي

الأخطاء المطبعية وإعادة الصياغة تتراكم: باحثان وجّها النماذج الحدّية عبر إشارات غير مرئية

خيارات المطالبات التي لا معنى لها منفردة تتضافر تقريبًا على نحو جمعي. ومع تراكم عدد كافٍ منها، يمكنك التحكم في الإجابة — وتعمل المطالبة نفسها على نماذج لم تُضبط عليها قط.

18 أغسطس 2026

بطاقة معاينة على alphaXiv تعرض عنوان الورقة 'Model Hypnosis: Strong control of AI via additive subliminal effects' للباحثين Enric Boix-Adsera وBenedict Tessler، بجانب الصفحة الأولى من الورقة