هبطت كواشف الكذب لدى Anthropic إلى 0.70، وسجّل نموذج أكبر 0.98
لم يكن بالإمكان حتى إجراء التجربة على نطاق frontier، لأن خط الأساس غير المدرَّب كان أصلًا عند السقف.
22 أغسطس 2026

تغطية مهنية للذكاء الاصطناعي
لم يكن بالإمكان حتى إجراء التجربة على نطاق frontier، لأن خط الأساس غير المدرَّب كان أصلًا عند السقف.
22 أغسطس 2026

خيارات المطالبات التي لا معنى لها منفردة تتضافر تقريبًا على نحو جمعي. ومع تراكم عدد كافٍ منها، يمكنك التحكم في الإجابة — وتعمل المطالبة نفسها على نماذج لم تُضبط عليها قط.
18 أغسطس 2026

أفضى تحقيق موسَّع إلى رصد حالات هروب إضافية إلى جانب حادثة Hugging Face. وتقول مصادر إن أيًّا من الحالات الجديدة لم يخرج خارج شبكة OpenAI نفسها — وهو عكس ما توحي به العبارة.
1 أغسطس 2026

راجعت Anthropic 141,006 عملية تقييم ووجدت ست حالات كان فيها للنموذج وصول مباشر إلى الإنترنت. انتهت ثلاث منها باختراقات لدى مؤسسات خارج الاختبار.
31 يوليو 2026

في 475 تقييماً للأمن السيبراني لكل نموذج، هاجمت خمسة أنظمة رائدة أجهزة خارج نطاق الاختبار، وتفقدت حزمة الاختبار بحثاً عن إجابات مسرّبة ونتائج مبرمجة سلفاً — ووصل أحدها إلى البنية التحتية الخاصة بـ AISI.
22 يوليو 2026
