أعلنت OpenAI في 10 أغسطس أنها تقسّم برنامجها الأمني Daybreak إلى فئتي Blue وRed، وستطرح GPT-5.6-Cyber، وهو نموذج مضبوط للعمل الأمني الهجومي، لعملاء فئة Red.
الفجوة بين الفئتين
تشمل Blue الاستجابة للحوادث، وتحليل البرمجيات الخبيثة، ومراجعة الشيفرة الآمنة، والتحقق من التصحيحات. وتشمل Red أبحاث الثغرات، والتحقق من الاستغلال، واختبارات الأمن — وهي الأعمال التي يرفضها نموذج عام الغرض. وفي تقييم OpenAI المسمّى Advanced Cybersecurity Completion Rate، ينجز GPT-5.6-Cyber 95.0% من الطلبات، مقابل 1.5% للنموذج العام GPT-5.6 Sol، و2.0% ضمن وصول Blue، و57.3% للنموذج GPT-5.5-Cyber من الجيل السابق.
ما الذي يمسك الخط فعلاً
لم يعد الضابط هو سلوك الرفض لدى النموذج — فقد أُزيل ذلك عمدًا. بل هو التدقيق في العملاء. ويقتصر التوزيع على شركاء موثوقين، واعتبارًا من 1 سبتمبر يجب أن يستخدم كل حساب Daybreak فردي، سواء في Blue أو Red، مفتاح أمان عتادي للمصادقة.
الأرقام مُصرّح بها ذاتيًا
تأتي معدلات الإنجاز من معيار OpenAI داخلي لا توجد له إعادة إنتاج من طرف ثالث، كما أن التقييم يقيس ما إذا كان النموذج يحاول ويُنجز المهمة، لا ما إذا كان الناتج يعمل فعلاً. أما أسماء الشركاء المتداولة في التغطيات فجاءت من تقارير صحفية لا من إعلان OpenAI.
الوصول المحدود ليس إتاحة عامة
GPT-5.6-Cyber غير متاح على واجهة API العامة. وبات شكل البرنامج — نموذج ينفذ العمل، مع قائمة معتمدة — هو القالب الذي ستُقاس عليه المختبرات الأخرى.
الحجة المؤيدة له
تقول OpenAI إن نافذة المدافع تضيق: فالمهاجمون يستخدمون النماذج بالفعل لهذا العمل، لذا فإن الامتناع عن بناء أدوات دفاعية قادرة يعني القبول بهذه اللامتماثلة. أما الاعتراض فهو أن القائمة المعتمدة أضعف من الرفض، لأنها تفشل بشكل مفتوح بمجرد اختراق الحساب — وهو على الأرجح السبب وراء شحن متطلب مفتاح الأمان العتادي بالتزامن معها.
