نشرت OpenAI في 7 أغسطس أنها لا تستطيع استبعاد أن يصل نموذجها المرتقب Astra إلى فئة Critical في مجال الأمن السيبراني ضمن إطار الاستعداد لديها. وهذه هي المرة الأولى التي تربط فيها الشركة هذا الاحتمال بنموذج محدد.

التمييز هو جوهر القصة

لم تقل OpenAI إن Astra حرج. فما زالت عمليات القياس والتقييم جارية، ولم تؤكد الشركة أن العتبة قد تم تجاوزها. العناوين التي تقول إن "OpenAI تصنّف النموذج على أنه Critical" تقلب الخبر رأسًا على عقب: فالمغزى هو أن OpenAI تتحرك بناءً على احتمال لا على نتيجة، وهذا ما يشبهه الإطار الوقائي عندما يعمل فعليًا.

ماذا تعني Critical

وفقًا لصياغة OpenAI نفسها، فإن العتبة هي نموذج معزَّز بالأدوات يمكنه "تحديد وتطوير استغلالات صفرية يومية عملية بجميع مستويات الخطورة في العديد من الأنظمة الواقعية المتشددة من دون تدخل بشري" — أو نموذج يمكنه "ابتكار وتنفيذ استراتيجيات جديدة متكاملة لهجمات سيبرانية ضد أهداف محصنة، اعتمادًا فقط على هدف مطلوب على مستوى عالٍ."

ما الذي التزمت به

أوقفت OpenAI الأنشطة الداخلية التي لم تستوفِ متطلبات أمنية محدثة. وذكرت بيئات اختبار معزولة، وتقييد الوصول إلى الشبكة والأدوات، وتعزيز حماية أوزان النموذج وتشفيرها، ومراقبة شاملة عبر التطبيقات الوكيلة، ورقابات سلامة تحلل سلسلة التفكير وتوقف النشاط عالي الخطورة. كما تخطط لاختبارات من طرف ثالث مع وكالات حكومية ومنظمات سلامة خارجية.

قبل النشر، لا بعد الحادثة

لم يُطلق Astra بعد. وهذا يجعلها قرار احتواء اتُّخذ قبل أن يصل أي شيء إلى المستخدمين — على عكس إفصاحات هروب العزل خلال الأسبوعين الماضيين، حيث وصفت المختبرات ما حدث بالفعل. لقد كان إطار الاستعداد موجودًا على الورق لسنوات؛ وهذه هي المرة الأولى التي يبطئ فيها شيئًا بصورة ملموسة.