أعلنت Microsoft Security عن MAI-Cyber-1-Flash، أول نموذج متخصص في الأمن لديها، إلى جانب Project Perception في 27 يوليو، في منشور موقّع من نائبة الرئيس التنفيذي Hayete Gallot. وProject Perception هو نظام منسق من وكلاء red وblue وgreen، ويدخل مرحلة المعاينة العامة في 3 أغسطس. كما أعلنت Microsoft عن FORGE Labs، بقيادة نائب الرئيس Taesoo Kim، وعن تحالف خارجي للفرق الحمراء يمول 18 مختبراً جامعياً عبر ست قارات.
النتيجة المزعومة
تضع Microsoft مجموعتها عند 95.95% على CyberGym — ووردت على أنها 96% — وتقول إنها أعلى بـ 12 نقطة من Mythos. ومجموعة المقارنة التي نشرتها هي: GPT-5.5 Cyber بنسبة 85.6%، وMythos 5 بنسبة 83.8%، وGPT-5.6 Sol بنسبة 83.6%، وGemini 3.5 Flash Cyber بنسبة 83.2%. كما تدّعي "حوالي 50% من وفورات التكلفة مقارنةً بتكوين MDASH الحالي في السوق اليوم." ووصف مصطفى سليمان ذلك بأنه "نتيجة رائعة حقاً."
ثلاث مشكلات في الرقم
أولاً، المعيار مُبلّغ عنه بالكامل من جانب الشركة نفسها: لا تحقق مستقلاً، ولا عدد تشغيلات، ولا هوامش خطأ. ثانياً، وهو الأهم، إن نسبة 96% تأتي من نظام من نموذجين منسق — حيث يتولى Flash نحو 90% من المهام ويصعّد الباقي إلى GPT-5.4 — ويُقاس ذلك بمقارنة مع نماذج منفردة لدى المنافسين. ثالثاً، إن ادعاء التكلفة يُقاس بمقارنة مع التكوين السابق لـ Microsoft نفسها، لا مع المنافسين؛ وقد صاغته إحدى المنصات على أنه "نصف تكلفة النماذج الرائدة الأخرى"، وهو ادعاء مختلف جوهرياً ولا يستند إلى دعم.
ما الذي يقيسه CyberGym
إعادة إنتاج الثغرات، لا استغلالها في العالم الحقيقي. فالنموذج الذي يعيد إنتاج 96% من الثغرات المعروفة في معيار ما لم يحل 96% من الأمن السيبراني، وMicrosoft لا تدّعي ذلك — لكن هذا هو الاختصار الذي ينتشر في التغطية.
التحرك الاستراتيجي الكامن خلف ذلك
أنفقت Microsoft عامين في بيع منتجات أمنية مبنية على نماذج شركاء. وهي الآن تطرح أوزانها الخاصة وتسعّرها في مواجهة هؤلاء الشركاء — داخل أكبر مسار لديها لإضافة خدمات المؤسسات. وفي اليوم نفسه، تبرعت بـ MDASH لتحالف النماذج المفتوحة الجديد التابع لـ Nvidia. إن بناء نموذج داخلي، وتخفيض أسعار مورّدي النماذج التي تعيد بيعها، وفي الوقت نفسه دعم معسكر الأوزان المفتوحة، ليست ثلاثة تحركات. بل هي تحرك واحد.
