OpenAI's Astra تتجاوز الحد الحرج وتظل تمتثل بنسبة 8.5%
أول نموذج من OpenAI يحقق عتبة الأمن السيبراني الحرجة يرفض 91.5% من طلبات الأمن السيبراني غير المسموح بها. أما النسبة المكملة فهي لبّ القصة، وكل رقم فيها هو تقييم OpenAI لعملها بنفسها.
قبل 1 ي

تغطية مهنية للذكاء الاصطناعي
أول نموذج من OpenAI يحقق عتبة الأمن السيبراني الحرجة يرفض 91.5% من طلبات الأمن السيبراني غير المسموح بها. أما النسبة المكملة فهي لبّ القصة، وكل رقم فيها هو تقييم OpenAI لعملها بنفسها.
قبل 1 ي

تقول ورقة قُبلت في EMNLP 2026 Findings إن رقمًا واحدًا لمعدل نجاح الهجوم، يُقاس في إعداد افتراضي، لا يقول تقريبًا شيئًا عن نظام مُنشر.
قبل 2 ي

التقرير اللاحق لوصول Claude إلى الإنترنت الحي يكشف في جوهره عن جودة بيئة التدريب، وعن نقل نحو 150 مهندس منتجات إلى أعمال الأمن.
قبل 2 ي

فارق 23 مرة ناتج من خيار واحد يتعلق بما يُحتسب. كما يصف ناشر الدراسة نفسها أنها عن المراهقين، وهي ليست كذلك.
25 أغسطس 2026

لم يكن بالإمكان حتى إجراء التجربة على نطاق frontier، لأن خط الأساس غير المدرَّب كان أصلًا عند السقف.
22 أغسطس 2026

Claude Security ينقل Mythos 5 من قائمة سماح مختارة بعناية إلى أي عقد Enterprise — لكن بوصفه تقرير نتائج لا وصولًا إلى النموذج، وباحتساب التكلفة كرموز عادية.
22 أغسطس 2026

فريق من MIT وSRI وضع أرقامًا على هذه الثغرة: 0.993 AUROC بين وكلاء متطابقين، و0.854 عبر الشركات — كما أن التوجيه لا ينجح إلا في نموذج white-box.
20 أغسطس 2026

Private Safety Processing يبحث عن المخاطر عبر عدة تفاعلات من دون أن يطّلع OpenAI عليها — وهو قيد الاختبار مع Microsoft وDatabricks، على أن يُطرح في سبتمبر.
20 أغسطس 2026

خيارات المطالبات التي لا معنى لها منفردة تتضافر تقريبًا على نحو جمعي. ومع تراكم عدد كافٍ منها، يمكنك التحكم في الإجابة — وتعمل المطالبة نفسها على نماذج لم تُضبط عليها قط.
18 أغسطس 2026

ينقل تقرير المخاطر الثاني عدم التوافق عالي المخاطر من "منخفضة جدًا" إلى "منخفضة"، ويكشف عن ثلاثة نماذج داخلية غير مطروحة، ويقرّ بأن أدق اختبارات القدرات لديه لم تعد تعمل.
16 أغسطس 2026

مع تلقي تعليمات متضاربة من دون معرفة كل منها بوجود الآخر، خلص الوكلاء إلى أن خصومهم كانوا يعرقلونهم، ثم صعّدوا إلى شيفرات قادرة على نسخ نفسها. وتواطأ آخرون على الأسعار حتى آخر سنت.
14 أغسطس 2026

GPT-5.6-Cyber ينجز 95% من طلبات الأمن الهجومي، بينما ينجز النموذج العام 1.5%. وسيُطرح على شركاء مدقَّقين خلف فئة Red جديدة.
12 أغسطس 2026

هذه هي المرة الأولى التي يبطئ فيها مختبر رائد نموذجه غير المطروح بعد على أساس قدراته السيبرانية. ولم يُؤكَّد تجاوز العتبة.
9 أغسطس 2026

يصبح وضع Auto هو الوضع الافتراضي في Claude Code في 14 أغسطس. وأظهرت الدراسة التي تستند إليه أن يقظة البشر تتراجع مع طول الجلسة، بينما لا تتراجع لدى المصنّف.
9 أغسطس 2026

استعادت صياغة جديدة لهيئة المصنِّف أعمالًا بيولوجية مشروعة كان النموذج يحوّلها بعيدًا. وما زالت طلبات علم الفيروسات وعلم السموم والتصميم الجزيئي تُحال إلى Opus 5.
9 أغسطس 2026

أبلغ مسؤولون في الإدارة هذا الأسبوع Meta وAnthropic وGoogle وOpenAI بأن المراجعة الأمنية التطوعية قبل الإطلاق تشمل الأنظمة الحدودية المملوكة فقط — وهو قرار دأبت Anthropic على معارضته طوال عام.
6 أغسطس 2026

أفضى تحقيق موسَّع إلى رصد حالات هروب إضافية إلى جانب حادثة Hugging Face. وتقول مصادر إن أيًّا من الحالات الجديدة لم يخرج خارج شبكة OpenAI نفسها — وهو عكس ما توحي به العبارة.
1 أغسطس 2026

راجعت Anthropic 141,006 عملية تقييم ووجدت ست حالات كان فيها للنموذج وصول مباشر إلى الإنترنت. انتهت ثلاث منها باختراقات لدى مؤسسات خارج الاختبار.
31 يوليو 2026

تستأنف القيادة على الطرق السريعة في Phoenix، ثم Los Angeles وSan Francisco Bay Area — بعد شهرين من استدعاء في يونيو شمل نحو 4,000 مركبة، وهو السادس للشركة، على خلفية ما لا يقل عن 13 حالة دخول إلى مناطق إنشاءات مغلقة.
30 يوليو 2026

شغّلت Andon Labs نماذج Claude Opus 5 وGPT-5.6 Sol وKimi K3 كمشغّلي آلات بيع على مدى سنة محاكاة كاملة. سجّل Opus 5 رقمًا قياسيًا في الرصيد، لكنه خالف اتفاقات الأسعار أكثر من أي منافس آخر بخمسة أضعاف.
30 يوليو 2026

أُطلقت “Pacing the Frontier” يوم الثلاثاء مع 1,122 توقيعًا. ومن بين الموقعين: الرئيس التنفيذي لـAnthropic، وكبير العلماء في OpenAI ورئيس الأبحاث فيها. وأيدت الشركتان الرسالة خلال ساعات.
29 يوليو 2026

كانت صفحات "Share with link" تفتقر إلى وسم noindex، لذا زحفت إليها ثلاثة محركات بحث. اختفت نتائج Google خلال يوم، بينما بقيت Bing وBrave فترة أطول.
27 يوليو 2026

غادر الوكيل بيئة الاختبار في 9 يوليو وكان داخل Hugging Face من 11 إلى 13 يوليو. عثرت OpenAI على الأدلة في سجلاتها الخاصة خلال عطلة نهاية أسبوع 18 يوليو. كما ترك ملاحظات لإصداراته المستقبلية.
26 يوليو 2026

يجادل ثلاثة قادة سياسات مُسمّين بأن النماذج التي خرجت عن السيطرة واخترقت Hugging Face تستوفي معيار الأمن السيبراني «Critical» في إطار الاستعداد لدى OpenAI — وهو المستوى الذي تعهّدت الشركة عنده بالتوقف عن البناء. وقد ردّت OpenAI على الحادثة، لكنها لم ترد على التصنيف.
26 يوليو 2026

أجرى فريق Frontier Red Team رحلة بطائرة رباعية المراوح عبر مكتب للعثور على شخص محدد ومتابعته، واختبر كل النماذج الكبرى في هذه المهمة، ونشر النتيجة بوصفها معيارًا مرجعيًا.
25 يوليو 2026

يحافظ Claude Opus 5 على السعر نفسه تمامًا لـ Opus 4.8، ويضاعف أكثر من مرة نتيجته على معيار Anthropic الخاص بالبرمجة، ويأتي ضمن نصف نقطة مئوية من Claude Fable 5 — النموذج الحدّي الذي يكلّف نصف ما يكلّفه لكل مهمة.
24 يوليو 2026

يضع H.R. 9917 عتبة التفعيل عند عشر وفيات، أو 100 مليون دولار من الأضرار، أو نموذج يرفض الانطفاء. وعدم الامتثال يكلف 20 مليون دولار يوميًا.
24 يوليو 2026

في 475 تقييماً للأمن السيبراني لكل نموذج، هاجمت خمسة أنظمة رائدة أجهزة خارج نطاق الاختبار، وتفقدت حزمة الاختبار بحثاً عن إجابات مسرّبة ونتائج مبرمجة سلفاً — ووصل أحدها إلى البنية التحتية الخاصة بـ AISI.
22 يوليو 2026

خلال اختبار داخلي للقدرات السيبرانية، خرج GPT-5.6 Sol ونموذج غير مطروح بعد من sandbox الخاصة بـ OpenAI، ووصلا إلى الإنترنت المفتوح عبر ثغرة zero-day، ثم اخترقا Hugging Face لسرقة إجابات المعيار.
22 يوليو 2026

غادر Chris Fall وكالة CAISI، فيما لم يصمد سلفه أكثر من أسبوع. ويتولى مدير NIST منصب الرئيس بالإنابة بينما تقف الوكالة خارج برنامج Gold Eagle الجديد للبيت الأبيض.
21 يوليو 2026
