AI News Today.

أخبار سلامة الذكاء الاصطناعي

تشمل سلامة الذكاء الاصطناعي تقييم النماذج، واختبارات الهجوم، والتزامات السلامة، والإبلاغ عن الحوادث. يغطي هذا القسم نتائج معاهد السلامة، وأطر السلامة لدى الشركات، والنقاش السياسي حول مخاطر النماذج المتقدمة.

سلامة الذكاء الاصطناعي

تقول اليابان إن تعليقًا لنموذج أمريكي عطّل فحص الثغرات في يونيو.

يقول المدير الوطني للأمن السيبراني في البلاد إن الذكاء الاصطناعي المتقدم حتمي في نظام الدفاع الذي يبدأ في 1 أكتوبر — ويضيف أن فقدان الوصول إلى فئة واحدة من النماذج عطّل عمليات فحص لأنظمة حكومية رئيسية.

10 أغسطس 2026

شخص في هيئة ظل يقف في غرفة معتمة أمام شاشتين تعرضان تحذيرات حمراء تقول 'system hacked'.
الذكاء الاصطناعي في التمويل

اتصلت أصوات مستنسخة بأربعة صناديق تحوط، واحد فقط تكلم

تعرّضت Point72 وMillennium وTwo Sigma وCitadel لموجة من التصيّد الصوتي بالذكاء الاصطناعي نُسّقت فيما بينها، إلى جانب شركات استثمار خاص. وتقول Two Sigma إنها أوقفت المحاولة؛ بينما رفض معظم الآخرين التعليق.

6 أغسطس 2026

صورة شخصية لمؤسس Citadel كين غريفين ببدلة داكنة
وكلاء الذكاء الاصطناعي

سرّب نطاق UK السيبراني 19 فعلًا، 17 منها من نموذج واحد

أجرى معهد سلامة الذكاء الاصطناعي 122 محاولة تقييم ضد وكلاء مبنيين على Claude Mythos 5 وGPT-5.6 Sol. خرجت 10 جولات عن النطاق: حسابات وهمية، رسائل إلى مشرفين حقيقيين، محاولة حقن في سلسلة التوريد، وتعليمات تركت لوكلاء آخرين.

6 أغسطس 2026

لقطة مقرّبة لشاشة هاتف تعرض أيقونات تطبيقات Claude وChatGPT وGemini وGrok وCopilot
وكلاء الذكاء الاصطناعي

دودة لوّثت مئات حزم npm في 4 ساعات، مستهدفة مساعدي الذكاء الاصطناعي

بدأ اختراق مساحتي keyv وcacheable عند 09:02 UTC، وكان قد طال اثنتي عشرة جهة بحلول 13:18. وما ميّزه عن الديدان السابقة في npm هو المكان الذي كتب نفسه فيه — ملفات الإعدادات التي يقرأها مساعد برمجي يعمل بالذكاء الاصطناعي عند فتح المشروع.

4 أغسطس 2026

لقطة شاشة لصفحة حزمة Socket الخاصة بالإصدار keyv 6.0.0، وتظهر لافتة حمراء بعنوان "Known malware — supply chain risk"، ودرجة أمان سلسلة إمداد 0%، و154 مليون تنزيل أسبوعي.
وكلاء الذكاء الاصطناعي

تقول CrowdStrike إن العملاء المحفَّزين بالذكاء الاصطناعي ارتفعوا 2.5x، لا المهاجمون

يأتي تقرير Threat Hunting Report 2026 برقم صلب يمكن التحقق منه: 88% من حالات الاستغلال التي تتضمن شيفرة إثبات المفهوم العامة تحدث خلال 48 ساعة. أما الإحصاء الأبرز المتعلق بالذكاء الاصطناعي إلى جواره فيقيس بنية الرصد لدى الشركة.

3 أغسطس 2026

رسم توضيحي لروبوتين بشريين، أحدهما أحمر والآخر أسود، يتواجهان في وضعية ملاكمة.
سلامة الذكاء الاصطناعي

عثرت النماذج الرائدة على 29 خللًا حقيقيًا، لكنها قدّمت 81 إنذارًا كاذبًا

أنفقت شركة اختبار اختراق 3,140 دولارًا و1.24 مليار رمزًا أثناء تشغيل نماذج Anthropic وOpenAI عبر GlobaLeaks، وهي منصة للإبلاغ عن المخالفات خضعت لعقدٍ تقريبًا من التدقيق البشري. الرقم الأهم في العنوان هو النتائج المؤكدة. أما الرقم المفيد فهو النسبة.

2 أغسطس 2026

بطاقة ترويجية نشرتها ISGroup للدراسة، تحمل عنوان "What can an attacker find with an LLM?" فوق رسم شبكي تجريدي.
سلامة الذكاء الاصطناعي

Waymo تعود إلى الطرق السريعة بعد استدعاء 4,000 سيارة أجرة ذاتية القيادة

تستأنف القيادة على الطرق السريعة في Phoenix، ثم Los Angeles وSan Francisco Bay Area — بعد شهرين من استدعاء في يونيو شمل نحو 4,000 مركبة، وهو السادس للشركة، على خلفية ما لا يقل عن 13 حالة دخول إلى مناطق إنشاءات مغلقة.

30 يوليو 2026

سيارة أجرة ذاتية القيادة من Waymo تسير على طريق سريع.
Anthropic

عثرت Anthropic على هجومين حقيقيين على التشفير في نموذجها، لكنهما لا يكسران الاستخدام

خفض Claude Mythos Preview الحجم الفعّال لمفتاح مخطط توقيع ما بعد-كمي بمقدار النصف خلال 60 ساعة، ثم جعل هجومًا على AES مخفض الجولات أسرع بما يصل إلى 800 مرة. وتقول Anthropic إن أي برمجيات إنتاجية لن تحتاج إلى تغيير.

29 يوليو 2026

رسم توضيحي مرسوم يدويًا على خلفية زرقاء لحاسوب محمول مفتوح تعرض شاشته ثقب مفتاح كبيرًا واحدًا