AI News Today.

#AIxCC

سلامة الذكاء الاصطناعي

التحقق المعتمد على PoC فقط يضخّم نجاح ترقيع الذكاء الاصطناعي بمقدار 1.83x

الطريقة شبه المعتمدة لتقييم ما إذا كان وكيل ذكاء اصطناعي قد أصلح ثغرة — إعادة تشغيل proof-of-concept المتعطل ومعرفة ما إذا كان سيتعطل مجددًا — تبالغ في معدلات النجاح عبر 11 وكيلاً، بينهم أفضل ثلاثة من AIxCC.

قبل 2 س

الصفحة الأولى من الورقة الأولية، بعنوان 'PatchBench: Evaluating AI Agents for Vulnerability Patching'، والمؤرخة في 3 سبتمبر 2026