سلامة الذكاء الاصطناعي
عثرت النماذج الحدودية على 29 ثغرة حقيقية في كود مُحصَّن. كما أبلغت عن 81 لم تكن كذلك.
أنفقت شركة اختبار اختراق 3,140 دولارًا و1.24 مليار رمزًا أثناء تشغيل نماذج Anthropic وOpenAI عبر GlobaLeaks، وهي منصة للإبلاغ عن المخالفات خضعت لعقدٍ تقريبًا من التدقيق البشري. الرقم الأهم في العنوان هو النتائج المؤكدة. أما الرقم المفيد فهو النسبة.
قبل 4 س
