AI News Today.

تغطية مهنية للذكاء الاصطناعي

#AI benchmarks

الذكاء الاصطناعي في الرعاية الصحية

يجد اختبار معياري جديد أن الذكاء الاصطناعي الذي يقرأ الأشعة السينية قد يكون واثقًا بشكل خطير عندما يخطئ

اختبر RadLE 2.0 16 نموذجًا متقدمًا على 200 حالة أشعة سينية باستخدام نظام تقييم يعاقب الأخطاء الواثقة؛ وسجل اختصاصيو الأشعة البشريون 988.7 من أصل 2,000 مقابل 758 لأفضل نموذج ذكاء اصطناعي.

قبل 1 ي

صورة أشعة سينية للصدر معروضة على شاشة
نماذج الذكاء الاصطناعي

"ليست سباق المعايير هو النقطة الأهم": مسؤولون في WAIC يدفعون لإعادة التفكير في تقييم الذكاء الاصطناعي

مع تشبّع لوحات الصدارة القياسية وتلوّثها، جادل قادة الذكاء الاصطناعي في الصين بأن أداء المهام في العالم الواقعي — ومقاييس مثل "الوكلاء النشطين يوميًا" — ينبغي أن يحل محل المعايير الثابتة.

قبل 1 ي

لوحة صدارة لمعايير نموذج ذكاء اصطناعي على شاشة