Ricerca AI
Un nuovo benchmark scopre che l'IA che legge le radiografie può essere pericolosamente sicura di sé quando sbaglia
RadLE 2.0 ha testato 16 modelli frontier su 200 casi di radiografie con un sistema di punteggio che penalizza gli errori sicuri; i radiologi umani hanno ottenuto 988,7 su 2.000 contro i 758 della migliore IA.
1 g fa
