AI研究新基准发现:AI 读 X 光片出错时可能危险地自信RadLE 2.0 在 200 个 X 光病例上测试了 16 个前沿模型,并采用会惩罚自信错误的评分体系;人类放射科医生得分为 988.7 分,满分 2,000 分,优于最佳 AI 的 758 分。2天前