Modèles d’IA
« La course au benchmark n’est pas l’essentiel » : des dirigeants du WAIC appellent à repenser l’évaluation de l’IA
Alors que les classements standards sont saturés et contaminés, des dirigeants chinois de l’IA ont soutenu que les performances sur des tâches réelles — et des métriques comme les « agents actifs quotidiens » — devraient remplacer les benchmarks statiques.
il y a 1 j
