Si leur importance relative varie en fonction des objectifs de l’évaluation, les critères de qualité suivants font l’objet d’un récent consensus. La validité fait référence à la capacité qu’a une évaluation à mesurer ce qu’elle est censée mesurer. Il s’agit de choisir un instrument adapté en fonction de ses objectifs d’apprentissage et d’utiliser le plus possible d’items représentant au mieux le contenu testé. La reproductibilité s’évalue de manière empirique en fonction de divers modèles psychométriques. L’équivalence concerne la stabilité des scores d’un même test appliqué dans des situations différentes. La faisabilité et l’acceptabilité sont deux autres critères dont il faut tenir compte. D’un point de vue pédagogique, la qualité d’une évaluation s’apprécie d’une part sur son effet avant le testing et d’autre part sur son effet rétroactif, dit catalytique. C’est en tenant compte de ces deux derniers critères que l’on peut optimaliser l’effet levier de l’évaluation sur l’apprentissage.
Dory, V. (2012). Principes d’une «bonne» évaluation des étudiants et praticiens en Sciences de la Santé. Louvain médical, 131(2), 75 (79). https://hdl.handle.net/2078.5/158538 (Original work published 2012)