noesisnoesis
Comment on mesure

Validité convergente et discriminante

Deux exigences en miroir : une mesure doit concorder avec ce avec quoi elle devrait concorder, et doit rester distincte de ce qu'elle prétend ne pas être. La plupart des instruments faibles échouent sur le second point.

La validité convergente et la validité discriminante constituent les deux moitiés d'une seule et même exigence. Une mesure doit être corrélée avec ce qu'elle devrait théoriquement l'être, et ne doit pas être trop fortement corrélée avec ce dont elle est censée se distinguer. Satisfaire l'une sans l'autre n'est pas un demi-succès ; c'est généralement le signe que le construit n'est pas ce qu'il prétend être.

Validité convergente

Les données convergentes montrent qu'une mesure s'aligne sur d'autres indicateurs du même phénomène. Une nouvelle échelle d'anxiété devrait être substantiellement corrélée avec des échelles d'anxiété établies, avec des évaluations cliniciennes, et — idéalement — avec quelque chose qui n'est pas un autre questionnaire, comme des mesures physiologiques ou des comportements d'évitement observés.

Les corrélations attendues ici dépassent généralement 0,50, souvent 0,70 lorsque la mesure de comparaison est un instrument bien établi pour le même construit. En dessous de ce seuil, soit la nouvelle échelle, soit la mesure de comparaison mesure autre chose.

Il existe un piège. Une corrélation de 0,95 avec une échelle existante n'est pas un triomphe — cela signifie que le nouvel instrument est un reconditionnement, et la vraie question devient celle de sa valeur ajoutée. La validité convergente est un plancher, non une cible à maximiser.

Validité discriminante

Les données discriminantes montrent que la mesure reste distincte des construits dont elle prétend différer. C'est là que résident les échecs les plus révélateurs.

Le même schéma revient dans la littérature. La persévérance est corrélée à environ 0,84 avec la conscienciosité, une proximité telle que la méta-analyse a révélé qu'elle n'apporte presque rien à la prédiction académique une fois la conscienciosité contrôlée. L'intelligence émotionnelle auto-rapportée recoupe largement la stabilité émotionnelle, l'extraversion et la conscienciosité combinées. La variance partagée au sein de la Triade Sombre disparaît en grande partie dès lors que l'on prend en compte l'Honnêteté-Humilité du modèle HEXACO. Dans chaque cas, le construit était présenté comme un territoire nouveau et s'est révélé n'être qu'une région renommée d'une carte existante.

La validité discriminante est également là où les effets de méthode font surface. Si chaque construit auto-rapporté dans une étude est corrélé à 0,4 avec tous les autres, le facteur commun est probablement le style de réponse du répondant plutôt qu'une quelconque psychologie partagée.

Le test décisif

La procédure décisive est la validité incrémentielle : on introduit d'abord la mesure établie dans une régression, puis la nouvelle, et on vérifie si cette dernière explique une part supplémentaire de variance dans le critère. Si ce n'est pas le cas, le construit peut rester théoriquement intéressant, mais l'instrument ne mesure rien que le domaine ne possédait pas déjà.

C'est une norme exigeante, et un grand nombre d'échelles publiées n'y ont jamais été soumises. Lorsqu'elles le sont, le résultat est fréquemment celui de la redondance mentionnée plus haut. Ce n'est pas un scandale — c'est un élagage scientifique normal — mais cela signifie que la popularité d'un construit n'indique rien quant à sa capacité à survivre à ce test.

Ce que cela change pour le lecteur

Lorsqu'un test rapporte plusieurs scores, la question utile est de savoir si ces scores sont réellement distincts. Quatre dimensions corrélées à 0,8 entre elles n'en forment qu'une seule avec quatre étiquettes, et un profil construit à partir d'elles paraîtra différencié tout en ne portant presque aucune information indépendante.

Les instruments qui rapportent leurs corrélations inter-échelles vous permettent de vérifier cela par vous-même. Les instruments qui présentent une typologie en quatre quadrants sans jamais montrer comment ces quadrants sont liés ont rendu cette vérification impossible, ce qui est généralement le but recherché.

Mettez-le à l'épreuve

Lire sur la mesure est une chose. Voir son propre score avec sa source, son échantillon normatif et ses limites en est une autre. Gratuit, sans inscription.

À lire ensuite