Qu'est-ce que la psychométrie ?
La discipline qui détermine si une mesure psychologique est valable — et la raison pour laquelle deux tests posant des questions similaires peuvent différer énormément quant à la valeur de leurs résultats.
La psychométrie est la branche de la psychologie consacrée à la mesure elle-même. Non pas à ce que signifie l'extraversion, mais à la question de savoir si un ensemble donné de questions mesure réellement l'extraversion, quelle est la marge d'erreur du chiffre obtenu, et ce que ce chiffre est en mesure de prédire.
Cette distinction est plus importante qu'il n'y paraît. N'importe qui peut rédiger vingt questions sur le caractère sociable d'une personne et additionner les réponses. La psychométrie, c'est le travail qui vient ensuite : démontrer que les vingt questions forment un ensemble cohérent, qu'elles mesurent une seule chose plutôt que trois, que la même personne obtient à peu près le même score le mois suivant, que le score est lié à la façon dont cette personne se comporte réellement, et que tout l'appareil fonctionne de la même manière pour un jeune de 22 ans à Lisbonne que pour un adulte de 55 ans à Munich.
Pourquoi une discipline a été nécessaire
La mesure physique bénéficie d'un avantage que la psychologie n'a pas : on peut poser une règle graduée à côté de ce que l'on mesure. Il n'existe pas de règle graduée pour la conscienciosité. Le trait n'est pas directement observable — il est inféré à partir de comportements, et les réponses à un questionnaire constituent une couche d'inférence supplémentaire.
C'est ce que les psychométriciens appellent une variable latente : quelque chose d'assez réel pour avoir des conséquences, mais qui n'est jamais accessible qu'au travers d'indicateurs indirects. Tout l'appareil méthodologique existe en raison de cette indirection. Chaque technique que vous rencontrerez — analyse factorielle, coefficients de fidélité, théorie de la réponse à l'item, échantillons de normes — est une tentative de formuler quelque chose de défendable sur une quantité que personne ne peut observer.
Les trois questions
En faisant abstraction du vocabulaire, la psychométrie pose trois questions à tout instrument.
Est-il cohérent ? Si la mesure est principalement du bruit, rien d'autre n'a d'importance. La cohérence est vérifiée entre les items (les questions sont-elles concordantes ?), dans le temps (la même personne obtient-elle le même score le mois suivant ?), et entre évaluateurs lorsque cela est pertinent. C'est la fidélité.
Mesure-t-il ce qu'il prétend mesurer ? Un questionnaire peut être parfaitement cohérent et pourtant mesurer la mauvaise chose. Une échelle censée mesurer le potentiel de leadership mais qui corrèle à 0,8 avec la simple estime de soi mesure en réalité l'estime de soi. C'est la validité, et elle n'est pas une propriété qu'un instrument possède ou ne possède pas — c'est un argument construit à partir de preuves accumulées.
Par rapport à qui ? Un score brut de 34 ne signifie rien en soi. Il ne devient interprétable que par rapport à un groupe de référence : 34, c'est élevé par rapport à quelle population, mesurée quand et où ? C'est le travail des normes, et c'est l'étape que la plupart des tests grand public omettent entièrement.
À quoi ressemble une bonne pratique
Un instrument bien conçu possède une traçabilité documentaire. Quelqu'un a publié la façon dont les items ont été rédigés et lesquels ont été écartés. Quelqu'un a rapporté les coefficients de fidélité, dans des échantillons nommés, avec les tailles d'échantillon. Quelqu'un a vérifié que la structure factorielle se confirmait dans un second échantillon indépendant, et non dans celui utilisé pour la construire. Quelqu'un a vérifié que les items se comportent de la même manière selon les langues et les groupes d'âge. Quelqu'un d'autre — idéalement sans aucun intérêt dans l'instrument — a tenté de reproduire les résultats et a rapporté ce qui s'est passé.
Rien de tout cela ne rend un test infaillible. Cela rend ses limites connaissables, ce qui est une propriété différente et plus utile. Un instrument dont l'erreur de mesure est documentée vous indique dans quelle mesure vous pouvez faire confiance à une faible différence entre deux scores. Un instrument sans estimation d'erreur publiée n'est pas plus précis ; il est simplement plus discret sur son imprécision.
Ce que cela implique pour le lecteur
La psychométrie ne vous dira pas qu'un test est vrai. Elle vous indiquera jusqu'où un score peut être poussé avant de cesser de signifier quoi que ce soit — quelles questions il peut répondre, pour quelles populations il a été étalonné, et quelle doit être l'ampleur d'une différence pour qu'elle vaille la peine d'être remarquée.
C'est une promesse plus modeste que celle que font la plupart des produits de personnalité. C'est aussi la seule promesse qui résiste à l'épreuve des faits.
Mettez-le à l'épreuve
Lire sur la mesure est une chose. Voir son propre score avec sa source, son échantillon normatif et ses limites en est une autre. Gratuit, sans inscription.
À lire ensuite
- Qu'est-ce que la fidélité en psychométrie ?La fidélité désigne la cohérence de la mesure, non son exactitude. Un test peut être très fidèle et mesurer néanmoins la mauvaise chose — c'est pourquoi c'est la première question que l'on pose, et jamais la dernière.
- Qu'est-ce que la validité dans les tests psychologiques ?La validité n'est pas une propriété que possède un test. C'est un argument sur la question de savoir si une interprétation particulière d'un score particulier, pour un objectif particulier, est défendable — et elle doit être reconstruite pour chaque nouvel usage.
- Qu'est-ce que la validité de construit ?La question la plus difficile en matière de mesure : savoir si ce que vous mesurez existe tel que vous l'avez défini, et si votre instrument l'atteint plutôt que quelque chose d'adjacent.
- Validité convergente et discriminanteDeux exigences en miroir : une mesure doit concorder avec ce avec quoi elle devrait concorder, et doit rester distincte de ce qu'elle prétend ne pas être. La plupart des instruments faibles échouent sur le second point.
- Ce qu'est l'alpha de Cronbach — et ce qu'il n'est pasLa statistique la plus rapportée en psychométrie, et la plus mal interprétée. L'alpha ne vous dit pas qu'une échelle est unidimensionnelle, et une valeur élevée est souvent un symptôme plutôt qu'une vertu.
- Erreur type de mesure : dans quelle mesure votre score peut-il être inexactTout score comporte une marge d'erreur, et pour la plupart des tests psychologiques, elle est plus large que ce que les gens supposent. C'est ce chiffre qui vous indique quand une différence est réelle et quand elle n'est que du bruit.
- Normes et percentiles : ce à quoi votre score est comparéUn score brut est inexploitable en lui-même. Il ne prend de sens qu'en référence à un groupe étalon — et le choix de ce groupe est l'un des faits les plus déterminants et les moins publicisés concernant tout test.
- Comment un test psychométrique est réellement construitDe la définition du construit aux normes publiées, le processus prend des années et écarte la majeure partie de ce qui y est investi. Connaître les étapes permet de voir immédiatement lesquelles un quiz en ligne rapide a omises.
- Que signifie dire qu'un test est validé ?Le terme n'est pas réglementé et est utilisé librement par des produits qui n'ont accompli aucun des travaux nécessaires. Voici ce qu'il signifie lorsqu'il a un sens, et les quatre questions qui permettent de distinguer les deux cas.
- Pourquoi la plupart des tests de personnalité en ligne ne sont pas fiablesNon pas parce qu'ils sont malhonnêtes, mais parce que les étapes qui rendent une mesure digne de confiance sont invisibles, coûteuses et faciles à ignorer — et les ignorer ne change rien à l'apparence du résultat.
- Ce que les auto-évaluations peuvent et ne peuvent pas mesurerLes questionnaires vous demandent d'être l'observateur de vous-même, ce qui fonctionne mieux pour certaines choses que pour d'autres. Savoir où la méthode est solide et où elle échoue change la façon dont vous interprétez n'importe quel résultat.
- Ce que signifie qu'un test prédit quelque choseUne corrélation de 0,30 est un résultat solide en recherche sur la personnalité et une base fragile pour prendre une décision concernant une personne en particulier. Ces deux affirmations sont vraies, et l'écart entre elles est à l'origine de la plupart des mauvaises utilisations des résultats de tests.
- Le dépistage n'est pas un diagnosticUn questionnaire de dépistage est conçu pour détecter le plus grand nombre de cas possible, en acceptant un taux élevé de faux positifs comme contrepartie. Interpréter un score de dépistage comme un diagnostic va à l'encontre de ce pour quoi il a été conçu.