Ce que signifie qu'un test prédit quelque chose
Une corrélation de 0,30 est un résultat solide en recherche sur la personnalité et une base fragile pour prendre une décision concernant une personne en particulier. Ces deux affirmations sont vraies, et l'écart entre elles est à l'origine de la plupart des mauvaises utilisations des résultats de tests.
La recherche en psychologie de la personnalité indique que la conscienciosité prédit la performance professionnelle. En lisant cette phrase, la plupart des gens imaginent quelque chose de bien plus fort que ce que les données montrent réellement. C'est dans l'écart entre l'affirmation statistique et le sens courant du mot « prédit » que commence la plupart des mauvaises utilisations des tests psychologiques.
Les chiffres en jeu
Les tailles d'effet en recherche sur la personnalité sont généralement exprimées sous forme de corrélations. Les valeurs méta-analytiques pour les relations bien établies se situent généralement entre 0,20 et 0,35. La conscienciosité et la performance professionnelle se situent autour de 0,20 à 0,25. La satisfaction au travail et la performance professionnelle avoisinent 0,30. L'aptitude mentale générale, le meilleur prédicteur unique dans ce domaine, atteint environ 0,50 pour les tâches complexes.
Élevez une corrélation au carré et vous obtenez la proportion de variance expliquée. Une corrélation de 0,25 représente environ six pour cent des différences entre les individus. Quatre-vingt-quatorze pour cent s'expliquent par autre chose : les aptitudes, les opportunités, la formation, le management, la santé, la chance.
Pourquoi 0,25 est néanmoins un résultat réel
À l'échelle d'une population, de petites corrélations produisent des effets agrégés substantiels. Si vous sélectionnez mille personnes, un prédicteur à 0,25 améliore votre résultat moyen de façon mesurable et répétée. Les assureurs et les épidémiologistes fondent des pratiques entières sur des effets de cette magnitude.
Le problème est que le bénéfice agrégé et la prédiction individuelle sont deux quantités distinctes. Une corrélation de 0,25 signifie que parmi les personnes obtenant un score élevé, davantage performeront bien que parmi celles obtenant un score faible — mais aussi qu'un grand nombre de personnes à score élevé performeront mal et qu'un grand nombre de personnes à score faible excelleront. Ces deux affirmations découlent du même chiffre.
Le cas individuel
C'est l'étape que l'on omet. Une corrélation décrit la relation entre deux distributions. Elle n'autorise aucune affirmation concernant un individu en particulier.
Si la conscienciosité est corrélée à 0,25 avec la performance, alors connaître le score de conscienciosité d'une personne ne réduit que légèrement la plage plausible de sa performance. L'intervalle de prédiction pour un individu donné reste suffisamment large pour englober presque toute l'étendue des résultats possibles. Apprendre que vous vous situez au 80e percentile en conscienciosité vous renseigne très peu sur vos performances dans un emploi précis.
C'est pourquoi l'utilisation des scores de personnalité comme filtre de sélection principal est peu justifiée, même lorsque la recherche sous-jacente est rigoureuse. La recherche soutient l'idée que le trait a de l'importance. Elle ne soutient pas l'idée qu'un score vous indique ce qu'un candidat fera.
Deux mises en garde supplémentaires
Prédire et causer sont deux choses différentes. La quasi-totalité de cette littérature est corrélationnelle. Le fait que la conscienciosité prédise les résultats de santé est compatible avec l'idée que la conscienciosité cause de meilleures habitudes de santé, avec l'existence d'un troisième facteur causant les deux, et avec une causalité inverse. Les études longitudinales réduisent les possibilités ; elles les éliminent rarement.
Les critères autodéclarés font gonfler les chiffres. Lorsque le prédicteur et le résultat sont tous deux autodéclarés par la même personne le même jour, la variance due à la méthode commune fait monter la corrélation. Les études utilisant des résultats objectifs ou des évaluations par des tiers rapportent généralement des effets plus faibles, et ce sont celles auxquelles il convient d'accorder le plus de poids.
À quoi sert réellement un score
Lu comme une description plutôt que comme une prophétie, un score à un test est véritablement utile. Il vous indique où vous vous situez par rapport à une population de référence sur un trait aux conséquences documentées, et il vous offre un vocabulaire pour nommer un schéma que vous avez peut-être remarqué sans pouvoir le désigner.
Cela a de la valeur. Mais c'est une chose différente d'une prévision, et cette distinction est l'une que tout rapport honnête devrait expliciter pour vous, plutôt que de vous laisser la déduire vous-même.
Mettez-le à l'épreuve
Lire sur la mesure est une chose. Voir son propre score avec sa source, son échantillon normatif et ses limites en est une autre. Gratuit, sans inscription.
À lire ensuite
- Qu'est-ce que la psychométrie ?La discipline qui détermine si une mesure psychologique est valable — et la raison pour laquelle deux tests posant des questions similaires peuvent différer énormément quant à la valeur de leurs résultats.
- Qu'est-ce que la fidélité en psychométrie ?La fidélité désigne la cohérence de la mesure, non son exactitude. Un test peut être très fidèle et mesurer néanmoins la mauvaise chose — c'est pourquoi c'est la première question que l'on pose, et jamais la dernière.
- Qu'est-ce que la validité dans les tests psychologiques ?La validité n'est pas une propriété que possède un test. C'est un argument sur la question de savoir si une interprétation particulière d'un score particulier, pour un objectif particulier, est défendable — et elle doit être reconstruite pour chaque nouvel usage.
- Qu'est-ce que la validité de construit ?La question la plus difficile en matière de mesure : savoir si ce que vous mesurez existe tel que vous l'avez défini, et si votre instrument l'atteint plutôt que quelque chose d'adjacent.
- Validité convergente et discriminanteDeux exigences en miroir : une mesure doit concorder avec ce avec quoi elle devrait concorder, et doit rester distincte de ce qu'elle prétend ne pas être. La plupart des instruments faibles échouent sur le second point.
- Ce qu'est l'alpha de Cronbach — et ce qu'il n'est pasLa statistique la plus rapportée en psychométrie, et la plus mal interprétée. L'alpha ne vous dit pas qu'une échelle est unidimensionnelle, et une valeur élevée est souvent un symptôme plutôt qu'une vertu.
- Erreur type de mesure : dans quelle mesure votre score peut-il être inexactTout score comporte une marge d'erreur, et pour la plupart des tests psychologiques, elle est plus large que ce que les gens supposent. C'est ce chiffre qui vous indique quand une différence est réelle et quand elle n'est que du bruit.
- Normes et percentiles : ce à quoi votre score est comparéUn score brut est inexploitable en lui-même. Il ne prend de sens qu'en référence à un groupe étalon — et le choix de ce groupe est l'un des faits les plus déterminants et les moins publicisés concernant tout test.
- Comment un test psychométrique est réellement construitDe la définition du construit aux normes publiées, le processus prend des années et écarte la majeure partie de ce qui y est investi. Connaître les étapes permet de voir immédiatement lesquelles un quiz en ligne rapide a omises.
- Que signifie dire qu'un test est validé ?Le terme n'est pas réglementé et est utilisé librement par des produits qui n'ont accompli aucun des travaux nécessaires. Voici ce qu'il signifie lorsqu'il a un sens, et les quatre questions qui permettent de distinguer les deux cas.
- Pourquoi la plupart des tests de personnalité en ligne ne sont pas fiablesNon pas parce qu'ils sont malhonnêtes, mais parce que les étapes qui rendent une mesure digne de confiance sont invisibles, coûteuses et faciles à ignorer — et les ignorer ne change rien à l'apparence du résultat.
- Ce que les auto-évaluations peuvent et ne peuvent pas mesurerLes questionnaires vous demandent d'être l'observateur de vous-même, ce qui fonctionne mieux pour certaines choses que pour d'autres. Savoir où la méthode est solide et où elle échoue change la façon dont vous interprétez n'importe quel résultat.
- Le dépistage n'est pas un diagnosticUn questionnaire de dépistage est conçu pour détecter le plus grand nombre de cas possible, en acceptant un taux élevé de faux positifs comme contrepartie. Interpréter un score de dépistage comme un diagnostic va à l'encontre de ce pour quoi il a été conçu.