noesisnoesis
框架比较

MBTI是科学的吗?

诚实的回答比简单的是或否更具体:问卷的构建相当合理,而它用来报告结果的类型理论则缺乏支持。这两个事实通常被混为一个争论。

迈尔斯-布里格斯类型指标(MBTI)是全世界使用最广泛的人格测评工具,同时也是学院派人格心理学最不认真对待的一个。这两个事实都值得解释,因为双方通俗版本的论点都是错的。

这些批评究竟证明了什么

这些二分类别并不是真正的二分的。 这是最有力的反对意见,而且基本无可争议。MBTI 把你报告为E或I、T或F。如果这些真的是真实的类别,那么每个维度上的分数分布应该呈现出两个隆起、中间有一个缺口。事实并非如此。这些分布是单峰的——大多数人都聚集在中间,而类型的边界恰好切在分布最密集的地方。

实际后果很严重。一个人在边界一分之差的两侧,会得到不同的字母、不同的四字母类型,尽管在统计上他们其实无法区分。这不是一个微妙的统计学争论;这正是为什么同一个人合理地可能测出两种不同的类型。

重测分类的一致性很差。 数据显示,间隔数周后重新测试,相当一部分受测者——通常报告在三分之一到二分之一之间——至少有一个字母发生变化,从而得到不同的类型。对于一个全部输出都是一个稳定类型的测评工具来说,这是一个严重的问题。注意其中的机制:这直接源于二分化的做法。底层的连续分数相当稳定;正是在某个边界处切分的这个动作,制造出了这种不稳定性。

第四个维度的支持较弱。 判断-知觉(J-P)是伊莎贝尔·迈尔斯(Isabel Myers)在荣格理论基础上添加的内容,并非原始理论的一部分,也是四个维度中实证基础最薄弱的一个。

该理论是前实证时代的产物。 荣格的类型理论来自20世纪20年代的临床观察和内省。它不是从数据中推导出来的,也不是为了被检验而构建的。这不是对荣格的批评,他做的是另一件事;这只是在说明这是一种什么性质的主张。

在其最常被声称的地方,预测效度较弱。 MBTI 在团队组建和职业指导方面被大力营销。有关类型能预测工作绩效或团队效能的证据很单薄,该测评工具的出版方自己也建议不要将其用于选拔。

这些批评没有证明的事

问卷本身的编制并不差。题目层面的心理测量学指标是相当不错的——四个量表的内部一致性总体上是可接受的,而且这些题目的开发比通俗批评所暗示的要用心得多。

更有意思的是,其底层的连续维度与已确立的特质有明显的对应关系。E-I与外向性密切对应。T-F与宜人性有相当程度的对应。J-P与尽责性有相当程度的对应。S-N与开放性对应。四个维度中有三个恢复的是五因素模型也捕捉到的真实变异。

所以问题不在于测量本身。问题在于测量之后所做的事:连续的分数被切分成类别,类别被赋予了名字,而这些名字被当作了人的种类。

为什么它依然如此受欢迎

它令人愉悦。十六种类型中的每一种都被正面地描述,没有一种是"糟糕"的类型,而且这些描述写得足够笼统,以至于大多数人都能在其中认出自己——巴纳姆效应正如文献所记载的那样精确地起作用。

它也为团队提供了一套共享的、不带威胁性的词汇。咨询顾问反映,这在团队引导中确实很有用,没有理由怀疑他们。这是一个合理的用途,与这些类型是否真实无关。

合理的结论

参加MBTI测试并无害处,阅读自己类型的描述也并非毫无价值。但把类型作为招聘、晋升、团队分配或职业方向的依据,并没有证据支持,出版方自己也认同这一点。

如果你想要的是一个可以站得住脚的人格测量,五因素模型是有证据支撑的选择:连续分数而非类型,四十年的独立复现研究,已发表的常模,以及有据可查的测量误差。NOESIS 在目录中发布的大五人格测评工具,注明了其来源和局限性,这才是值得你亲自比较的对象。

付諸实测

阅读关於测量的文章是一件事,親眼看到自己的得分连同其来源、常模樣本与限制一起呈现则是另一件事。免费进行测验,无需註冊。

继续阅读