从人格分类研究看招聘测评:企业用MBTI筛人靠谱吗?
摘要:MBTI等性格测试正被越来越多企业用作招聘筛选工具,但其信效度、预测效度与合规风险均存争议。本文从人格分类研究出发,结合SHRM、EEOC等权威资料,分析性格测试在招聘中的适用边界。
一、现象:性格测试从社交标签变成招聘"硬杠杠"
MBTI的应用场景正从社交领域扩展到招聘环节。在微博,与MBTI相关的话题阅读量高达8亿,各大线上平台涌现出大量以人格类型命名的群组[3]。但如今,这套由4个英文字母组成的代码,已经悄然出现在招聘流程的筛选环节。
据媒体报道,近年来MBTI、卡特尔16PF、PDP、九型人格等性格测试在职场招聘中频频出现,越来越多公司开始在面试中加入相关内容,甚至在岗位调整和晋升时也会用到,有企业还提出性格测试不通过一年内不能再投简历的要求[2]。求职者的困惑随之而来:"3轮面试都过了,最后卡在了性格测试""刚做完测试,被通知与意向岗位要求不符,可这是我做梦都想去的公司"[2]。
从人力资源与组织发展的视角看,企业引入性格测试的动机并不难理解。据媒体报道,有企业方认为,性格测试可以作为一种快速筛选的"通用语言",帮助面试官迅速了解求职者的性格特征和行为偏好,提升招聘效率[2]。据Talent Board 2016年北美候选人体验研究报告,82%的企业正在使用某种形式的职前测评[1]。问题在于,当性格测试从"辅助参考"变成"一票否决",它的科学性是否撑得起这份权重?
二、MBTI是什么:一套自我报告式的人格分类工具
要判断MBTI能否用于筛人,先要弄清它究竟是什么。
MBTI全称为"Myers-Briggs Type Indicator"(迈尔斯—布里格斯性格分类指标),由美国作家迈尔斯和她的母亲布里格斯在20世纪40年代编制,是一种自我报告式的人格测评工具,用以描述人们在获取信息、做出决策、对待生活等方面的心理活动规律和人格类型表现[3]。它将个体人格分成16种类型,认为每种类型都有独特的性格特征和擅长之处[2]。
其理论根基可追溯至荣格。中国科学院心理研究所教授陈祉妍介绍,荣格在20世纪20至30年代出版的《心理类型》一书中首次对人格进行了类型划分,我们熟知的性格内向和外向等概念就出自此书[3]。
这里有一个常被忽略的关键点:MBTI是自我报告式工具。这意味着测试结果高度依赖受测者的自我认知与作答时的状态。正如专业人士所指出的,心理测试结果可能仅反映测试者短时状态[2]。当它被用于招聘场景时,求职者有充分动机去"呈现"岗位偏好的那一面——这本身就动摇了筛选的根基。
三、信效度之问:性格测试能预测工作绩效吗?
企业用性格测试筛人,隐含一个假设:人格类型能预测工作绩效。这个假设在学术上远未达成共识。
《心理科学进展》刊发的综述《人员选拔中人格问卷可用性之争》梳理了这一争议脉络。文章指出,个性调查问卷旨在通过一系列专门设计问题的施测结果来预测候选人的工作绩效,但以往研究由于对工作绩效内涵及对应参照效标的界定、问题设计的逻辑基础等方面存在各自局限,一直以来对个性调查问卷的有效性存在分歧[18]。该文提出,应从平衡计分卡四个维度定义工作绩效参照效标,采用内嵌并纵贯模式跟踪候选人工作绩效参照效标,作为检验并提升个性调查问卷预测效度值得探索的研究方向[18]。
换言之,争议的根源不只是"问卷准不准",更在于"我们用什么标准衡量绩效、又用什么方法验证预测"。若企业用性格测试筛人时缺乏清晰的绩效效标和纵向追踪数据,其所谓"有效"可能只是经验直觉。
SHRM专家Whitney Martin在2018年人才大会上指出,心理能力测验是"工作绩效的单一最佳预测指标",并强调使用测评前应先明确目的,提出"四个V"原则帮助理解如何整合与业务目标相关的测评数据[1]。这一立场来自测评策略咨询的一线实践,值得企业管理者重视。
四、测量学视角:国内人格测验的信度现实
即便退一步,假设企业只是想把性格测试当作参考,也需要面对测量学层面的现实约束。
一项对1994至2013年间国内大五人格测验研究文献的信度概化分析显示:检索到的文献中约68.15%存在"信度引入"现象(指在研究中引入信度系数的方式可能影响元分析结果的准确性);未加权估计中,A(宜人性)和O(开放性)的均值最低,N(神经质)和C(尽责性)的均值最高,国内所得结果均略低于国外(O除外);采用α系数效果量方法,在随机效应模型中,N的估计值最高,O和A的估计值最低[17]。回归分析还显示,分数均值、量表来源和南北地域差异是N维度信度的预测变量,量表来源、文章专业类型、测验版本和测验记分对E(外向性)维度信度具有预测作用[17]。
这项研究为MBTI等同类人格测验的中国化应用提供了重要参照[17]。它提示我们:人格测验的信度并非一个固定常数,而是会随量表来源、样本地域、施测版本等因素波动。企业若直接套用未经本土化验证的量表,测量误差可能远超预期。
值得注意的是,人格分类研究本身也在向计算化方向演进。有硕士论文以Kaggle MBTI人格类型数据集为例,采用基于Transformer架构的深度学习分类器进行人格类型预测,并指出:该数据集资料多源自人格讨论社群,文本中可能直接出现MBTI类型、人格维度的缩写或认知功能等词汇,若未处理,模型可能依赖显性标签线索进行分类,造成标签泄漏并高估模型效能[4]。需要说明的是,该研究为硕士论文,其结论的适用范围有限。另一项针对九型人格的研究则尝试利用语言特征和表情符号提升分类效率,结果显示表情符号和语言特征在跨源性格侦测中比词袋功能更稳定、更泛化[15]。
这些研究揭示了一个共同的方法论警示:当文本中本身就含有类型标签时,分类器的高准确率可能源于标签泄漏而非真实预测能力。这提示我们,在招聘场景中,若求职者了解岗位偏好,其作答也可能受到社会赞许性影响,从而影响测评效度。
五、合规红线:性格测试作为筛选工具的法律风险
除了科学性问题,性格测试用于招聘还牵涉法律合规。
美国平等就业机会委员会(EEOC)的技术援助文件明确指出,雇主常使用测试和其他选拔程序来筛选求职者和晋升候选人,测试类型包括认知测试、性格测试、体检、信用检查和犯罪背景调查等[5]。这些工具可以是确定谁最合格的有效手段,但如果雇主故意用它们基于种族、肤色、性别、国籍、宗教、残疾或年龄(40岁及以上)进行歧视,就违反了联邦反歧视法;即便非故意,若测试产生不成比例的排斥效果(disproportionate impact),同样可能违法[5]。
这一框架对国内企业同样有借鉴意义。据媒体报道,有网友称这种测试成了就业歧视的"新马甲"[2]。专业人士的观点是,如果用人单位能够证明这种测试是基于合理的工作需求或岗位特性,且测试过程合法、公正、透明,就不涉及就业歧视问题[2]。同时,考察求职者是否适合岗位应多角度进行,心理测试结果可能仅反映测试者短时状态,企业招聘时不宜将其作为决定因素[2]。
六、专业判断:性格测试在招聘中的合理位置
综合上述资料,从人才测评的专业角度看,可以给出几点务实判断。
第一,区分"参考"与"决策"。 SHRM专家Martin强调,使用测评前应先明确目的,通过"四个V"原则帮助理解如何整合与业务目标相关的测评数据[1]。这意味着性格测试可以用于团队配置、沟通风格研讨、发展性反馈等场景,但不应作为录用的决定性门槛。
第二,警惕单一工具的过度外推。 陈祉妍教授的观点值得反复引用:任何测试都是有局限性的,MBTI测试可以帮我们更好地了解人的性格特征,但不能仅以单一的测试结果就推断一个人的心理特征;要想真正考察一个人,必须用多种方法、从多个角度来考察,再用心理测试结果进行辅助分析,这样才可能得出一个比较可靠、客观的结果[3]。
第三,关注效标与追踪。 学术综述已指出,人格问卷有效性之争的根源在于工作绩效参照效标的界定,改进方向是基于平衡计分卡四维度定义绩效效标并纵向追踪[18]。企业若真想让测评产生价值,与其纠结用MBTI还是大五,不如先建立清晰的绩效数据和追踪机制。
第四,把合规前置。 EEOC的框架提醒我们,测试的使用方式可能触发反歧视审查[5]。企业在设计筛选规则时,应评估测试结果与岗位要求的实质关联性,避免"类型不符即淘汰"的粗暴逻辑。
需要坦诚说明的是,公开资料中缺乏企业使用MBTI筛人的一手追踪数据,因此本文无法就"某企业用MBTI筛人后的实际绩效表现"给出实证结论。上述判断更多是基于测量学原理、学术综述与合规框架的机制分析,而非对具体企业案例的验证。这本身也说明:这个领域最缺的,恰恰是严谨的效度证据。
性格测试可以是认识自我的一面镜子,但把它当成筛人的一把尺子,恐怕既量不准人,也量不准岗位。