公司在选AI测评系统的时候,厂商demo里总有一个环节让人印象深刻:候选人在系统里做完一套测评,AI自动生成匹配报告,附上"强烈推荐"“谨慎推荐"“不推荐"三个档位的录用建议。看起来清晰、高效、无偏见。
但系统真正上线三个月后,我留意到一个耐人寻味的现象——几乎所有HR都会打开AI给出的录用建议页面,但几乎没有一个人会直接按它做最终决定。大家会参考分数,会拿报告跟面试印象做对比,会在心里嘀咕"系统说不推荐这个人,但我面试感觉还不错”——最后拍板的,还是人自己。
嘴上说相信技术,到了做决定的时候,身体却很诚实。
这种犹豫不是因为AI不准
先说清楚一件事:我不是在否定AI测评的价值。
过去两年我持续跟踪过几家头部AI测评工具的实际落地效果。从数据上看,AI测评在预测候选人与岗位的基础匹配度方面,准确率确实在逐年提升。认知能力测试、行为倾向分析、压力情境反应——这些AI擅长的评估维度,和传统人工判断相比,标准更统一、受面试官主观偏好的干扰更少。
一家我们服务过的零售企业,去年在区域经理的招聘中引入了AI测评作为初筛环节。上线六个月后,HR团队的反馈是:AI帮他们筛掉了大约30%明显不适合的人选,招聘漏斗前端的效率提升非常直接。
但"效率提升明显"和"可以直接做录用决定"是两回事。前者AI能胜任,后者我建议你慎重。
AI测评结果在什么情况下容易失真
在和几十位HR同行聊过之后,我发现大家不敢直接用AI测评结果拍板,不是出于对技术的不信任,而是因为在实际操作中见过太多翻车的情况。
第一种情况:测评测的是候选人的"最佳状态”,但工作是"日常状态"。
一个人在安静的环境里对着屏幕完成一套测评,和他在真实的团队协作、跨部门扯皮、项目延期压力下展现出来的行为,中间可以差出好几个量级。我之前在分析测评数据和实际表现对不上的问题时提过这个核心矛盾——测评工具只能采样人在受控条件下的反应,而工作中真正考验人的都是失控场景。
第二种情况:AI匹配模型依赖历史数据,但历史数据不一定代表未来。
AI测评的推荐算法本质上是基于已有数据做模式匹配——过去在这个岗位上做得好的人有某些共同特征,所以候选人的特征越接近就越"匹配"。这个逻辑在稳定业务、成熟岗位上行得通,但如果岗位本身在变化,或者团队即将进入一个新的业务阶段,用历史数据训练出来的模型反而可能选出"适合过去但不适合未来"的人。
第三种情况:测评数据没法捕捉团队化学反应的变量。
这一点往往是管理者最纠结的地方。两个人在AI测评上的得分一样、特质相似,放进不同的团队可能产生完全不同的效果。A团队需要一个打破常规的人来激活氛围,B团队需要一个稳定的执行者来保证交付——同一个人换两个团队,结果一个被评价为"贡献突出",另一个被说成"不合群"。AI测评不会告诉你这个人的风格和你现有团队是互补还是冲突。
一个真实的决策困局
去年底我和一家科技公司的HRD有过一次挺深的讨论。他们用了一套比较成熟的AI测评系统做技术岗的初筛,系统给一位候选人的评分很高——认知能力、学习能力、逻辑推理三个关键维度全部处于前15%。按照AI的推荐级别,应该是"强烈推荐录用"。
但技术负责人在面试后的反馈是:这人技术上没问题,但沟通风格太硬,和团队现有的协作氛围明显不搭。技术负责人建议再考虑看看。
HRD陷入一个两难——信AI,候选人确实聪明,技术底子好;信面试官的直觉,对方说团队氛围可能会被破坏。两边都有道理,两边都有风险。
最后他们的决定是:录用,但放在一个独立项目组,不直接嵌入现有团队。结果半年后复盘,这个选择是对的——候选人确实在独立项目的技术攻关上表现突出,但和主团队的协作问题也印证了面试官的判断。
这个案例说明一件事:AI测评的结论和面试官的判断,不是谁对谁错的问题,而是它们在回答不同层面的问题。AI回答的是"这个人和岗位的匹配度",面试官判断的是"这个人和我们一起工作的适配度"。
录用决策的本质是一个综合判断
我和很多HR聊过的共识是:面试和测评各自有不可替代的边界,最好的选人方式是把两套信号结合起来看。AI测评适合回答"可不可以做"——候选人的底层能力、认知水平、行为倾向是否符合岗位要求。而人的判断适合回答"适不适合一起做"——团队氛围、管理风格、组织发展阶段这些变量,当前还没有算法能建模。
在实际操作中,我建议把AI测评结果放在这样一个位置:它是一个重要的参考维度,但不应该成为录用决策的唯一或决定性依据。换句话说,如果AI给出了"不推荐",但面试官强烈认为这个人值得给机会——我会优先相信面试官的判断,然后把AI指出的风险点作为试用期重点观察的方向。
反过来也一样。AI给了高分,面试交流中隐约觉得哪里不对——那就去追问,而不是用AI的评分说服自己忽略直觉。
录用的最终责任在哪里,决策权就应该在哪里
技术工具进步的速度确实很快,也许再过两三年,AI测评在预测团队适配度、组织匹配度方面的能力会有质的提升。但在那之前,录用一个候选人的最终决定权,我认为还是应该交给对这个决定负责的人——业务负责人、HR、面试官组成的决策小组。
不是因为人的判断永远比AI更准,而是因为录错一个人,承担后果的是业务团队和管理者,不是算法。
AI测评是一个越来越好的帮手,但它还不到可以独立做决定的时候。