简要概述
为小型企业打造的完整工作流程,涵盖岗位定义到结果评估。
如何使用本实用指南
本指南将实际评估流程分为五章:明确招聘决策、收集技能证据、理解推理测试分数、审查筛选结果,以及设计客服任务。每章分别讨论一项不同的决策。首次准备评估流程时,请按顺序阅读;需要重温某个部分时,可以查阅目录。
从一个真实的职位空缺和一份空白的决策记录开始。写明岗位名称、最重要的三项任务、每项任务所需的评估依据,以及负责审核的人。不要一开始就加入所有可用的测评。与其因为软件支持就安排一大堆测评,不如选择规模更小、目标明确的测评,这样更容易说明、维护和改进。
这些章节摘编自 HireValid 编辑内容库,并经过编辑;每章开头都附有相关内容的链接。我们将它们汇集于此,方便小型团队在同一处逐步完成整个流程。所有示例均为假设情境。本草稿尚未经过具名专家或法律审核。它不是经过验证的人员选拔程序,也不保证符合相关要求。
在工作过程中保留三份记录:候选人说明、审核评分标准和变更记录。候选人说明介绍测试体验,评分标准说明如何评估证据,变更记录说明下次流程为何有所不同。这些记录不必很复杂,但应足够具体,让同事无需依赖你的记忆也能了解整个流程。
邀请候选人前,请确认每项测试都与岗位相符,并准备好隐私声明和审核流程。HireValid 的题库目录列出了每项测试及其时长,网站上的样题则让候选人和雇主可以先熟悉题型。审核流程和最终决定由雇主负责。
第 1 章:小企业如何开展招聘前测评
改编自小型企业如何开展入职前测试。
从一个招聘决策开始
小型企业不需要复杂的测评方案,也能开始收集更有价值的证据。首先要明确回答一个范围更小的问题:新员工必须会做什么?用什么方式可以证明他具备这项能力?从当前正在招聘的岗位开始。不要先购买一整套题库,再设法尽可能多地使用其中的内容。
用日常语言写明工作内容。办公室行政人员可能需要核对订单、协调日程并回答常见问题。客服人员可能需要解读政策、找出缺失信息并撰写有帮助的回复。与“聪明”“善于沟通”或“符合团队文化”等宽泛标签相比,这些任务更适合作为评估的起点。这些标签会掩盖你需要观察的具体行为。
选出三到四项必要要求,并将它们与新员工可以学习的内容区分开来。熟悉某款软件可能可以通过培训掌握,而仔细核对信息的能力从第一周起就可能很重要。这样区分有助于避免仅仅因为候选人没有在完全相同的环境中工作过,就排除有能力的人选。也能让你更清楚地解释每个评估环节的目的。
让评估依据与岗位要求相匹配
不同方法回答的问题各不相同。推理测试可以展现一个人如何处理陌生信息。工作样本可以展示他们如何在类似实际工作的任务中运用技能。结构化面试可以了解他们的决策方式、沟通能力和过往经验。任何一种方法都无法单独提供完整的情况,增加更多评估方法也不能保证覆盖面有效。
针对每项要求,明确你希望看到什么证据。如果准确性很重要,可以请候选人比较两份简短记录,并解释其中的差异。如果客户沟通很重要,可以提供一项政策,让候选人据此撰写回复。如果优先级判断很重要,可以提供几项彼此冲突的请求及其截止时间,并给出足够的背景信息,让候选人判断合理的处理顺序。任务应与实际工作相似,但不能变成无偿的商业产出。
注重细节测试展示的是一项具体技能,并不声称能够预测行政工作表现的各个方面。你可以将它与一项简短的岗位相关任务,以及一次关于检查工作的交流结合起来。这样能获得互为补充的证据,而不是通过多项测试反复考查同一技能,并误把重复考查当成更有把握。
让第一项测评简短一些
耗时较长的评估会给应聘者和评估人员带来负担。增加测试前,先问问它能提供哪些与决策相关的新信息。如果答案不明确,就先不要把它纳入第一版评估。之后可以针对具体疑问进一步了解,而不必一开始就要求所有人完成每一种测试。
时长应与测评目的和候选人所处的招聘阶段相符。面试前进行简短的初步测评或许是合理的。如果雇主没有明确表明承诺,却要求候选人完成一项耗时较长的任务,可能会让人觉得不成比例。应如实说明预计用时,包括阅读说明和练习所需的时间。标注“十分钟”却需要花二十分钟进行准备,会削弱信任。
可以先从岗位测试组合开始,再根据需要进行调整。通用组合无法了解你的具体职责、语言需求或无障碍要求。删除与实际工作任务无关的内容。如果题库中没有测试能评估你需要的技能,不要勉强用其他测试替代,而应改用简短的工作样本。
要求候选人完成任务前,先说明流程
邀请中应说明评估的目的、大致所需时间,以及接下来的流程。注明截止时间和时区。说明允许使用的工具、设备要求和任何监控安排。提供咨询问题和申请便利措施的联系方式。不要让候选人开始后才发现需要使用摄像头,或遇到意料之外的限时环节。
一份实用的测试邀请可以说明,测试内容包括书面客户沟通和核对订单详情,之后会为进入候选名单的人安排结构化面试。邀请中还可以说明雇主会审核答案,且分数不会作为唯一的决定依据。不要承诺团队无法确保的反馈日期。如果时间安排有变,请及时清楚地告知候选人。
发送邀请时,也可以减少候选人本可避免的焦虑。请告知他们练习题是否计分、能否返回之前的题目,以及网络连接中断时该怎么办。当人们需要在陌生的环境中作答时,这些细节并非无关紧要。尊重候选人的流程可以减少意外干扰,让测评结果更容易解读。
第 2 章:没有人力资源团队,也能开启技能导向招聘
用实用的任务清单取代模糊的候选人画像
基于技能的招聘应从工作本身出发,而不是给同一份招聘广告换个说法。如果小型企业在没有说明岗位职责的情况下,要求应聘者拥有学位、数年工作经验和熟悉的职位头衔,那么筛选的可能是背景,而非能力。有些资质确实必不可少,另一些则只是沿用旧模板形成的习惯。请逐项审视要求,不要想当然地认为每项要求都必须保留。
设想您要招聘一名办公室行政人员。先列出具体工作:核对订单记录、协调共享日历、处理日常请求,以及标记异常情况。然后判断哪些工作要求新员工入职时就能独立胜任,哪些可以通过培训掌握。这样得出的岗位画像会比“有条理、积极主动且沟通能力出色”更实用,也更便于之后准备面试。
实用的任务清单应写明要做什么、针对什么对象,以及达到什么标准。“将每日订单录入内容与原始记录核对,并上报无法解释的差异”比“注重细节”能让候选人了解更多。写出这样的句子不需要一套冗长的胜任力框架。熟悉这项工作的人可以先起草,再请同事确认内容是否符合实际岗位。
区分必要条件和优先条件
必备要求应当与岗位有合理且站得住脚的关联。某项偏好或许能让新人更容易上手,但不应在不知不觉中变成筛选标准。请将两者分开列出。如果团队可以培训某款软件的操作界面,请说明有同类经验者也可应聘。如果岗位要求具备法律资质,请明确说明,并通过适当流程进行核实。
对于听起来中性、实际却可能含义模糊的替代性要求,应谨慎处理。“以英语为母语”“年轻有活力”或“完美契合企业文化”等说法,可能会模糊岗位真正需要的能力,也可能引发公平性问题。应改为描述沟通任务、工作条件和可观察到的行为。请根据所在地的规定,就招聘用语征求适当建议,尤其是在相关要求可能排除受保护群体的情况下。
职位描述模板提供了带占位符的结构框架,但不了解你的薪酬、工作时间或当地的相关义务。请替换所有占位符,并删除不适用的内容。模板的价值在于启发思考,而不是让雇主不加审视地发布一份要求清单。
为每项主要技能选择一种直接考察方式
针对每项基本要求,想一想候选人能在合理的时间内展示什么。一项简短的记录核对练习,可以看出候选人如何处理信息不一致的情况。一个日程安排场景,可以看出他们是否注意到各项任务之间的依赖关系,以及能否提出有用的问题。一段简短的书面回复,可以看出表达是否清晰、语气是否得当。测试任务应与实际工作相似,但不应要求候选人提供机密信息或完成耗时很长的无偿项目。
使用模拟数据和明确虚构的情境。不要让候选人解决贵公司可以用于商业用途的真实客户问题。提供充分的背景信息,确保从未在贵公司工作过的人也能公平地完成任务。解释流程中特有的术语。隐藏信息考查的是熟悉程度,而不是预期的技能。
通用测评可以补充工作样本,但不能仅仅因为它能轻松得出一个数字,就让它主导整个流程。Office Administrator 测评组合列出了一些相关领域。请对照工作任务清单,检查其涵盖范围。如果建议的测评组合超出了做出决定所需的范围,可以删减测试,不要把默认组合当作必选项。
开始评估前,先制定一份简明的评分指南
评分标准能把主观印象转化为一系列围绕证据的问题。对于记录核对练习,可以考察候选人是否找出了重要的不一致之处、避免凭空编造更正内容,以及说明了下一步怎么做。对于日程安排任务,可以考察他们是否识别出各种限制,并说明时间冲突。各个评估维度应有足够的区分度,让评审人员能够清楚说明评分依据。
使用通俗的描述来说明各评分等级。中等等级可以表示回答大体正确,但遗漏了一项重要检查。较高等级可以要求工作准确,并清楚说明不确定之处。避免只写“优秀”之类的标签,却不说明优秀在哪里。这样的标签只会让人更有信心,却无法帮助评分者一致地使用评分标准。
在用评分标准评估候选人之前,先用两三个虚构答案试一试。看看两位评审者是否能识别出相似的证据,以及意见分歧是否反映出表述含糊。这是一项校准练习,不是效度研究。其目的是让流程更易理解,并在影响真实候选人之前减少可避免的不一致。
第 3 章:认知能力测验:测什么以及如何使用
了解推理测评所回答的问题
认知能力测试旨在收集有关推理、学习或解决陌生问题能力的证据。根据测试设计,题目可能包含数字信息、书面短文、视觉图形,或多种题型的组合。测试结果反映的是一个人在特定条件下完成这些任务的表现,并不能全面衡量一个人的潜力、性格或对所有岗位的适合程度。
这一区别很重要,因为单一分数看起来可能比实际情况更全面。一位候选人可能擅长视觉形式的推理,却觉得语言内容较多的形式很难。另一位候选人可能理解问题,但在严格限时下速度较慢。应结合岗位要求来解读这些差异,而不是草率地断定谁“最聪明”。
首先要问,为什么招聘流程中需要这类证据。如果工作涉及学习新系统、解读陌生信息或比较选项,那么推理能力可能与岗位相关。请记录这种关联。如果仅仅因为其他雇主使用这项测试就把它纳入流程,您还没有说明它的用途。一个耳熟能详的测评名称不能代替岗位分析。
区分推理能力和岗位知识
推理任务和知识测试衡量的是不同方面。一个人可能因为多年使用某款应用而熟悉电子表格快捷键,也可能能通过查阅文档摸索出新的公式。两种能力都可能重要,但不能互相替代。请判断哪些能力是入职后立即需要的,哪些可以通过入职培训培养。
对于初级分析师,一道数理推理题或许能看出他们是否能正确理解百分比。SQL 任务或许能看出他们是否会筛选行,或是否理解联接的逻辑。一段简短的工作样例或许能看出他们是否会在解释结果前检查缺失值。每种方法都有明确用途时,它们可以相互补充。如果多个版本只是反复考查同样的熟悉程度,就会显得重复。
通用认知能力测试涵盖多个推理领域。测试页面上的示例题展示了题目的形式;任何单项分数都应只作为一项参考证据。初级数据分析师测试组合展示了如何将推理能力与岗位相关的技术技能一并考查。雇主仍需判断这一建议的组合是否符合实际工作要求。
谨慎解读百分位数
百分位数描述的是一个人在参照群体中的相对位置。按照相关评分规则,结果位于第 75 百分位,表示分数高于该记录群体中 75% 的人。这不代表答对了 75% 的题目,也不代表胜任该岗位的概率为 75%。这些是不同的指标,需要不同的证据来衡量。
务必了解常模群体、样本量、数据收集方法和版本。以广泛在职人群为参考,与以某个具体岗位的求职者群体为参考,回答的可能是不同问题。如果参考样本量较小或匹配度不佳,看似精确的百分位数可能会产生误导。报告应说明这些局限,而不是用看似肯定的图表将其掩盖。
比较不同测试版本的分数时也需要谨慎。题目、时限或评分方式的变化可能会影响分数的解读。一份实用的报告会记录候选人作答时使用的版本。日后更新常模时,早期报告仍应便于理解。HireValid 的基准页面介绍了评分说明文档,包括百分位数如何标明其参照群体和版本。
检查语言和时间要求
即使一道推理题被标为数理题,也可能包含大量阅读内容。复杂的措辞可能会把一道解读表格的题变成高级语言能力测试。请检查说明和题目文本,去掉不必要的复杂表达。如果工作要求的是日常职场沟通,评估中也应尽可能使用日常职场用语。
时间限制也会影响所观察的技能。严格的时限可能更侧重处理速度、对题目形式的熟悉程度或在压力下保持镇定的能力。在某些情境下,这些因素可能与岗位相关,但不应想当然地认为如此。请提前告知候选人时限,并说明是否可以练习。应考虑提供适当的便利安排,而不是认为同一时限对所有人都天然公平。
视觉推理并非天然不存在障碍。图形过小、对比度低或依赖颜色,都可能使任务无法被某些人使用。阅读量较少并不意味着内容不存在文化偏见,也不代表人人都能使用。应根据各形式本身的特点进行评估。关键在于,这项任务是否为目标人群提供了恰当的方式来展示相关技能。
第 4 章:为小型雇主解读五分之四规则
改编自为小型雇主解读五分之四规则。
这项规则比较的是什么?
四分之五规则用于比较不同群体的甄选率。甄选率是某一特定群体在特定阶段被选中的人数,除以该阶段纳入考虑的人数。筛选比率是某个群体的甄选率除以甄选率最高群体的甄选率。比率低于 0.80 可能提示存在值得调查的差异。但仅凭这一比率,无法解释差异产生的原因,也不能判断甄选流程是否合法。
区分风险提示和结论至关重要。仪表板上的比例看起来可能很权威,因为计算结果十分精确,但解读起来要复杂得多。你需要了解相关人群、招聘阶段、样本量、数据质量,以及甄选方法是否适用。比例高于阈值并不代表流程公平,低于阈值也不能作为完整的法律结论。
The U.S. EEOC guidance on employment tests and selection procedures is a primary source for the broader legal context of employment testing. This article is an educational explanation of a screening calculation. It does not replace advice about a particular employer, jurisdiction or hiring decision.
通过假设示例逐步分析
假设一个定义明确的测评环节包含两个虚构群体。A 组有 40 名申请者,其中 20 人进入下一轮,录取率为 50%。B 组有 20 名申请者,其中 8 人进入下一轮,录取率为 40%。用 40% 除以 50%,结果为 0.80,即 80%。这个例子恰好达到常见的筛选阈值。这些数字是为说明问题而编造的,并非 HireValid 客户的实际结果。
现在假设 B 组的 20 名申请者中只有 6 人进入下一轮,其通过率为 30%。用 30% 除以 50%,结果为 0.60。这个比率低于五分之四,应当进一步审查。不过,这项计算仍无法确定差异是由测试、前期筛选环节、评审做法不一致、数据缺失还是其他因素造成的。
确保分母和招聘阶段保持一致。如果一个群体的分母包括所有申请者,而另一个群体的分母只包括完成测试的人,那么两者的比较衡量的就不是同一件事。明确标注统计人群和时间段。一份有用的报告应让审核者了解每个数字的来源,而不是只显示没有底层数据支持的比率。
为什么要谨慎看待小样本
在小规模招聘中,一个人的结果就可能大幅改变某项比率。如果一个群体有五个人,其中一个人的结果发生变化,录用率就会相差 20 个百分点。这并不意味着这个人的经历不重要,而是说明这个数字不稳定,脱离背景信息不应据此得出宽泛结论。审慎的评估会将不确定性视为结果的一部分。
不要仅仅为了扩大样本量,就把无关的岗位或时期合并起来。不同岗位的要求和筛选阶段可能不同。合并数据可能掩盖重要差异,也可能造成误导。如果汇总数据,请说明这些人群和流程为何具有可比性。应确保获得适当授权的审核人员可以查看底层明细。
没有申请者的群体,或没有任何人被选中的对照组,也可能导致比率无法定义或缺乏参考意义。软件不应悄悄将这些情况转换成零、通过标记或确定无疑的警告。应显示实际人数,并说明该比率无法按通常方式解读。清楚说明限制,比展示整齐却容易误导的状态标签更有用。
保护用于分析的信息
人口统计信息可能涉及敏感内容。请判断收集这些信息是否合适且合法,说明参与方式,并明确谁可以查看结果。自愿填写的回复可能不完整,缺失数据也会影响解读。不要仅仅为了填充图表,就根据姓名、照片或其他替代信息推断受保护特征。这会带来额外风险,也可能降低分析结果的可信度。
HireValid 的公平性报告使用自愿且经同意收集的人口统计信息,并将这些信息与候选人的个人成绩分开存储。报告支持汇总分析,不会将人口统计信息与个人测评结果并列展示给招聘经理。
在实施前,明确访问权限、数据保留期限和最低报告条件。即使是汇总表格,也可能让人识别出小群体。审核总体结果的人不一定需要查看每位候选人的敏感信息。法律和隐私审查应针对实际的数据收集与报告流程,而不能仅凭某项功能听起来令人安心的名称作判断。
第 5 章:设计实用的客户服务测评
改编自设计实用的客户服务评估。
从团队实际提供的服务入手
客户服务工作因岗位而异。处理配送问题的人,与支持技术产品或解决账单纠纷的人,需要面对的情境并不相同。设计评估前,应先明确新员工最常遇到的情况,以及他们获准作出的决定。只考查是否友善的通用测试,无法反映岗位实际职责的边界。
写下关键行为,例如倾听对方的诉求、查看相关记录、准确执行政策、说明下一步安排,以及在必要时升级处理。将行为与候选人无法控制的结果区分开来。即使政策不允许退款,客服人员也可能妥善处理了棘手的沟通。评估不应仅仅因为某个承诺听起来讨喜,就奖励违反政策的承诺。
选择少量真实场景即可,不必详尽模拟所有可能的投诉。你需要的是足以支持招聘交流的证据,而不是把评估变成无偿培训。客户支持专员测试组合是一个合适的起点。它是否适用,取决于测试内容是否符合团队的工作和沟通渠道。
为候选人提供足够的背景信息
情境题应说明相关政策、客户的顾虑以及客服人员的权限。如果最佳答案取决于候选人从未接触过的内部规定,这道题考察的就是对组织的熟悉程度,而不是服务判断力。情境应保持简洁,但不要删去作出合理应对所需的信息。
例如,描述一笔延迟的订单、最新的物流跟踪信息和可选的解决方案。说明客服人员是否可以退款,还是必须先申请批准。请候选人说明下一步行动,并简要解释理由。优秀的回复应依据提供的事实,而不是自行编造政策,也不应承诺客服人员无法控制的结果。
避免不必要的情绪渲染。符合现实情况的愤怒客户情境,可以展现候选人如何兼顾同理心与准确性。过于极端或令人难堪的情境,可能测出的只是候选人对测评的适应程度,而不是日常服务工作的表现。措辞应保持尊重,并解释行业专用术语。我们的目标是观察有用的思考能力,而不是让应试者感到意外或难堪。
同时评估同理心与准确性
同理心很重要,但不应被简化为一套规定说法。候选人可以用多种得体的方式体谅客户遇到的不便。评分时,应看回应是否意识到了问题,并且沟通得体。如果另一种清晰、恰当的表达同样有效,就不要要求候选人模仿某位评审偏好的风格。
准确性同样重要。即使语气亲切,如果回复中的政策信息有误,或泄露了其他客户的信息,也算不上优质的服务回应。评分标准应将表达语气与事实准确性分开,让评审者能够识别具体的优势或不足。只凭整体印象评分,可能会掩盖这一区别,让措辞漂亮的回答胜过真正有帮助的回答。
假设有客户投诉被重复扣费。合理的第一步是回应客户的疑虑,并核查账单记录。马上承诺退款听起来可能很热心,但也可能为时过早。尚未调查就让客户去联系其他人,可能解决不了问题。相比候选人是否使用了某句惯用的道歉语,了解其作出选择的理由更有参考价值。
设计一份简短的书面工作样本
书面任务可以展现应聘者如何将决定转化为信息。提供一份简短的政策说明,并请应聘者撰写一段长度适当的回复。说明读者对象和沟通渠道。聊天回复和电子邮件可能需要不同的结构,因此不要把它们当作同一种任务评分。
使用虚构的客户信息。没有合法且适当的依据时,不要泄露真实的客服工单或个人信息。删除新员工通常会在入职培训中了解的公司专属知识。如果工作中通常会用到某项工具或模板,请明确评估时是否允许使用。工具使用规则应与要评估的技能相符。
实用的评分标准可以考查回复是否指出问题、说明正确的下一步、避免作出缺乏依据的承诺,并且通俗易懂。如果需要了解候选人作出某项选择的原因,可以请他们简要说明。任务的规模应与评估目的相称,也不要将候选人的回答用作免费的商业客服内容。
第一轮筛选工作表
发送邀请前,先写一份一页的计划。注明岗位名称,并列出核心任务。针对每项任务,明确你需要哪些证据,以及哪些评估方法可以提供这些证据。标出可在入职培训期间教授的要求,避免它们成为不必要的入职门槛。
接下来,一起拟定邀请内容和评分标准。如果你无法用通俗的语言向候选人解释某项任务,就要检查其目的是否明确。如果评分者无法根据可观察到的细节解释评分,就要修改评分标准。可以找一位不熟悉内部流程的人试读说明。
一轮测评结束后,检查说明是否清晰、预计耗时、便利安排以及评审者之间的分歧。记录计划作出的调整及其原因。结论应保持审慎:第一轮测评可以揭示流程问题,但不足以证明其具有广泛的预测效度。
最终决策问题
- 每个环节是否都对应一项必要的岗位要求?
- 候选人需要投入的总时间是否合理?
- 是否在开始前说明工具、时间安排和监控方式?
- 评审人员能否区分证据与假设?
- 由谁处理问题、便利安排申请和数据请求?
- 本轮招聘结束后,你们会复盘哪些内容?
| 测量内容 | 岗位示例 | 典型时长 | 在 HireValid | |
|---|---|---|---|---|
| 认知能力 | 推理、学习和解决问题的能力 | 大多数岗位,尤其是变化较快的岗位 | 8至12分钟 | 推理能力、批判性思维和注重细节 |
| 岗位技能 | 岗位使用的工具和涉及的任务 | 行政人员、分析师、助理 | 8至15分钟 | Excel、Google Workspace、簿记、文书工作 |
| 语言 | 阅读、语法和书面沟通 | 支持、销售、营销、远程岗位 | 12 分钟 | 英语水平、商务写作 |
| 情境判断 | 真实职场情境中的选择 | 客户服务、销售、团队角色 | 8至10分钟 | 客户服务、销售、时间管理等 |
| 打字与数据录入 | 键盘输入速度和准确性 | 呼叫中心、行政、数据录入 | 5至8分钟 | 打字、数据录入和数字键盘 |
| 编程 | 阅读代码并进行推理 | 初级开发人员和分析师 | 12 分钟 | Python、SQL 和 JavaScript 基础 |
| 性格问卷 | 自述的偏好和风格 | 适用于多种岗位 | 视情况而定 | 未提供 |
| 诚信问卷 | 自述的规则意识和诚信态度 | 零售、现金处理、安保 | 视情况而定 | 未提供 |
| 工作样本 | 一项贴近实际工作的任务 | 大多数岗位,在筛选出候选人后 | 30 至 90 分钟 | 面试阶段模板 |
从不同类型的测试中选择
大多数小型企业不需要为每个岗位使用所有类型的测试,通常两到三种就够了。入职前测试类型指南通过示例介绍了每种测试。一个合理的默认组合是:一项推理测试、一项岗位技能或判断力测试,以及在岗位需要时进行语言或打字测试,总时长约为 20 至 45 分钟。我们的岗位组合以这一模式为基础,适用于 11 种常见岗位;测试库则列出了每项测试的时长和涵盖的技能。
人格和诚信问卷属于另一类测评工具:它们要求候选人描述自己,而不是展示技能。HireValid 不提供这类问卷。如果你使用这类问卷,可以把它作为开启对话的方式,而不是录用门槛,并确认其用途与岗位相关。工作样本很有价值,但耗时较长,因此大多数团队会把它留到候选人筛选阶段;我们的面试模板可以帮助你按照统一标准评分。
认知能力测试页面介绍了推理测试的测量内容,以及如何设定公平的分数线。
了解更多关于招聘测评的信息
AI 时代的就业前测试
AI 改变了简历或居家任务能提供的信息。如今,许多求职申请读起来都同样出色,而 AI 面试助手还能在视频通话期间提供答案建议。因此,简短的限时聘前评估会更有用,而不是更没用:它能提供应聘者在与其他人相同的条件下进行推理和工作的依据。
设计比检测更重要。采用随机题库中的限时题目、注重具体细节的情境题,并在之后围绕应聘者自己的答案进行交流,可以大幅降低外部帮助的作用。切换标签页或答题时间异常等完整性信号可以帮助人工审核结果,但都不能作为证明。雇主 AI 面试作弊工具指南介绍了相关工具和五步流程,完整性页面则说明了 HireValid 的 Integrity Score。
入职前测评的费用
招聘前测试需要花费金钱和候选人的时间,因此两方面都要比较。谈到价格,关键要看招聘频率。许多测评平台按年收费,适合每月都要测试候选人的团队;HireValid 默认按月收费,50 位候选人每月 $49 起。Free 计划每月可测试 5 位候选人,两个招聘周期之间还可选择 $9 的 Pause 计划。
谈到候选人投入的时间,整个招聘前筛选测试应控制在约 30 到 45 分钟。测评时间过长,可能会让有其他录用机会的优秀申请者退出。下方的计算器会根据你的招聘月份和候选人数,将使用 HireValid 一年的费用与一个广泛使用的平台公布的最低年费进行比较;其他平台请查看对比中心。
本周进行首次招聘前测试
每月可免费评估 5 位候选人。选择一个岗位测评组合,然后发送一个链接。
法律与公平性基础知识
任何就业测验都应与岗位相关,并以一致的方式实施。在美国,EEOC 关于就业测验和选拔程序的指南说明,测验不得存在歧视,雇主必须提供合理的便利措施。美国人事管理局指出,大多数评估方法都需要测量方面的专业知识才能有效开发,这也是小企业使用现成测验的原因之一。在英国,CIPD 的选拔方法指南建议采用清晰、客观、结构化的流程来减少偏见。
实际操作中:只测试岗位需要的内容,为所有人提供相同的条件,让候选人可以轻松申请便利措施,并在每轮招聘后检查不同群体的录取率。我们的公平性方法以及词汇表中关于五分之四规则的词条介绍了监测步骤。想了解各国的详细信息,请阅读入职前测验合法吗?。
来源
- 美国 EEOC:就业测试和人员选拔程序,于 2026-10-01 检查
- 美国 OPM:其他评估方法,于 2026-10-02 检查
- CIPD:甄选方法,于 2026-10-02 检查
Integrity Score 较低会导致候选人被淘汰吗?+
不是。诚信信号可能有合理的解释,包括网络连接问题或无障碍需求。作出决定前,应由人工审核相关证据,并与候选人沟通。
候选人需要准备什么?+
你需要使用浏览器并保持网络连接稳定。打字、电子表格和代码任务适用于电脑端。如果雇主启用了摄像头检查,必须明确告知候选人,并提供申请替代方案的途径。
这些分数是官方资质证明吗?+
不是。这些工具用于招聘决策。英语测试结果是与 CEFR 对标的水平估计,并非官方证书。认知能力得分也不是临床 IQ 测试结果。
什么是入职前测评?+
这是申请人在面试或获得录用通知前完成的一项简短、结构化评估,例如推理测试、岗位技能测试或打字测试。每位申请人都在相同条件下回答相同的问题,因此你可以根据实际表现进行比较,而不只看简历。
招聘前测评有哪些例子?+
常见的测试包括认知能力测试、面向客服或销售岗位的情境判断题、Excel 和 Google Workspace 测试、英语和商务写作测试、打字测试,以及面向开发人员的代码阅读测试。实际工作样本(例如一项简短的岗位任务)通常会在后续用于评估入围候选人。
测评没通过,还有机会被录用吗?+
通常是的,雇主应在设计时考虑这一点。单一分数通常不应成为自动淘汰线。只有对岗位真正必需的技能才设置最低分数;应结合面试和工作样本查看测试结果,并在每轮招聘后审查不同群体的通过率。
招聘测评应该进行多长时间?+
对大多数岗位来说,整个评估控制在 30 至 45 分钟是不错的目标。这个时长足以收集可靠的依据,也不会太长,有能力的应聘者通常能完成。HireValid 的每项测试需 5 至 15 分钟,并可组合成岗位测试包。
入职前测验合法吗?+
可以,前提是测试与工作相关、对所有人一致实施,并提供合理便利。在美国,EEOC 关于就业测试的指导介绍了相关基础知识。雇主仍须对自己的决策负责,因此遇到具体法律问题时,请寻求合格专业人士的建议。
招聘测评题目是什么样的?+
题目因测试而异。推理题可能会让你根据两条陈述判断哪项结论必然成立;客服情境题会询问下一步最合适的做法;Excel 题则会询问某个公式的返回结果。我们题库中的每个测试页面都提供一道示例题。