指南

如何防止在线测评作弊(包括使用 AI)

如何防止在线测评作弊,包括使用 AI:明确工具使用规则,设计不易受作弊影响的任务,公平解读诚信信号,并由人工负责决策。

AI 辅助撰写的编辑稿。具名专家审核尚未完成。示例均为假设情形。本文提供实用指导,不构成法律认定。

简短回答

如何防止在线测评作弊,包括使用 AI:明确规定允许使用哪些工具;采用限时较短、题目随机的测试;设计需要候选人自行推理的任务;记录诚信信号,供后续审核,而不是将其视为证明;并通过有条理的后续环节确认技能。没有任何方法能杜绝所有情况,因此每项决定都应由人工负责。

从雇主指南开始

如果您刚开始了解借助 AI 作弊,雇主 AI 面试作弊工具指南会介绍这类工具的主要类别,以及适用于面试和测试的五步流程。如需了解具体工具,请参阅Cluely 是否会被检测到?和Cluely 与 Interview Coder 对比。本实用指南还会介绍如何在实际操作中防止在线测评作弊,并深入探讨测评设计、情境判断和认知能力测试、候选人体验,以及在没有人力资源团队的情况下开展技能型招聘。

示意图:切换标签页、粘贴操作和作答时间等诚信信号用于生成评分,由人员进行审查。开始切换标签页粘贴快速作答完成
诚信信号是供人审核的证据,并非确凿证明。

简要概述

明确允许使用的工具,设计实用的任务,并在调查诚信疑虑时避免夸大结论。

如何使用本实用指南

要设计不易受 AI 影响的测评,首先要明确区分允许使用的工具和你需要考查的独立能力。本指南围绕五项决策展开:设定这些界限、编写实用情境、解读推理能力的证据、尊重候选人体验,以及让整体招聘流程聚焦于实际工作。任何单一的监控功能都无法解决这五个方面的问题。

拿出一项拟采用的测评,对照本指南逐项检查。对于每项任务,写明目的、允许使用的工具和预期证据。然后列出你实际能够观察到的情况,以及这些情况无法支持的结论。这样简单地区分两者,有助于避免把技术层面的观察变成没有依据的指控,也能让给候选人的说明更加具体。

这些章节选编并编辑自 HireValid 内容库,并附有完整文章的链接。它们汇编成一本实施工作手册,并非作为独立研究呈现。所有情境均为假设情境,草稿还需专家审核。营销演示不会采集摄像头数据,也不能证明检测效果已经过验证。

在收集相关信息之前,指定专人审核疑虑。如果没人知道该如何解读详细的事件时间线,也不知道如何中立地追问,那么这份时间线的价值就很有限。事先商定要考虑哪些背景信息、候选人如何解释中断情况,以及在什么情况下,另一份工作样本比进一步监控更有参考价值。采取的措施应与实际岗位和不确定程度相称。

在指南末尾,使用审核工作表检查测评本身及其相关流程。我们的目标不是不加限定地宣称作弊辅助不可能发生,而是在明确告知的条件下收集相关证据,由人工作出决定,并如实说明系统的局限。

第 1 章:如何减少在线测评中对 AI 的依赖

改编自如何减少在线评估中的 AI 辅助。

明确独立完成工作的含义

要减少未经允许的 AI 协助,首先应明确岗位要求,而不是依赖检测工具。有些任务确实要求个人回忆信息、独立推理,或在没有外部帮助的情况下作答。另一些任务通常会借助文档、同事和 AI 工具完成。测评应说明要考察哪种能力。否则,候选人可能只是遵循日常工作习惯,却被雇主视为违反规则。

为每个环节制定简短的工具使用规定。说明是否允许使用搜索工具、计算器、代码补全、翻译工具和生成式 AI。说明候选人是否可以做笔记,以及能否使用电子笔记。对于容易引起疑问的界限,提供具体示例。“你可以使用提供的参考资料,但不能使用外部助手”比“请诚信作答”更有帮助。请在邀请开始计时前向候选人提供这些规定。

有效的流程可以同时包含独立完成和借助资源完成的任务。例如,初级开发人员可以先独立讲解一个小函数,再在另一项调试练习中使用文档。第二项练习可以考查他们如何验证建议的解决方案。这样区分任务有助于解读评估证据,也避免让人误以为现实中的每项工作都需要独立完成。

设计能展现思考过程的任务

如果一个任务可以用一段泛泛的文字回答,就很难判断候选人的实际能力。向候选人提供具体信息,并请他们据此做出决定。对于客服岗位,可以提供简短的订单记录和退货政策,并要求候选人说明下一步行动及简要理由。对于分析师岗位,可以提供一张包含一个含义不明确数值的小表格,并询问在分享结论之前需要核实什么。

目的不是把题目设计得晦涩难懂。候选人应当获得足够的信息,以便给出有理有据的答案。这项任务的价值在于证据与决策之间的关联。优秀的回答会找出相关事实,承认信息不足之处,并说明适当的下一步行动。如果回答虽然流畅,却忽略了给出的事实,即使不借助 AI 检测工具,也更容易发现其中的问题。

随机抽取题目可以减少重复接触同一题目的情况,但随机化并不能自动确保不同版本等效。各个版本仍需在考查范围和难度上保持可比。为每道题设置时间限制可以限制外部帮助,但也会把速度纳入测量。只有在适当时才使用这种限制,并保留提供合理便利的流程。评估不应变成让候选人在原因不明的压力下惊慌失措的测试。

将浏览器信号作为参考背景

浏览器可以观察到某些事件,例如页面失去焦点或收到粘贴的文本,但无法可靠地了解应聘者周围发生的一切。第二台设备可能无法被发现。屏幕覆盖层可能不会产生可检测的事件。焦点变化也可能是由密码管理器、操作系统消息或辅助功能工具引起的。在介绍产品和解读结果时,应考虑这些技术限制。

因此,诚信报告应先描述观察到的情况,再说明它可能意味着什么。“测评页面有 12 秒未处于焦点状态”比“候选人使用了 AI”更具体。前者可以核查和讨论,后者则得出了仅凭这一事件无法支持的结论。作答时间规律和答案相似之处也需要结合具体情况判断,不应自动据此指责候选人。

HireValid 诚信评估方案综合多种信号,并由人员作出决定。网站演示中使用的是示意性权重,并不代表经过验证的检测效果,也不会监控你的浏览器活动。在实际应用某项规则之前,团队需要了解它衡量的内容、无辜行为触发该规则的频率,以及审核人员会收到怎样的说明。

在不作指责的情况下核查疑虑

设想一名候选人将一段文字粘贴到书面回答中。这种情况可能有多种解释:候选人先在别处起草了内容、使用了辅助工具、复制了外部答案,或误解了规则。首先查看候选人收到的说明。如果政策允许在单独的文档中起草,那么这一操作并不能证明候选人违反了政策。如果规则不够明确,最重要的做法可能是改进说明。

中立的后续提问可以请候选人说明自己的思路,以及如何准备答案。与其直接问候选人是否作弊,不如简短讨论实际内容,这样可能更有参考价值。对于技术任务,可以问为什么要设置某个条件,或者输入不同的内容会发生什么。提问应与岗位相关,并且与对其他候选人的流程保持一致,便于比较。

记录观察到的情况、适用规则、相关说明以及审查过的证据。不要在缺乏依据的情况下认定候选人不诚实。如果你认为证据仍不充分,应采用其他适度的测评环节,而不是臆断结论。招聘记录应区分尚未解决的疑虑,与候选人确实未遵守已明确告知的指示这两种情况。

第 2 章:情境判断测验:示例与最佳实践

改编自情境判断测试:示例与最佳实践。

怎样的情境题才有用?

情境判断测试会呈现一个场景,并要求候选人选择、排序或解释可能的应对方式。测试是否有用,取决于情境设计的质量以及评分背后的依据。仅有一个可信的故事还不够。题目需要有明确的目的、充分的背景信息,并且应对方式与实际工作之间要有合理、可解释的关联。

从岗位中实际会遇到的决策情境入手。销售代表可能需要弄清客户提出的异议;行政人员可能需要确定相互冲突的请求的处理优先级;团队成员可能需要回应反馈。明确你想考察的行为,以及做出决策的人能够获得哪些信息。不要先写好答案,再编造一个让这个答案显得理所当然的故事。

这种题型用于收集信息,并非诊断性格。一个人对某个假设情境的回答,并不能证明他们在所有工作场所都会如何行事。回答可以帮助组织后续交流,并了解候选人注意到了哪些方面。解读时应以具体情境为依据,同时考虑其他合理答案以及证据本身的局限。

示例一:客户对价格提出异议

假设一位潜在客户告诉初级销售代表,所提议的服务太贵了。销售代表还没有弄清客户期望的结果或当前的工作流程。一个有用的问题是:接下来该怎么做?一种做法可能是施压,要求客户立即签约。另一种做法可能是询问,达到什么结果才会让这笔投资物有所值。第三种做法可能是擅自提供折扣。

第二种回答是合理的,因为它会先收集相关信息,再判断这项提议是否合适。它并不保证成交,评估也不应暗示这一点。关键在于下一步处理得是否妥当:应弄清价值和限制,而不是猜测客户的异议,或承诺超出销售代表权限的事项。

后续问题可以询问哪些信息会改变候选人的做法。这样可以看出他们能否根据具体情境灵活运用原则。如果潜在客户已经说明预算上限很严格,重复提出笼统的需求了解问题可能不太有用。好的情境设计会纳入影响选择的关键信息,而不是奖励背熟销售话术的人。

示例二:截止日期冲突

一名行政人员同时接到两项必须按时完成的请求,却无法兼顾。情境应说明未完成任务的后果、任务之间的依赖关系,以及其可行使的权限。缺少这些信息时,“先做最重要的任务”只是在重复问题本身。恰当的应对方式可能是说明任务冲突,并与相关负责人商定优先顺序,而不是默默错过截止时间。

询问候选人会如何沟通。他们是否会指出能力或资源限制、提出可选方案,并明确说明需要作出的取舍?他们是否会确认能否提前完成部分工作或重新分配任务?回答应体现出切实可行的应对方法,而不是声称出色的时间管理能让所有冲突都消失。

如果情境允许,评分应接受不止一种合理的处理顺序。候选人可以先确认依赖事项,也可以先通知提出请求的人。应评估其判断依据和选择带来的结果。答案标准如果过于狭窄,可能会因为合理判断不同于出题者偏好的行动顺序而给候选人不公正的低评价。

示例三:棘手的反馈

一位同事收到反馈后似乎有些难过。职场判断题可能会询问你该如何回应。提出私下聊一聊,并询问对方如何理解这份反馈,可能比认定对方无法接受批评,或在整个团队面前讨论其反应更有建设性。这里的考量是尊重、隐私和相互理解,而不是对任何人的情绪作出诊断。

情境应符合候选人的岗位职责。同事和经理的职责可能不同。如果题目没有说明双方的关系,那么多个答案都可能有道理。不要根据题目未说明的职权或保密要求来给候选人评分。补充必要的背景信息,让判断有据可依。

这类任务不应被宣传为临床测评。情商测试围绕职场情境设计,不用于诊断心理健康状况,也不用于判定一个人的整体性格。可将回答作为相关讨论的依据,但不要仅凭少量假设性选择就得出宽泛结论。

第 3 章:认知能力测验:测什么以及如何使用

改编自认知能力测试:测量什么以及如何使用。

了解推理测评所回答的问题

认知能力测试旨在收集有关推理、学习或解决陌生问题能力的证据。根据测试设计,题目可能包含数字信息、书面短文、视觉图形,或多种题型的组合。测试结果反映的是一个人在特定条件下完成这些任务的表现,并不能全面衡量一个人的潜力、性格或对所有岗位的适合程度。

这一区别很重要,因为单一分数看起来可能比实际情况更全面。一位候选人可能擅长视觉形式的推理,却觉得语言内容较多的形式很难。另一位候选人可能理解问题,但在严格限时下速度较慢。应结合岗位要求来解读这些差异,而不是草率地断定谁“最聪明”。

首先要问,为什么招聘流程中需要这类证据。如果工作涉及学习新系统、解读陌生信息或比较选项,那么推理能力可能与岗位相关。请记录这种关联。如果仅仅因为其他雇主使用这项测试就把它纳入流程,您还没有说明它的用途。一个耳熟能详的测评名称不能代替岗位分析。

区分推理能力和岗位知识

推理任务和知识测试衡量的是不同方面。一个人可能因为多年使用某款应用而熟悉电子表格快捷键,也可能能通过查阅文档摸索出新的公式。两种能力都可能重要,但不能互相替代。请判断哪些能力是入职后立即需要的,哪些可以通过入职培训培养。

对于初级分析师,一道数理推理题或许能看出他们是否能正确理解百分比。SQL 任务或许能看出他们是否会筛选行,或是否理解联接的逻辑。一段简短的工作样例或许能看出他们是否会在解释结果前检查缺失值。每种方法都有明确用途时,它们可以相互补充。如果多个版本只是反复考查同样的熟悉程度,就会显得重复。

通用认知能力测试涵盖多个推理领域。测试页面上的示例题展示了题目的形式;任何单项分数都应只作为一项参考证据。初级数据分析师测试组合展示了如何将推理能力与岗位相关的技术技能一并考查。雇主仍需判断这一建议的组合是否符合实际工作要求。

谨慎解读百分位数

百分位数描述的是一个人在参照群体中的相对位置。按照相关评分规则,结果位于第 75 百分位,表示分数高于该记录群体中 75% 的人。这不代表答对了 75% 的题目,也不代表胜任该岗位的概率为 75%。这些是不同的指标,需要不同的证据来衡量。

务必了解常模群体、样本量、数据收集方法和版本。以广泛在职人群为参考,与以某个具体岗位的求职者群体为参考,回答的可能是不同问题。如果参考样本量较小或匹配度不佳,看似精确的百分位数可能会产生误导。报告应说明这些局限,而不是用看似肯定的图表将其掩盖。

比较不同测试版本的分数时也需要谨慎。题目、时限或评分方式的变化可能会影响分数的解读。一份实用的报告会记录候选人作答时使用的版本。日后更新常模时,早期报告仍应便于理解。HireValid 的基准页面介绍了评分说明文档,包括百分位数如何标明其参照群体和版本。

检查语言和时间要求

即使一道推理题被标为数理题,也可能包含大量阅读内容。复杂的措辞可能会把一道解读表格的题变成高级语言能力测试。请检查说明和题目文本,去掉不必要的复杂表达。如果工作要求的是日常职场沟通,评估中也应尽可能使用日常职场用语。

时间限制也会影响所观察的技能。严格的时限可能更侧重处理速度、对题目形式的熟悉程度或在压力下保持镇定的能力。在某些情境下,这些因素可能与岗位相关,但不应想当然地认为如此。请提前告知候选人时限,并说明是否可以练习。应考虑提供适当的便利安排,而不是认为同一时限对所有人都天然公平。

视觉推理并非天然不存在障碍。图形过小、对比度低或依赖颜色,都可能使任务无法被某些人使用。阅读量较少并不意味着内容不存在文化偏见,也不代表人人都能使用。应根据各形式本身的特点进行评估。关键在于,这项任务是否为目标人群提供了恰当的方式来展示相关技能。

第 4 章:为候选人带来更好的测试体验

改编自为候选人提供更好的测试体验。

清楚说明目的

应聘者应当了解测评为何是招聘流程的一部分。只说“请完成此测试”,却不解释雇主希望了解什么,就是在占用对方的时间,却没有说明原因。更好的邀请应说明相关技能、预计所需时间和下一阶段安排。同时还要明确,测评证据会由人来审核,而不是让人误以为软件会自行决定申请结果。

用通俗易懂的语言说明测试与岗位的关联。可以让应聘支持岗位的候选人解读一项政策,并写出有帮助的回复;也可以让虚拟助理候选人为一组请求排定优先级,并说明哪些内容需要进一步澄清。任务越接近日常工作,即使形式不熟悉,候选人也能理解测试的目的。安排一长串与岗位无关的测试则更难解释其合理性。

不要承诺候选人完成测评后就会获得某种结果。完成测评并不保证能获得面试或录用机会。你仍然可以说明筛选阶段,并以尊重的方式进行沟通。清晰沟通并不意味着要对每个未来决定都做出确定承诺,而是要如实说明已知信息,以及候选人接下来可以期待什么。

如实说明所需时间

测评所需时间不仅包括答题,还包括阅读说明、检查设备和尝试练习题。如果限时答题部分需要 20 分钟,准备工作还要另花 10 分钟,邀请中就不应让人以为整个过程只需 20 分钟。可以请一位不熟悉流程的人试做,并记录哪些环节需要额外时间。

评估的投入应与招聘阶段相称。简短的初步筛选和后续较为深入的测试,会带来不同的预期。在雇主审查基本匹配度之前,避免要求每位申请者完成大量工作。如果确实需要较长的任务,应说明原因,并考虑如何让要求更合理。不要借测试之名获取无偿的商业成果。

说明候选人是否必须一次完成测评,以及网络断开时会发生什么。注明截止时间所采用的时区。如果系统支持中断后继续作答,请准确说明相关限制。与其含糊地承诺一切都会顺利,不如冷静说明如何恢复测评,尤其是在断网期间计时器仍会继续运行时。

开始前说明所用工具和监测方式

候选人需要知道哪些工具可以使用。搜索工具、计算器、笔记、翻译软件和 AI 辅助在某些任务中可以使用,在另一些任务中则可能受到限制。应针对具体任务写明规则,不要只笼统地要求候选人独立完成。如果某条界限可能被误解,请提供示例。

监控措施也需要清楚说明。如果雇主启用了浏览器事件记录或可选的摄像头检查,应在候选人同意前说明会收集哪些信息以及收集原因。不要把摄像头要求藏在笼统的隐私链接后,也不要等限时环节开始后才告知。适当情况下,应提供沟通替代方案的途径。

HireValid 候选人页面介绍了候选人的体验。网站上的示例工具不会启动摄像头,也不会将练习结果发送给雇主。这一点很重要:营销预览不应让人担心自己正被秘密监控,也不应让人误以为练习分数已被记录在真实的求职申请中。

让候选人可以方便地申请合理便利

如果候选人找不到合适的联系人,仅仅承诺公平是不够的。请在邀请中和测试开始页面之前说明如何申请便利安排,并指定专人负责回应。说明候选人如何申请调整,同时避免让他们通过普通表单提交不必要的敏感信息。

应关注所评估的技能以及此人面临的障碍。根据不同情况,延长作答时间、提供无障碍格式或采用其他方式代替摄像头检查,可能会有所帮助。统一的标准调整并不适用于所有需求。雇主应了解自身适用的义务,并在必要时寻求专业建议,而不是指望软件默认设置能解决所有情况。

除了政策,也要检查界面。能否仅用键盘完成任务?放大文字后,说明是否仍清晰可读?信息是否只通过颜色传达?用户能否看懂错误提示并解决问题?无障碍设计会切实影响评估能否测出目标技能,而不是受到无关的交互障碍影响。

第 5 章:没有人力资源团队,也能开启技能导向招聘

改编自没有人力资源团队,也能开启技能型招聘。

用实用的任务清单取代模糊的候选人画像

基于技能的招聘应从工作本身出发,而不是给同一份招聘广告换个说法。如果小型企业在没有说明岗位职责的情况下,要求应聘者拥有学位、数年工作经验和熟悉的职位头衔,那么筛选的可能是背景,而非能力。有些资质确实必不可少,另一些则只是沿用旧模板形成的习惯。请逐项审视要求,不要想当然地认为每项要求都必须保留。

设想您要招聘一名办公室行政人员。先列出具体工作:核对订单记录、协调共享日历、处理日常请求,以及标记异常情况。然后判断哪些工作要求新员工入职时就能独立胜任,哪些可以通过培训掌握。这样得出的岗位画像会比“有条理、积极主动且沟通能力出色”更实用,也更便于之后准备面试。

实用的任务清单应写明要做什么、针对什么对象,以及达到什么标准。“将每日订单录入内容与原始记录核对,并上报无法解释的差异”比“注重细节”能让候选人了解更多。写出这样的句子不需要一套冗长的胜任力框架。熟悉这项工作的人可以先起草,再请同事确认内容是否符合实际岗位。

区分必要条件和优先条件

必备要求应当与岗位有合理且站得住脚的关联。某项偏好或许能让新人更容易上手,但不应在不知不觉中变成筛选标准。请将两者分开列出。如果团队可以培训某款软件的操作界面,请说明有同类经验者也可应聘。如果岗位要求具备法律资质,请明确说明,并通过适当流程进行核实。

对于听起来中性、实际却可能含义模糊的替代性要求,应谨慎处理。“以英语为母语”“年轻有活力”或“完美契合企业文化”等说法,可能会模糊岗位真正需要的能力,也可能引发公平性问题。应改为描述沟通任务、工作条件和可观察到的行为。请根据所在地的规定,就招聘用语征求适当建议,尤其是在相关要求可能排除受保护群体的情况下。

职位描述模板提供了带占位符的结构框架,但不了解你的薪酬、工作时间或当地的相关义务。请替换所有占位符,并删除不适用的内容。模板的价值在于启发思考,而不是让雇主不加审视地发布一份要求清单。

为每项主要技能选择一种直接考察方式

针对每项基本要求,想一想候选人能在合理的时间内展示什么。一项简短的记录核对练习,可以看出候选人如何处理信息不一致的情况。一个日程安排场景,可以看出他们是否注意到各项任务之间的依赖关系,以及能否提出有用的问题。一段简短的书面回复,可以看出表达是否清晰、语气是否得当。测试任务应与实际工作相似,但不应要求候选人提供机密信息或完成耗时很长的无偿项目。

使用模拟数据和明确虚构的情境。不要让候选人解决贵公司可以用于商业用途的真实客户问题。提供充分的背景信息,确保从未在贵公司工作过的人也能公平地完成任务。解释流程中特有的术语。隐藏信息考查的是熟悉程度,而不是预期的技能。

通用测评可以补充工作样本,但不能仅仅因为它能轻松得出一个数字,就让它主导整个流程。Office Administrator 测评组合列出了一些相关领域。请对照工作任务清单,检查其涵盖范围。如果建议的测评组合超出了做出决定所需的范围,可以删减测试,不要把默认组合当作必选项。

开始评估前,先制定一份简明的评分指南

评分标准能把主观印象转化为一系列围绕证据的问题。对于记录核对练习,可以考察候选人是否找出了重要的不一致之处、避免凭空编造更正内容,以及说明了下一步怎么做。对于日程安排任务,可以考察他们是否识别出各种限制,并说明时间冲突。各个评估维度应有足够的区分度,让评审人员能够清楚说明评分依据。

使用通俗的描述来说明各评分等级。中等等级可以表示回答大体正确,但遗漏了一项重要检查。较高等级可以要求工作准确,并清楚说明不确定之处。避免只写“优秀”之类的标签,却不说明优秀在哪里。这样的标签只会让人更有信心,却无法帮助评分者一致地使用评分标准。

在用评分标准评估候选人之前,先用两三个虚构答案试一试。看看两位评审者是否能识别出相似的证据,以及意见分歧是否反映出表述含糊。这是一项校准练习,不是效度研究。其目的是让流程更易理解,并在影响真实候选人之前减少可避免的不一致。

诚信度审查工作表

为每项拟议中的信号设置四列:观察到的事件、可能的解释、后续问题和与决策的关联。以窗口焦点变化为例,观察到的事件是离开评估窗口。可能的解释包括收到通知、使用辅助软件或使用外部工具。中立的后续问题应询问发生了什么,而不是断定哪种解释属实。

在增加其他信号之前,先检查任务本身。没有提供事实依据的泛泛作文,可能不如简短、具体的决策练习有参考价值。后续说明可以展示候选人如何运用信息。最有效的改进或许是优化问题,而不是收集更多监控数据。

最后,检查每项设置对隐私和无障碍访问的影响。启用数据收集前,明确收集目的、访问权限和保留期限。如果某项要求尚未明确,请保持该功能关闭,并采用适度的替代方案。只描述你实际启用并检查过的监控措施。

最终决策问题

  • 哪些能力必须在没有协助的情况下展示,原因是什么?
  • 明确允许使用哪些工具?
  • 每项信号描述的是观察结果,而非判定结论吗?
  • 候选人能否通过清晰的流程补充相关情况?
  • 是否说明了系统的局限,而没有承诺能够检测所有情况?
  • 是否由人员负责每一项会产生重大影响的决定?

继续了解诚信概览、示例测试和候选人指南。

关于编辑团队

本内容由 AI 协助编写,作为 HireValid 编辑材料。相关领域专家和法律审核尚未完成。 阅读编辑政策。

Integrity Score 较低会导致候选人被淘汰吗?+

不是。诚信信号可能有合理的解释,包括网络连接问题或无障碍需求。作出决定前,应由人工审核相关证据,并与候选人沟通。

候选人需要准备什么?+

你需要使用浏览器并保持网络连接稳定。打字、电子表格和代码任务适用于电脑端。如果雇主启用了摄像头检查,必须明确告知候选人,并提供申请替代方案的途径。

这些分数是官方资质证明吗?+

不是。这些工具用于招聘决策。英语测试结果是与 CEFR 对标的水平估计,并非官方证书。认知能力得分也不是临床 IQ 测试结果。

防止在线测试作弊最有效的方法是什么?+

重在设计,而非监控。设置较短的作答时间,从随机题库中抽题,并设计需要候选人自行推理的任务,可以降低外部帮助的作用。再加上明确的规则、供人工审查的诚信信号和结构化的后续评估,并由人员负责做出决定。

抗 AI 测评和完全不受 AI 影响的测评是一回事吗?+

不。抗 AI 测评的设计旨在降低 AI 帮助的作用,并让使用 AI 的情况更容易被察觉,但任何测试都无法完全排除这种可能。请谨慎看待“完全防 AI”的测试宣传,并通过结构化面试或工作样题核实重要结果。

我应该在所有测评中禁止使用 AI 工具吗?+

不一定。许多雇主会在限时筛选测试中要求候选人独立完成;如果工作中会用到 AI,则会在之后的工作样本环节允许使用,但要求说明。无论你如何决定,都应在候选人开始前说明每个环节的规则。

继续探索

少靠猜测,多找到优秀人才。

AI 可以润色答案。
招聘时看重背后的能力。

了解面向 AI 时代打造的进阶招聘测评和诚信工具。

免费开始或试做样题 无需信用卡,也无需承诺年度订阅。