Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.061 — 2026-09-03
PAPER 约 1 分钟

测试对象会作弊,检验该怎么设计

把考试做成逐级筛选:只给过关者升级安保复测,以较低成本对付策略性作弊。

如果所有考生都用最高规格监考,作弊会更难,但成本可能高得无法落地;如果规则太松,知道规则的人又会专门钻空子。这篇论文研究的正是这种两难:测试结果既受自然噪声影响,也会被受测者策略性操纵,怎样仍然选出真正的优胜者。

作者的关键做法像漏斗:先用较低安保等级测试,只有通过者才进入成本更高、安保更严的复测。模型假定,每名非优胜者都有一个需要多高监考成本才能被淘汰的门槛;组织者知道这些门槛的总体分布,却不知道谁对应哪个门槛。真正的优胜者则能通过任何等级的测试。在这些设定下,系统要共同决定测几轮、每轮用什么安保等级,并可依据前一轮结果调整下一轮。作者用动态规划——把大决策拆成一连串可复用的小决策——求总测试成本最低的方案。

它值得注意的地方,不只是“加强监考”,而是承认固定规则本身会成为作弊攻略,再把有限资源集中到越来越小的可疑或高分人群。结论的适用范围仍取决于论文的门槛模型与分布已知等假设。


供稿材料 SOURCES — 1

← 返回 2026-09-03 · 数据板块