Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.071 — 2026-09-13
PAPER 约 1 分钟

答案一致,不代表推理完成

同一个答案反复出现,可能只是模型暂时没改口,并不表示推理已经结束。

像做一道难题时连续几次都写下同一个答案,并不代表你已经想完;再检查一步,答案仍可能被推翻。这篇论文提醒,推理模型也会如此。所谓自一致性,是在一段尚未完成的推理途中多次探测当前答案,若结果相同便提前退出——也就是提前停止生成,以节省时间和算力。问题在于,这只能证明模型暂时没改口,不能证明推理已经完成。

作者在两个模型、三个基准的冻结推理轨迹上,按预先固定的分析规则系统测试这类停止方案。一个仍能节省 token 的规则中,每九次停止约有一次锁定了模型随后会放弃的答案,而且这些情况大多截断了原本会发生的纠错。把观察答案的一致窗口拉长也没有消除风险,只会让规则更晚、更少触发,节省随之缩水。

这项工作的警示很具体:答案稳定与推理终止之间存在缺口,单靠“连续答得一样”来省算力,测到的可能只是一个被探测问题反复诱出的临时答案。预注册测试中,没有一种自一致性规则通过作者事先设定的安全与节省门槛;相对地,读取推理边界置信度的 DEER 在同一流程中通过了全部门槛。不过,这是否适用于更广泛的模型和任务,仍需继续验证。


供稿材料 SOURCES — 1

← 返回 2026-09-13 · 学术板块