发布前最难回答的,不是“还剩几个 Bug”,而是“上线后会有多少用户踩雷”。十个藏在冷门菜单里的缺陷,可能不如登录页上的一个缺陷影响大。Hernández-Suárez 与 Hernández-Cuevas 因此把 Beta 测试——正式发布前让接近目标人群的用户实际使用产品——看成对未来用户的一次抽样,直接估计新用户撞上未知缺陷的概率。
方法抓住一个很直观的信号:在全部测试记录中,只被报告过一次的缺陷越多,说明尚未见过的缺陷可能占据越大的用户风险。作者用“单例”数量除以报告总数,并称所得比例是未知缺陷风险的保守上界;它不预设缺陷数量、出现频率或软件内部结构。更妙的是,藏在其他 Bug 后面的缺陷也不必逐个推算:能走到更深处的用户,必先经过前面的故障点,因此后方缺陷合计影响的人群不会超过这道“门”的影响范围。
这个读数成立有一个关键前提:数据必须记录真实用户遇到缺陷的次数,例如 Beta 或崩溃遥测;每个 Bug 只记一条的整理清单不能代表用户风险。作者用已知真值的合成人群做了验证,但材料未披露具体误差数字。