一个孩子感染后出现腹泻,我们真正想追问的可能不是“感染平均增加多少风险”,而是:如果没有这次感染,腹泻还会不会发生?论文研究的“必要性概率”(probability of necessity,PN),正是衡量对已经暴露且出现结果的人,撤去暴露后结果不会发生的概率。
难点在于病例对照研究会先按结果抽人,例如特意招募一批患病者和未患病者,再回看暴露。样本里的患病比例由研究设计决定,不能当作总体风险。作者给出一套非参数方法:若能从外部获得总体结局流行率,就可把样本重新接回目标总体,并在常见因果假设及“暴露不会反而阻止结果”的单调性假设下,精确识别 PN;不采用单调性时,结果仍可作为有效下界。
更实用的一点是:当结局很罕见时,作者还给出不需要外部流行率的简化估计,并证明其近似误差会按总体结局流行率的量级趋近于零。也就是说,结局越罕见,这条省去外部数据的路线越有依据;但它仍是近似,且结论依赖论文列出的因果与抽样假设。