临床试验像考试中途查分:看到疗效信号,可以提前结束;还能参考往年成绩,也就是借用历史试验或真实世界数据。但旧数据一旦不适用,就可能把无效治疗误判为有效。Mariani 等人关注的正是这笔账:贝叶斯序贯试验可以提效,却不能只谈提效,不看假阳性与功效——前者指无效时误报有效,后者指有效时成功检出的概率。
论文最具体的设计,是在每次中期分析都提供两道证据门槛。一道允许动态借用:当前数据与历史证据越相容,借得越多;冲突越大,借得越少。另一道通过解析对应关系,精确复现频率学派的 UMP 检验——即在给定条件下功效最高的一类检验。团队因此能随时看清:结论有多少来自当前试验,有多少来自外部信息;若怀疑两者不相容,也可退回频率学派判断。
需要注意,作者并未声称借用后仍严格控制第一类错误;论文明确说,这样做往往会抵消借用带来的功效收益。其取舍是保留一条可比较、可撤回的频率学派基准,并用数值研究及一项结核病预防试验设计展示框架。