深度专题 FEATURES — 2
选择偏差下,因果图还能怎么找
把隐藏因素、入样偏差和逐个干预放进同一张因果图,并给出可检验的识别边界。
训练集混入AI废料,先别急着删
三种方法清洗疑似 AI 文本,却误删真人评论并拖累模型:数据变干净,不等于模型变更好。
速览 BRIEFS — 8
PAPER
合规评分也需要置信区间
AI合规分不能只报一个数:同批样本算出的多项指标会一起波动,门槛判断也该带上不确定范围。
PAPER
多层中介效应不能直接混算
多层中介分析混算两条路径,答案会随样本设计悄然变化
PAPER
最优治疗策略也可能难以落地
最优治疗规则未必胜过医生;新方法把“何时交给算法”也纳入决策。
PAPER
预测模型的收益该和谁比
相对效用衡量模型比简单策略多赚多少,但上限并非完美概率预测。
PAPER
小样本逻辑回归如何做拟合检验
把残差画成图交给预训练网络,再用 Bootstrap 守住小样本误报率。
PAPER
把序数结果二分,会丢掉什么
五档健康评价压成好坏两档,门槛一挪,地区差异的结论也可能随之改变。
PAPER
薄板样条降秩也能追求真最优
截断更合适的样条基,在不增加构建成本的前提下追求真正最优的低秩近似。
PAPER
虚拟哑变量为筛选结果控FDR
让人工空变量与真实变量同场竞争,为GLM和Cox筛选校准假发现门槛。