深度专题 FEATURES — 2
因果分析Agent,人类该在哪把关
Netflix 开源因果分析 Agent:机器包办重复诊断,人类守住问题、假设与结论。
数据不出站,一轮通信完成推断
一篇 JASA 论文把多机构异构数据推断瞄准一轮通信,但效果与隐私边界仍待正文核查。
速览 BRIEFS — 8
NEWS
同一条Polars查询跑到160亿行
同一套 Polars 查询,从笔记本上的 9700 万行直接跑到云端 160 亿行。
PAPER
聚类完成后,显著性还能信吗
同一批数据既用来分组又用来找差异,普通显著性检验可能低估误报风险。
NEWS
Airbnb把评测前移到开发流程
Airbnb把生成式 AI 评测变成每轮开发的导航仪,让问题在上线前更早暴露。
NEWS
dbt补全开始理解数据库列
开源语言服务器让 dbt 编辑器读懂数据库列,写 SQL 时能直接提示真实字段。
PAPER
因果数字孪生也有能力边界
数字孪生通过实验不等于因果可靠:反馈系统的反事实预测仍可能无法唯一确定。
PAPER
协变量平衡别只盯一个均值差
加权后均值相近,不代表两组真的可比;三种检验能继续追查分布与尾部差异。
PAPER
差分隐私结果还得服从硬约束
最大熵方法让隐私噪声服从人口总数等硬约束,同时尽量保留原有隐私含义。
NEWS
选择偏差不总朝同一方向
不系安全带的出租车司机,提醒我们:选择机制可能把直觉结论整个翻过来。