深度专题 FEATURES — 1
模型的“自信”真的会支配行动
一项因果实验显示,LLM不只会报告“自信”,还会据此决定回答还是弃答。
速览 BRIEFS — 8
PAPER
语言统计如何长成缩放定律
把词频长尾一路推到模型缩放曲线,为经验规律寻找语言统计根基。
PAPER
DQN终于有了连续极限解释
把 DQN 当作连续控制方程的数值求解器,并说明它何时会逼近正确答案。
PAPER
思维链能力也能用秩来刻画
JMLR 用学习理论中的“秩”,精确刻画受限 Transformer 至少要推理几轮。
PAPER
不可逆环境里,智能体要会求助
面对不能重来的错误,智能体可以先求助,再逐步学会独立判断。
PAPER
扩散模型未必怕高维
新理论称:数据若藏在低维结构中,扩散模型的样本需求未必随像素数爆炸。
PAPER
多目标RL重新审视“效用”
多目标决策不只要会调权重,还要先确认偏好真能导向最优策略。
PAPER
主动学习工具链补上统一入口
把主动学习的选样、建模与实验流程装进同一套 Python 工具箱,帮助团队少花标注成本。
PAPER
同行评审会交给机器人吗
Science追问AI能否参与审稿:它或许能帮忙挑错,但保密、能力与责任边界仍待厘清。