深度专题 FEATURES — 3
世界模型的物理感,终于有尺可量
GAUGE把仿真和生成视频拉回真实测量:画面像物理,不等于运动真的对。
人类视频教会机器人想象动作
LAWM-3D从人类视频提炼三维动作代码,试图降低机器人世界模型的数据成本。
模型与脚手架开始一起训练
把提示、工具流程也纳入后训练:AI 不只练“大脑”,还会改造并逐步收起自己的办事清单。
速览 BRIEFS — 9
PAPER
被逐出的KV还能救回来
QEvict给被淘汰的KV留一份低比特备份,注意力转移后还能重新启用。
PAPER
投机解码开始联合起草Token块
DBlast让草稿词元彼此照应,在随机生成中拼出更连贯的候选块。
PAPER
世界模型能否跨机器人身体
XEWorld换掉机器人身体做受控测试,发现模型更认外形,而非真正迁移物理规律。
PAPER
一张纸也能劫持机器人
纸面文字可让机器人改计划:三款VLM在系统测试中均曾中招
PAPER
弱模型也能给强模型挑推理错
弱模型不必解完整道题,也能靠局部试探帮强模型找出推理岔路。
PAPER
扩散LLM可能先猜答案再补推理
记录填词顺序后,研究者发现扩散LLM会先锁定答案,再围着结论补推理。
PAPER
图像工具会用,不等于真的有用
因果审计显示:AI 会裁剪、放大图片,不代表它真的借此找到了答案。
PAPER
B300双节点全参微调的踩坑实录
16张B300实训Qwen3-32B:功耗排障比利用率更可靠
PAPER
编码Agent先学会找对文件
CodeGrep专门训练 AI 先找对文件,减少编码 Agent 在仓库里盲目翻找。