深度专题 FEATURES — 2
FP4预训练:算得快还不够
FP4张量核很快,但训练未必快。论文把缩放、打包与反向传播一起优化,算清低精度预训练的系统账。
FutureWorlds:让机器人比较多种未来
FutureWorlds让机器人同时预演、比较多种未来,把“哪条更靠谱”变成新的训练信号。
速览 BRIEFS — 8
PAPER
因果世界模型何时真能帮到Agent
因果模型并非总能帮到 Agent:关键看模块关系能否识别、行动时能否用上。
PAPER
世界变了,JEPA边规划边适应
JEPA-TTT让世界模型在运行中持续修正自己,环境规律变了,规划也能逐步跟上。
PAPER
投机解码开始精算每根分支
CAST给投机树逐枝算账,在多猜候选与验证成本间寻找真实加速。
PAPER
首个Token并非裁判的最终意见
只看首个 Token 虽省钱,却可能把位置偏差系统性算高。
PAPER
长任务VLA迎来记忆专项考场
90项任务把机器人“记没记住”从总体操作成绩中单独拆出来考。
PAPER
物理智能榜单加入闭环体检
PhysVista把“看见—推断—核验”连起来,检查VLM是否真懂物理。
PAPER
Agent发现世界规则也要可审计
Kepler把Agent对环境的猜测写成程序,让试错依据和失败位置都能复查。
PAPER
仿真技能跨到真机前先由Agent重组
Skill2Real让Agent先在仿真中验证并重组技能,再零样本迁移到真机。