深度专题 FEATURES — 3
LaGSplat:一段视频变成交互物理场
LaGSplat 从一段或少量单目视频中学习物体动力学,让画面里的刚体和软物体真正可推、可碰。
SCALE:给JEPA找对规划几何
SCALE重排JEPA潜空间,让“离目标近”更像真的容易到达,补上表征与规划之间的关键断层。
回滚了对话,却没清掉KV缓存
Agent撤回失败分支后,模型可能还记得它:问题藏在没同步回滚的KV缓存里。
速览 BRIEFS — 9
PAPER
世界模型的随机性,校准了吗
CaliBench反复生成同一场景,检查世界模型给出的物理结果概率是否靠谱。
PAPER
驾驶世界模型也要缓存动作线索
DriveCache用车辆动作判断哪些扩散计算可以复用,减少驾驶视频生成等待。
PAPER
长任务机器人开始主动经营记忆
GaussMemory让机器人按任务轻重经营3D记忆,把精度留给真正影响下一步的物体。
PAPER
多Agent共享前缀,缓存别一刀切
GraniKV把共享前缀与独立生成分开管理,减少多Agent缓存浪费。
PAPER
Agent负载正在改写服务系统
Agent任务不只“跑模型”:工具、环境与持久状态正成为新的延迟和内存中心。
PAPER
VLA也能先猜动作、再批量验证
SpecVLA让机器人在简单路段多走几步,关键操作前再逐步核验。
PAPER
奖励学会了,就少分一点梯度
SA-MRPO降低已饱和奖励的权重,把更新信号留给仍有提升空间的能力。
PAPER
世界模型评测开始让Agent写判词
HarnessEval-W让评测Agent查证并写出判词,让世界模型的分数有据可查。
PAPER
长程Agent训练,也得先解决容错
Belayer为长程Agent训练补上容错:故障后保住计算进度,也让模型记忆与沙箱状态对得上。