深度专题 FEATURES — 3
世界模型学会反事实推演
世界模型不只猜未来,还要分清“换个动作会怎样”,让机器人规划少被相似画面误导。
KV缓存开始跨上下文共享
KVShareArena把缓存复用推向不同上下文和模型版本,并算清质量与成本账。
世界模型也会被植入后门
TrojanWorld把后门藏进世界模型:预测看似正常,智能体的行动却可被实物触发并持续偏转。
速览 BRIEFS — 8
PAPER
答案一致,不代表推理完成
同一个答案反复出现,可能只是模型暂时没改口,并不表示推理已经结束。
PAPER
一比特量化开始较真
AF1把附加开销也算进账,尝试让1比特大模型真正省内存、跑得快。
PAPER
视频生成器真懂指定物理吗
PhysWeep从视频像素反推物理参数,发现部分生成器听采样种子、不听指令。
PAPER
视觉触觉世界模型接受力约束
小型视觉触觉模型能改善抓取选择,但预测更准不等于决策更好
PAPER
异步传感器打破世界模型假设
让世界模型看懂不同步传感器,并划清“下次刷新时间”何时真正有用。
PAPER
推测解码让验证信息流回来
DFlow把验证阶段的“废稿信息”带到下一轮,提高并行草稿命中率。
PAPER
机器人记忆被改写成计划
MaP-WAM把长期经历整理成计划,让机器人记得前事,又不必每一步重读全部历史。
PAPER
视频大模型可能看不懂运动
MotionBlind用成对视频测试运动感知:会认物体的Video-LLM,未必看得懂速度与方向。