深度专题 FEATURES — 3
世界模型会在哪里突然失灵
不再只看平均分:BasinLens主动寻找世界模型会在哪些正常输入下严重失准。
人形控制越过动作模仿
机器人不只照录像排练,还要临场组织动作;BeyondMimic用引导扩散探索这一步。
WAM蒸馏也要边跑边教
让加速版机器人边行动边向教师补课,修复蒸馏后的能力掉队。
速览 BRIEFS — 8
PAPER
世界模型学会守住物理不变量
让世界模型守住自己学会的“能量账本”,可改善长程预测
PAPER
视频生成离真正模拟器还有多远
系统审视200项工作:视频会“演”世界,却还难稳定、可查询地模拟世界。
PAPER
扩散语言模型学会及时收工
用第一轮置信度判断哪些词已定稿,减少扩散语言模型反复去噪的空转。
PAPER
LLM批量采样先筛掉慢尾巴
先跑一小段认出“慢尾”请求,再分流处理,避免整批采样被少数长回答拖住。
PAPER
工具路由开始为提示缓存让路
CacheRouter 把找工具另开一路,让主模型的提示前缀保持稳定、继续吃到缓存。
PAPER
Agent记忆遇上压缩悬崖
长程 Agent 会在反复压缩中遗失安全规则;分类保存,比一视同仁地摘要更可靠。
PAPER
投机解码只补最需要的视觉证据
FOVEA按生成状态补充关键视觉证据,同时保住缓存复用与解码速度。
PAPER
提示注入防御进入在策略蒸馏
让防御跟着 Agent 自己的行动练习,并逐词识别提示注入