Rebas Daily 第 56 期 · 2026-08-29
学术
海量并行训练,SAC要重写规则
WarpSAC发现:并行模拟让经验不再稀缺,SAC过去的“保险措施”反而可能拖慢学习。
预训练配方变成一场混合实验
把大模型数据配比当作配方实验,用更少的小模型试训寻找更好的混合方向。
机器人世界模型真的听指令吗
WorldEcho专测机器人是否真按动作预测未来,揭开“画面合理、动作失真”的盲区。
开源
Microduck:开源双足机器人走向大众
一只399美元的小型双足机器人,把动作训练、仿真和部署工具一并交给普通开发者。
科技
AI开始改造自己,十项测试全涨分
Anthropic让AI自动设计对齐训练,十项特定测试均涨分;这不是“自我觉醒”,却让递归改进首次变得可测。
Claude Code自动模式的安全豪赌
Claude Code把自动模式推向默认,但一次提示注入测试显示:防线不仅可能漏拦攻击,还可能挡住自救。
12帧记忆,重建万帧3D世界
高德ABot-Recon只保留最近12帧,让万帧级3D重建更快、更省,也更不易漂移。
数据
Switchback实验:CUPED再加码
给 Switchback 实验多看几周历史,再用交叉拟合防止“自我感觉良好”,有望更快识别小效果。
实验降方差,理论上能到多低
一篇从效率边界追问实验降方差:复杂模型还能带来多少真实精度,而不只是工程负担。
商业
长鑫首份财报:580%涨幅迎来验货
CXMT上市后股价暴涨,首份业绩实现盈利;AI与存储涨价叙事开始接受财务数字检验。
Anthropic准备递表上市
Anthropic拟于劳动节后公开招股书,模型公司的财务底牌或将首次接受统一审视。
千亿美元护盘:日本押注日元
日本单轮买入15.39万亿日元,创历史纪录;真正重要的是,它向汇市重新标出了政策底线。
量化
0DTE波动率溢价,交给排序模型
让模型每天给8种卖沽与“不交易”排队,再用保证金和信心门槛把0DTE溢价变成仓位。
漂亮回测,是运气还是本事
MinervaScore给漂亮回测加上五道体检,但高分仍不等于未来赚钱。
DeepSeek融资背后的量化帝国
DeepSeek向外找钱,幻方同时押注科技IPO:一条资本链正在重新划界。
设计
AI会先抹掉广告业新人吗
D&AD警告:AI省掉的不只是初级工作,也可能是下一代创意人的训练场。
一只跑进千家万户的甲壳虫
圆顶、后置风冷与2150万辆:一辆国民车如何跨越历史,变成亲切而反炫耀的全球符号。
艺术
非洲现代主义,不只是建筑
MoMA用“解放性艺术”重看非洲现代主义:艺术不再是建筑史的附录,而是独立与未来想象的现场。
第比利斯拆楼,为何引发抗议
第比利斯拆除一座亲欧时代地标,建筑保存、城市记忆与政治解读由此撞在一起。
月亮升起时,十字架亮了
月亮悬在黑天之中,落日只亮了十字架几秒,亚当斯把这几秒延长成摄影史的经典。