深度专题 FEATURES — 2
MiMo 2.6全家桶:小米从9B铺到万亿参数
从9B蒸馏版到超过1T旗舰,小米把一次公开强化学习做成了完整模型产品线。
Bend 2:用证明拦住AI写错代码
Bend 2要求AI改代码时附上数学证明,试图把“别写错”变成编译器能检查的硬规则。
速览 BRIEFS — 8
NEWS
100M参数也要挑战文生图
Supra2-IMG把文生图模型压到1亿参数,端侧门槛下探,但画质与速度仍待验证。
NEWS
俄罗斯自研80B稀疏模型入场
Yandex开放自研80B稀疏基础模型,每次生成仅激活约3B参数
NEWS
Hugging Face Tokenizers迈入1.0
Hugging Face 重写 Rust 分词核心,1.0 候选版提速明显,也尽量守住兼容性。
NEWS
Gemma 4有了专用高并发引擎
Gewell为Blackwell上的Gemma 4 31B量身优化,用更省显存的缓存设计服务高并发请求。
REPO
给Agent的危险命令加一道闸
给编码 Agent 的命令出口装上安检闸,危险操作执行前先拦截。
NEWS
18MB缓存就能临时改写模型拒答
phantom-kv用约18MB可卸载缓存临时改变模型拒答,安全边界因此延伸到运行时状态。
NEWS
小模型也有了策略游戏擂台
一个按体积分组的策略游戏擂台,让小型神经网络比拼决策与效率。
REPO
Qwen-Image 2.1开始流行GGUF版
社区把 Qwen-Image 2.1 压缩成 GGUF,正加速接入本地生图工具链。