深度专题 FEATURES — 2
模型的“内心话”可能藏不住
一篇论文声称能从 Claude 与 GPT 接口还原隐藏推理,但惊人结论目前只有单篇 Reddit 帖子转述。
3B视觉模型住进手机
约2GB的LFM2.5-VL-3B已能在手机本地看图,但真实演示也暴露了速度差距。
速览 BRIEFS — 9
NEWS
Gemma 4为KV缓存量化补课
KLD 实测显示,Gemma 4 31B 的 QAT 版更扛 KV Cache 压缩。
REPO
Nemotron 30B主打NVFP4闪电推理
30B 总容量、单次仅激活 3B,再用 NVFP4 压低推理成本,适合本地部署玩家关注。
REPO
Omnigent想统一编码Agent底座
Omnigent为多款编码Agent加上统一底座,切换工具时不必重做编排、权限与沙箱。
REPO
holaOS把百种工具接进Agent工作台
把多种 AI Agent、文件、浏览器和 50 多项集成收进一个本地优先工作区。
NEWS
Muse Glimmer在Mac上快了3.3倍
mlx-dspark为Muse Glimmer 30B补上Mac加速路径,数学任务最高提速约3.3倍。
NEWS
DeepSeek超大模型也能借内存投机
单卡跑下284B模型后,草稿模型放系统内存竟比放显存更快
REPO
Midscene用视觉驱动跨平台UI自动化
Midscene 用截图理解界面,让 AI 跨网页和手机操作,少依赖易失效的选择器。
REPO
本地AI把照片变成3D模型
Modly 把照片转成 3D 网格模型,生成全程在用户自己的 GPU 上完成。
NEWS
开源项目重造Mathematica
Woxi 用 Rust 重造 Wolfram Language 解释器,为数学脚本和笔记本提供开放底座。