深度专题 FEATURES — 2
Liquid押注“决策模型”新赛道
Liquid用3B与600M模型押注结构化决策:不写长答案,一次计算直接做判断,甚至走进浏览器。
显存放不下,llama.cpp按需缓存专家
llama.cpp合并MoE专家缓存,让装不进显存的模型按需借用GPU加速。
速览 BRIEFS — 9
REPO
Cloudflare把安全审计做成Agent技能
Cloudflare把代码安全审计写成Agent作业手册,用分阶段复核和结构化记录降低误报风险。
REPO
XERJ让Agent先索引再搜索
XERJ先给代码建索引再搜索,减少Agent逐文件翻找造成的上下文浪费。
REPO
开源电脑操作框架升温
CUA 单日新增 228 星,把跨系统桌面、设备调度与 Agent 评测装进一套工具链。
NEWS
27B三值模型获得2.2倍解码
重训草稿模型,让24GB可跑的27B三值模型在L4上解码提速约2.2倍。
NEWS
4GB手机也能独立逛亚马逊
1.5B本地模型在4GB手机上两次完成亚马逊加购,展示低配端侧Agent的可行性。
NEWS
Qwen提示处理再快5.5%
llama.cpp重排CUDA线程分工,Qwen长提示处理提速约5.5%
REPO
Agent专用终端盯上多任务通知
cmux用纵向标签和醒目通知,让并行编码Agent不再淹没在终端窗口里。
NEWS
浏览器本地搜索图片再进一步
EmbeddingGemma 2移植到WebGPU后,照片语义搜索可全程留在浏览器本地完成。
NEWS
106个超小模型有了统一考场
统一整理106个超小语言模型的成绩与资料,让端侧选型先有一张可横向比较的表。