深度专题 FEATURES — 2
Claude Code把执行端搬回自家机器
Claude Code让网页、手机和桌面任务落到企业自有机器执行,重新划定代码与凭据的控制边界。
浏览器原生跑起6亿参数语音识别
6亿参数语音模型直接在浏览器转写:不传服务器,也不用现成推理框架。
速览 BRIEFS — 8
NEWS
Q2量化在x86 CPU上快了三倍
llama.cpp为Q2_0接上x86 VNNI快车道,8B模型解码速度提升约3.4倍。
NEWS
超长上下文解码提速169%
llama.cpp 调整一处分派逻辑,Intel Battlemage 超长上下文解码最高提速约169%。
NEWS
300GB模型远程加载缩至90秒
llama.cpp并行RPC加载改动,将300GB模型的多机启动等待从近5分钟压到约90秒。
NEWS
LabyrinthBench专测Agent遗忘
一套本地运行的 Agent 记忆测试:不用模型当裁判,还揭示同一招可能帮七个模型、坑两个。
REPO
witr追出进程背后的启动者
witr 用一个入口追出进程、端口、容器或文件背后的完整启动链。
REPO
Agent前端栈继续走向多端
CopilotKit把同一套Agent界面带到网页、移动端和Slack,前端层正成为独立基础设施。
NEWS
Wan-Animate 2扩展角色动画边界
Wan-Animate-2跳过动作提取,让角色动画更接近完整制作流程
NEWS
AMD收购Taalas补AI推理版图
AMD收购多伦多推理芯片公司Taalas,为GPU之外的低成本模型部署路线加码。