深度专题 FEATURES — 2
vLLM甩掉Python:C++服务栈来了
社区开发者用C++20重写vLLM服务栈:运行时不依赖Python,并逐token核对输出。
小米机器人模型押注十万小时真机数据
小米 XR-1 用超十万小时真实操作轨迹训练,试图让机器人从演示走向开箱部署。
速览 BRIEFS — 9
REPO
代码审查先建一张本地图
先给代码库画一张持续更新的关系图,让 AI 审查时只读真正相关的代码。
REPO
Open SWE瞄准异步编码Agent
Open SWE让编码 Agent 在隔离云环境中后台干活,并用持久状态承接人工追问。
NEWS
Nemotron全模态补上Mac本地路径
社区用 MLX 补齐视觉与音频组件,让 Nemotron Omni 真正在 Mac 本地看图、听音频。
NEWS
MoE卸载调参让预填充翻倍
把八层 MoE 专家权重留给 CPU,3090 腾出显存扩大批次,提示词吞吐升至 2.36 倍。
NEWS
Nemotron Parse 2.0重做文档结构化
Nemotron Parse 2.0把文字、版面和阅读顺序一次整理好,瞄准RAG与文档ETL。
NEWS
Ling 3.0 Tiny只激活13亿参数
Ling 3.0 Tiny以7.9B容量、每个token仅激活1.3B参数,继续压低部署计算负担。
NEWS
Echo Dot 2跑起2800万参数模型
老旧 Echo Dot 2 跑通本地语音助手,缓存设计把响应等待从约 17 秒压到 2.3 秒。
REPO
本地搜索给编码Agent免掉API账单
Wigolo 把搜索、抓取和研究搬到本机,让编码 Agent 少交 API 费,也少依赖云服务。
REPO
Agent红队工具继续进入工程流水线
Promptfoo把AI应用评测与红队扫描接进自动化流水线,让安全检查不再靠手工试错。