深度专题 FEATURES — 1
Intern-S2:科学Agent迈向397B
Intern-S2把科学文献、跨领域强化学习和长程Agent装进397B级模型,但能力与部署门槛仍待实测。
速览 BRIEFS — 9
NEWS
24GB显卡跑进144K上下文
一套 vLLM 配置让 RTX 3090 跑起 27B INT4 模型,并把上下文窗口推至 144K。
NEWS
LoRA托管开始走向Serverless
让多个 LoRA 共用基础模型和 GPU,低频微调版本也能按需上线。
NEWS
AMD在Windows上兼容CUDA应用
ZLUDA 接上 ROCm/HIP,让部分 Windows CUDA 应用可在 AMD GPU 上直接运行。
REPO
Agent技能也要过安全验证
跨多款编码助手的技能注册表走红,焦点正从“装得多”转向“装得放心”
REPO
腾讯把团队记忆做成资产库
腾讯开源团队记忆库,让多个 Agent 复用聊天、文档与代码经验。
REPO
后台编码Agent有了开源方案
Open-Inspect 让编码 Agent 在后台并行干活,但目前只适合可信团队内部部署。
REPO
Transformers连续两日升温
成熟基础库单日新增152星、连续两日上榜,模型统一适配仍是刚需。
NEWS
本地AI工作站堆到64GB显存
一位开发者用三张消费级显卡搭出64GB显存工作站,尝试用本地编码 Agent 替代云端订阅。
NEWS
显存与算力剪刀差继续扩大
Micron图表显示:算力约两年增至3倍,HBM带宽却不到2倍,AI推理越来越受数据搬运限制。