本地跑 AI,有点像给电脑换了一套连接显卡的“传动系统”:底层一升级,上层工具能不能照常工作,往往比新功能更牵动用户。AMD 已将 ROCm——让程序调用 AMD GPU 的开源计算软件栈——跨代升级到 10.0;与此同时,llama.cpp 的适配补丁已经出现,说明这款常用的本地模型推理工具正开始跟进。
ROCm 10.0 的关键变化是整套版本改由 TheRock 统一构建和发布。按 AMD 的说法,基础组件、软件库和框架安装包会经过同一条流水线,并同时覆盖 Instinct、Radeon 和 Ryzen 集成显卡,以及 Windows、Linux。新版还计划统一软件仓库,允许多版 ROCm 并存,方便用户暂时锁定旧版再逐步迁移。
不过,目前材料没有披露 llama.cpp 补丁支持哪些显卡,也没有兼容性测试或性能数字。对本地推理用户来说,真正值得继续看的不是“10.0”这个编号,而是现有硬件能否稳定编译、运行,以及速度和显存占用是否变化。