本地运行 AI 模型,过去常像给电脑换零件:版本号变了,却不容易判断下游工具会不会跟着出问题。如今 llama.cpp——许多本地大模型应用依赖的通用底座——正式发布 v0.2.0。它的意义不只是一批新改动,而是此前预告的语义化版本开始落到正式发行版上。
据 GitHub 的项目发布页,v0.2.0 于 2026 年 8 月 21 日发布,标签指向提交 bb4caa7,并关联预编译构建 b10566。语义化版本用“主版本.次版本.补丁版本”提示变化性质。项目文档规定:公共 C API——下游程序接入 llama.cpp 的接口——若出现破坏性变化,就提升主版本;向后兼容的功能、模型支持或 API 新增,提升次版本;没有 API 变化的修复,则提升补丁版本。按这套规则,0.2.0 表示一次向后兼容的功能级更新。
发布页还附上了从 v0.1.2 开始比较的变更记录,涵盖后端修复、模型支持和界面调整等提交。对普通用户来说,眼前变化未必显眼;对依赖 llama.cpp 的项目而言,版本号终于开始成为判断兼容性和升级风险的共同坐标。