企业想把 AI 留在自己的服务器里,往往要在能力、响应速度和部署规模之间找平衡。IBM 推出的 Granite 4.2-30B,正是面向这一需求:它是 Granite 4.2 家族的旗舰推理模型,30B 指约有 300 亿个参数;企业可以自托管——把模型运行在自己控制的服务器或云账户中,以掌握数据和部署方式。
据 IBM 发布的模型页面,Granite 4.2-30B 内置 chain-of-thought(“思维链”,即回答前展开的中间推理步骤),用于数学、代码和多步骤问题。它提供完整思考、低投入和不思考三种模式,可按每次提问在思考深度与响应速度之间切换。模型还支持 512K 上下文窗口、带推理的工具调用,并采用 Apache 2.0 许可证。值得注意的是,目前材料主要来自 IBM 的模型说明,未提供可供本文展开比较的独立评测结果;它的现实意义首先在于,为需要自行部署推理模型的企业增加了一个尺寸适中的选择。