一个2.8万亿参数的模型,不只要看它会做什么,也要看是谁给它提供“机房和电力”。据 Bloomberg 报道,月之暗面通过与阿里的算力安排,获得了一个由约两万张 Nvidia 芯片组成的集群,并将其用于 Kimi K3 的开发。GPU 集群,就是把成千上万张加速芯片连成一套系统,让它们共同训练模型;芯片数量能说明规模,但实际效率还取决于芯片型号、网络和软件。
这也补上了 Kimi K3 的另一块拼图。本刊此前报道过它的开放下载承诺和2.8万亿参数规模,如今焦点转向训练底座:阿里不仅是月之暗面的投资方,也在供应训练算力。换句话说,月之暗面不必独自买齐全部芯片,而是借助云端集群缩短部署时间,同时也会更依赖基础设施提供方。Bloomberg 还称,月之暗面可通过东南亚使用较新的 Blackwell 处理器,并正为下一款模型寻找更多芯片;报道未披露具体芯片型号、网络配置和协议条款。