如果把新一代 AI 机架比作刚送到车队的新赛车,那么今天的进展不是它已经赢下比赛,而是发动机点着了,车队的整套工具也接了上去。
据 OpenAI 基础设施负责人 Uday Ruddarraju 在 X 上发布的消息,OpenAI 首批 NVIDIA Vera Rubin 机架已经到货,并开始运行其训练栈。这是目前唯一可识别的独立信源,Sam Altman 的转发不算额外交叉印证。
跑起训练栈,意味着什么?
Vera Rubin 是 NVIDIA 面向下一代 AI 数据中心的机架级计算平台。所谓“机架级”,不是单独交付几张 GPU,而是把计算芯片、内存、网络、供电和散热当成一个整体,让大量芯片协同工作。
训练栈则是模型训练所需的软件、通信库、任务调度和监控系统的总称。硬件能运行这套系统,说明它已开始接入 OpenAI 的真实训练流程,而不再只是发布会上的产品规格。
Ruddarraju 称,这批设备将用于扩展支撑下一代前沿 AI 预训练的算力。预训练是模型从海量语言、图像或代码数据中学习基础规律的阶段,通常也是最消耗算力的一环。
值得关注的是工程交接
这条消息的价值,在于它标记了硬件交付与训练准备之间的一次工程交接。新平台只有兼容训练软件、通信和调度系统,才可能进一步组成可用的训练集群。
但“running our training stack”更准确的理解是训练栈已经运行,不能直接写成端到端大规模训练已经跑通,更不能据此推断平台已正式投产或性能提升了多少。
局限与未知
- 消息未披露机架数量、测试范围、运行稳定性和性能数据。
- 目前没有 NVIDIA、OpenAI 官方公告或媒体报道交叉印证。
- “10T+ pretrain”来自帖文下的评论或推测,含义和项目状态均未获原帖确认。