NVIDIA 今日宣布,NVIDIA Vera Rubin 平台正开启代理式 AI 的下一个前沿。目前,该平台搭载的七款新芯片现已全面投产,旨在扩展全球最大 AI 工厂的规模。
该平台集成了 NVIDIA Vera CPU、NVIDIA Rubin GPU、NVIDIA NVLink™ 6 交换机、NVIDIA ConnectX®-9 SuperNIC、NVIDIA BlueField®-4 DPU 和 NVIDIA Spectrum™-6 以太网交换机,以及新纳入的 NVIDIA Groq 3 LPU。这些芯片设计为协同运作,构成一台强大的 AI 超级计算机,可为 AI 的各个阶段提供动力——从大规模预训练、后训练、测试阶段扩展到实时智能体式推理。
NVIDIA 创始人兼首席执行官黄仁勋表示:“Vera Rubin 是一次划时代的飞跃——七款突破性芯片、五种机架、一台巨型超级计算机——旨在为 AI 的每个阶段提供澎湃动力。代理式 AI 的拐点已经到来,Vera Rubin 正拉开历史上最大规模的基础设施建设序幕。”
“企业和开发者正在使用 Claude 进行日益复杂的推理、智能体工作流以及关键任务的决策,这要求基础设施必须能够跟上步伐。”Anthropic CEO 兼联合创始人 Dario Amodei 表示。“NVIDIA 的 Vera Rubin 平台为我们提供了计算、网络和系统设计,使我们在不断提升客户所依赖的安全性和可靠性的同时,能够持续提供卓越性能。”
OpenAI 首席执行官 Sam Altman 表示:“NVIDIA 的基础设施是让我们不断推动 AI 前沿发展的基石。借助 NVIDIA Vera Rubin,我们将能够以大规模运行更强大的模型和智能体,并为数亿用户提供更快速、更可靠的系统。”
转向 POD 级系统
AI 基础设施正快速演进——从分立芯片和单机服务器,向完全集成的机架级扩展系统、POD 级部署、AI 工厂和主权 AI 发展。这些进步正推动性能实现跨越式增长,并为各个行业各种规模的机构提升成本效益,从初创公司、中型企业,到公共和私营机构和大型企业。同时,这也有助于普及 AI 技术,并提高能效,从而为全球最严苛的工作负载提供动力。
通过跨计算、网络与存储的深度协同设计,并依托由 80 多家 NVIDIA MGX 生态系统合作伙伴组成的全球供应链,NVIDIA Vera Rubin 提供了迄今规模最大的 NVIDIA POD 级平台——这是一款超级计算机,其中多个专为 AI 设计的机架协同运作,构成一个庞大且统一的强大系统。
NVIDIA Vera Rubin NVL72 机架
Vera Rubin NVL72 集成了通过 NVLink 6 互连的 72 个 Rubin GPU 和 36 个 Vera CPU,并配备了 ConnectX-9 SuperNIC 与 BlueField-4 DPU,从而实现了突破性的效率表现。与 NVIDIA Blackwell 平台相比,Vera Rubin NVL72 仅需四分之一数量的 GPU 即可训练大型混合专家模型,每瓦特推理吞吐量最高可提升 10 倍的同时,每 Token 成本仅为原平台的十分之一。
NVL72 专为全球超大规模 AI 工厂设计,通过 NVIDIA Quantum-X800 InfiniBand 和 Spectrum-X 以太网实现无缝扩展,保持大规模 GPU 集群的高利用率,同时缩短训练时间并降低总体拥有成本。


闽公网安备 35020602001684号