微软与NVIDIA 官宣:首批Vera Rubin 开始装机!七晶片AI 超级电脑正式落地云端

NVIDIA 与微软今日共同宣布,首波Vera Rubin 平台已正式开始装机。 NVIDIA 官方X 帐号发文表示:「Vera Rubin 正加速进入全面量产,恭喜微软团队促成这个令人振奋的里程碑。」过去几个月来,NVIDIA 从GTC Taipei 宣布全面量产到实际出货给客户,节奏比外界预期更快。这代表次世代旗舰AI 运算平台从量产阶段正式迈入实际部署,微软也因此成为全球第一家在大规模资料中心部署Vera Rubin 的云端业者,为后续AWS、百度Cloud 等竞争对手的跟进建立了实际案例。

Vera Rubin 平台:七款晶片、五座机柜组成AI 超级电脑

Vera Rubin 是NVIDIA 至今规模最大的POD 级系统。从Blackwell 到Vera Rubin,NVIDIA 仅花了18 个月,大幅压缩了业界常见的24 到30 个月开发周期。整个平台由五座专用机柜组成,涵盖Rubin GPU、Vera CPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6 乙太网络交换器与Groq 3 LPU 共七款专用晶片。 NVIDIA 称这套架构为「极端协同设计」(extreme co-design),将整个机柜系统视为一个分散式加速器来运作,而非各自独立晶片的组合。

旗舰型号Vera Rubin NVL72 机柜搭载72 颗Rubin GPU 与36 颗Vera CPU,通过NVLink 6 高速互连。每颗Rubin GPU 配备288 GB 的HBM4 记忆体,频宽高达22 TB/s,相较Blackwell Ultra B300 的8 TB/s 记忆体频宽提升了近三倍。 NVIDIA 宣称Rubin 推理效能可比Blackwell 提升5 倍,训练效能提升3.5 倍,每Token 推理成本降低10 倍。整个NVL72 机柜采用100% 液冷散热,搭配无缆线模组化托盘设计,安装时间从Blackwell 的两小时大幅缩短至五分钟。 NVIDIA 表示,这些设计使得AI 工厂的部署速度与密度都达到前所未有的水准。

微软抢先部署,Fairwater AI 超级工厂即将启用

微软这次是Vera Rubin 第一家超大规模部署客户。微软将把Vera Rubin NVL72 机柜系统部署于次世代AI 资料中心,包含尚未公开的Fairwater AI 超级工厂站点。这些系统将为Azure 云端AI 服务提供底层算力基础,支援OpenAI 的模型训练与大规模推理工作负载。 NVIDIA 加速运算副总裁Ian Buck 日前在总部向媒体证实,系统已开始出货给客户,OpenAI、CoreWeave、百度Cloud、Microsoft Azure、Meta 与Dell 均在首批名单中。 CoreWeave 向Bloomberg 表示其NVL72 机柜的Token 输出量已达到上一代的10 倍,验证了NVIDIA 提出的10 倍Token 成本降幅已从规格变成实际可达标的。

除了微软与CoreWeave,已确认的首波云端部署合作伙伴还包含AWS、百度Cloud、Oracle Cloud Infrastructure,以及Lambda、Nebius 和Nscale 等NVIDIA 云端合作伙伴。 NVIDIA 也确认戴尔科技、HPE、联想、美超微等系统大厂,以及华硕、鸿海、技嘉、和硕、云达、纬创、纬颖等供应链伙伴均已采用NVIDIA DSX 平台来加速Vera Rubin 的量产。 Vera Rubin 同时整合BlueField-4 DPU,支援高达800Gb/s 的软体定义网络与硬体级多租户隔离,并通过全端机密运算技术提供机架级的可信任执行环境,确保多租户云端环境中的资料与模型安全。 NVIDIA 也强调,DOCA 软体平台可以在AI 工厂的每个机柜与每一层提供进阶安全防护,通过直接在BlueField-4 晶片中强制执行的功能来保护资料与推理过程,且所有加密与威胁侦测都不会占用主机CPU 资源,让安全防护不影响运算效能的同时还能做到多租户隔离与零信任策略强制执行。

量产规模与供应链动员

NVIDIA 于今年5 月31 日在GTC Taipei 正式宣布Vera Rubin 全面进入量产。供应链规模是Grace Blackwell 的两倍,涵盖全球30 个国家、350 座工厂,从鸿海到纬颖等一线ODM 厂全部投入生产线。 NVIDIA 执行长黄仁勋在GTC Taipei 时表示:「代理型AI 是一种全新的工作负载,一个提示即可启动包含推理、资讯检索、工具调用以及回应生成等长达数千步骤的运算流程。Vera Rubin 正是为此而生。」他也强调AI 已从成本项目转变为真正的获利引擎与GDP 生成器。

据供应链消息,Vera Rubin 的量产出货预计于今年秋季正式展开,2026 年Q4 出货量将攀升至25 到30 万颗GPU(约3,500 台整机),2027 年Q1 进入全行业大规模交付。 NVIDIA 同时导入已量产的Spectrum-X 乙太网络光子技术,结合共同封装光学(CPO)技术,实现百万GPU 规模的AI 工厂网络架构。这项技术使用200Gb/s SerDes 的交换器,能源效率比传统可插拔收发器提升5 倍,AI 正常运作时间延长5 倍,部署速度提升1.3 倍。根据NVIDIA 官方数据,Vera Rubin 在大规模部署下的代理资料输送量比Grace Blackwell 平台高出10 倍,且系统已通过开源MGX 架构设计的验证,确保供应链中的数百家合作伙伴可以快速跟进量产。 CoreWeave、Lambda 和Oracle Cloud Infrastructure 是第一波采用CPO 网络的云端业者,其中CoreWeave 已公开表示其Rubin 机柜的Token 输出量确实达到上一代的10 倍,而非仅停留在NVIDIA 的公版宣称数字。

结语

NVIDIA 这次直接在官方推文中点名微软团队庆祝装机,凸显双方的战略伙伴关系。微软需要最新的Rubin 硬体来维持Azure AI 在模型训练与推理服务上的竞争力,NVIDIA 则需要微软这种等级的首发客户来验证Vera Rubin 的量产成熟度与大规模部署能力。随着AWS、百度Cloud 与CoreWeave 等业者随后跟进,2026 下半年到2027 年将是AI 运算基础设施从Blackwell 世代全面转移到Rubin 世代的关键时期。半导体产业协会(SIA)数据显示,2026 年5 月全球半导体销售额已达1,206 亿美元,年增104%,这个数字背后的驱动力很大一部分来自超大规模资料中心对AI 运算晶片的旺盛需求。 Vera Rubin 的量产与部署将进一步推动这波产业循环。

(0)
麦克哥麦克哥

相关推荐

发表回复

您的电子邮箱地址不会被公开。 必填项已用 * 标注