英伟达开始按柜出货Vera Rubin,每天最高1000机柜

智能体时代的算力工厂来了

2026-07-27 10:49
英伟达Vera Rubin NVL72机柜
英伟达Vera Rubin NVL72机柜

英伟达的AI硬件战略进入了一个全新阶段。

7月27日,英伟达硬件工程高级副总裁Andrew Bell透露,Vera Rubin NVL72已进入规模化量产阶段,通过约十家制造伙伴,最终能做到每天产出最高1000个机柜。更关键的是,CoreWeave、Google Cloud、Microsoft Azure和Oracle Cloud等头部云厂商的机架已投入运行。

Vera Rubin NVL72是一个机架级系统,内部塞着72颗Rubin GPU和36颗Vera CPU,GPU与CPU的比例恰好2比1。这个比例不是随意定的——它反映的是智能体时代的新分工:GPU专心跑模型推理,CPU负责数据管道、工具调用和编排任务,每颗Vera「照看」两颗Rubin。

最让人惊讶的是硬件工程上的减法。Vera Rubin的机箱内部没有线缆、没有风扇、也没有软管,计算模块的组装时间从过去的数小时压缩到了1分钟。液冷入口温度设计在45摄氏度,可以做到不需要冷水机的干式冷却运行。对要铺几千个柜的云厂商来说,这种「开箱即算力」的省心,和芯片性能一样值钱。

性能数据也很扎实。CoreWeave的实测显示,在DeepSeek-R1推理任务上,Vera Rubin每兆瓦吞吐量比上一代Grace Blackwell提升了整整10倍。单柜价格700万到800万美元,Grace Blackwell 300是500万美元——涨价显然不是因为芯片本身,而是英伟达已经把GPU、CPU、网络、散热、软件全部打包进了这一个柜子里。

这颗Vera CPU本身就是大新闻。搭载了88颗英伟达自研的Olympus核心,单线程性能是竞品的2倍,核间带宽3倍,内存延迟降低40%。英伟达没有去做一颗面面俱到的通用芯片,而是为智能体负载专门定制了这颗CPU——这个路线选择暴露了英伟达对AI未来的判断:未来的算力瓶颈不在单核性能,而在编排效率和每瓦产出。

按英伟达的规划,Rubin这一代CPU单项营收就要瞄着200亿美元。当一家GPU公司开始按柜出货、自研CPU、在全球30个国家搭建供应链——它已经不只是芯片公司了。