英伟达称已出货数十万台Grace独立服务器,CPU在智体AI数据中心地位上升

英伟达的数据中心CPU业务已悄然扩展至远超市场预期的规模。该公司超大规模与高性能计算副总裁、CUDA发明者Ian Buck透露,英伟达已出货”数十万台”Grace独立服务器,标志着该公司在谈论其在AI数据中心内部角色方面的决定性转变。

这一数字为英伟达多年来一直在构建的战略提供了实际部署数据支撑。今年5月,该公司披露Grace CPU总出货量超过250万台,但其中包括Grace与GPU配对的Superchip配置。Buck的言论表明,仅搭载CPU的独立版本现在正占据该总量的重要且不断增长的份额。

CPU的转变

这一里程碑正值AI数据中心的架构正在经历结构性变革之际。训练大型模型仍需要大量的GPU集群。但随着AI应用从训练转向生产,计算的天平正在发生转移。智体AI工作负载,模型调用工具、运行代码、编排管道和评估结果,产生了纯GPU机架无法经济地服务的CPU密集型需求。

“几年前你会看到训练时为每个CPU配备八个GPU。现在在一些智体部署中,这一比例正趋向于一比一,”Buck告诉Tom’s Hardware。

英伟达的Grace CPU搭载72个Arm Neoverse V2核心,主频高达3.35 GHz,单芯片配置最高配备480 GB LPDDR5X内存,双芯片Superchip配置则为960 GB。LPDDR5X内存提供高达每秒1 TB的带宽,同时功耗约为传统DDR5的五分之一,使其对面临能源限制的数据中心运营商具有吸引力。

Vera即将到来

Grace的业绩为英伟达的下一代Vera CPU奠定了基础,该公司于今年1月在CES上首次亮相。Vera采用英伟达首个定制核心设计Olympus,拥有88个核心,支持同步多线程和机密计算。首批Vera系统已于5月交付给Anthropic、OpenAI、SpaceXAI和Oracle Cloud Infrastructure。

英伟达认为数据中心CPU是一个2000亿美元的总可寻址市场机会,这一预测明显比行业共识的到2030年约1200亿美元(约950亿英镑)更为乐观。摩根士丹利在4月份估计,仅智体AI一项就可能为该数字增加多达600亿美元(约480亿英镑)。

Meta作为关键客户

Meta一直是独立Grace服务器最显著的早期采用者。该社交网络将CPU部署在纯CPU系统中,用于通用和智体AI工作负载,并且据Buck称,已经对Vera在一些工作负载上进行了测试,结果”非常有前景”。

Meta的采用与亚马逊Graviton和谷歌Axion所代表的更广泛的超大规模企业定制Arm CPU趋势背道而驰。该公司计划部署数百万个英伟达GB300和Vera Rubin Superchip,并已扩大与英伟达的合作,涵盖GPU、CPU和Spectrum-X网络组件。

来源:英伟达已出货”数十万台”Grace独立服务器 (Tom’s Hardware,2026年7月); Meta已在规模部署英伟达独立CPU (The Register,2026年2月); Vera到来:英伟达首款面向智能体构建的CPU (英伟达博客,2026年5月)

婷 翻译

Scroll to Top