Nvidia强调Vera CPU单线程性能是代理式AI编排的关键

Nvidia正将其Vera CPU,一款现已全面投产的88核Arm处理器,围绕一个该公司鲜少领先的指标进行定位:单线程性能。该公司认为,这对于代理式AI的”快速思考、验证和编排”工作负载至关重要。

该芯片于3月在GTC上发布,将于2026年下半年在Dell、HPE、Lenovo和Supermicro的系统中出货。Vera采用基于Arm v9.2构建的Nvidia定制Olympus核心。每个核心采用Nvidia的Spatial Multithreading技术,通过物理划分资源而非时间切片的方式运行两个硬件线程,整个芯片可提供176个线程。

单线程为何对代理至关重要。 Nvidia的论点是,代理式AI系统,规划任务、执行代码、查询数据库、调用工具和验证结果,与传统批处理AI工作负载有着根本性的不同。它们需要多步骤推理链中每一步都能快速、低延迟地响应,这在很大程度上取决于每核心吞吐量而非原始核心数量。Phoronix发布的基准测试显示,Vera在AI相关的CPU工作负载中,特别是在内存带宽敏感的任务上,性能优于Intel和AMD。

Vera提供的内存带宽是其前代Grace的2.4倍,配备1.5 TB的LPDDR5X内存和第二代Scalable Coherency Fabric,可在负载下维持超过90%的峰值带宽。Nvidia表示,一个集成了256个液冷Vera CPU的机架可支持超过22,500个并发代理环境。

Help us build a better way to report the news—carefully researched, transparent, and free from clickbait.

Support independent reporting

生态系统采用情况。 早期采用者包括Meta、Oracle Cloud Infrastructure、Alibaba Cloud和CoreWeave。Los Alamos National Laboratory、Lawrence Berkeley National Lab和Texas Advanced Computing Center等研究机构也在规划部署。

Vera CPU是Nvidia六组件Vera Rubin平台的核心,该平台为额定性能达14.4 exaFLOPS(FP4)的NVL72机架提供动力。Bank of America预计,在代理式编排需求的推动下,数据中心CPU市场将从270亿美元增长到2030年的600亿美元,规模翻一番。

来源: NVIDIA Newsroom、Phoronix、WinBuzzer

婷 翻译

Scroll to Top