![]()
在Hot Chips 2026大会上,英伟达进一步披露了面向代理式数据中心(agentic data centers)的下一代Vera CPU关键细节。作为首款采用英伟达定制核心的CPU,Vera继承了此前基于标准Arm设计的Grace系列基因,但以单一SKU形式发售,拥有88个核心。
与x86竞争对手相比,Vera在设计上呈现三大显著差异:采用“空间多线程”(spatial multi-threading)技术、搭载LPDDR5X内存子系统,以及使用单体计算芯片(monolithic compute die)而非计算芯粒(chiplets)架构。
专为代理式AI打造
英伟达表示,Vera专为代理式AI工作负载设计。尽管该类别的性能基准测试尚在定义中,且完整代理链的测量复杂不一,但英伟达称代理式AI是“历史上最复杂的计算工作负载”。
通过无头浏览器(headless browser)示例,英伟达展示了Vera的优势。在与拥有96核心的AMD EPYC 9655P对比中,随着浏览器实例规模扩大,Vera的运行速度提升了24%。此外,通过剔除GUI渲染等非必要环节,智能体浏览工作流速度可提高4.5倍。
代码编译是另一项关键参考指标。数据显示,在使用原生AArch64目标编译Linux内核时,Vera比EPYC 9655P快22%;在交叉编译为x86架构时,速度快14%。
空间多线程与低功耗内存
Vera内置的Olympus核心具备大型分支预测单元(BPU)、神经分支预测器及10宽度指令解码能力。其采用的“空间多线程”技术将核心资源分离到两个流水线中,允许数据和缓存在线程间移动。SPEC CPU 2017测试显示,相比传统SMT导致资源时间片分割,Vera的空间多线程能更确定性处理相邻线程需求,减少“噪音邻居”效应带来的性能波动。
系统层面,Vera选用LPDDR5X而非传统RDIMM内存,并通过SOCAMM2设计提升可服务性。每个Vera CPU主板包含8个SOCAMM2插槽,提供高达1.5 TB容量和1.2 TB/s带宽。美光数据显示,其LPDDR5X功耗约为传统RDIMM的三分之一。英伟达指出,满载Vera内存系统功耗仅为30W至40W,而同等配置下RDIMM功耗易超过100W。
市场部署与竞争格局
尽管Grace服务器已部署数十万台,Vera标志着英伟达在代理式CPU市场的首次重大举措。该产品已开始大规模部署,英伟达昨日宣布在SpaceX AI中启用Vera。
在归一化单核性能对比中,Vera在总分上以3%优势领先AMD EPYC 9755。然而,Vera的真正对手并非Turin,而是AMD于6月推出的Venice,以及Intel近期公布的Diamond Rapids。未来几代产品中,英伟达是否会加倍投入代理式工作负载或进行产品细分,仍有待观察。
【星途科讯 图文丨踢三脚 首发于ZAKER科技,转载请注明出处】
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.