OpenAI自研的Jalapeño ASIC正在内部部署,与之搭配的是AMD EPYC Turin主机,每台配备1.5TB内存。SemiAnalysis在Jalapeño芯片发布后描述了这一机架级部署,我们就此采访了OpenAI硬件副总裁兼负责人Richard Ho。
Ho告诉我们,选择Turin的决定是“务实的”,并称英伟达的新款Vera CPU“在成熟度上稍微落后了一点”。
![]()
“务实”两个字,藏着一整套取舍
Ho的原话是:“我们做那个设计的方式,核心就是降低风险、能够快速完成设计。Vera作为独立产品,在成熟度上稍微落后了一点。Turin这款设备很强。它做到了我们需要的事,而且部分合作伙伴对它已经有经验。”
他进一步解释:“对于Jalapeño项目,我们试图做非常务实的决策。我们想在性能和成本目标上保持激进,但不想承担不必要的风险。那感觉是一个好的设计决策,符合我们做这类设计决策的参数范围。”
这段话的分量在于,它不是技术优劣的评判,而是工程节奏的评判。
1.8倍的宣传,和3%的真相
英伟达在Vera的对外口径上一直很猛。它把基于Arm的Vera拿来和x86阵营对比,宣称对AMD Turin竞品有高达1.8倍的提升。
但这个数字的算法值得拆开看。据SemiAnalysis,它是把SPEC CPU 2026的总分按每核心拆开算出来的。看整体分数,Vera只领先AMD的EPYC 9755大约3%。
英伟达展示的图表里,Vera确实领先到1.8倍。可一旦回到整体成绩,差距就收窄到3%。同一份基准测试,两种读法,两个世界。
这也是为什么Ho的表态没有去碰AArch64和x86的架构之争。他谈的是Turin和Vera之间的动态,而不是指令集层面的路线站队。
Arm阵营的雄心,和现实的渗透率
市面上基于Arm的CPU已经不少,很多超大规模云厂商都在内部部署,比如谷歌云的Axiom和AWS的Graviton。Vera和Arm自家的AGI被描述为“智能体CPU”,号称相比AMD和英特尔的x86产品,能加速智能体循环中复杂的推理过程。
Arm长期宣传AArch64指令集相对x86的优势,甚至声称自家AGI CPU的性能是现代x86平台的两倍以上。但这个说法基于内部估算,不是真实基准测试。
Arm对AGI的市场 adoption 自然乐观。可即便拿到了20亿美元的承诺,分析师认为两年后的市场渗透率仍将是低个位数。
从Graviton到Azure的Cobalt,很多半定制的Arm设计聚焦的是核心密度和云工作负载的效率。Vera和AGI则转向了峰值性能的宣传口径。这是一次叙事重心的迁移。
为什么Turin是此刻的答案
有意思的地方在于,OpenAI既是Arm AGI的部署伙伴之一,也在英伟达口中“探索Vera CPU”的客户名单上。前沿实验室和超大规模厂商的机队里,从来都是多种硬件并存。
把Jalapeño和Turin配对,核心考量是降低风险。Ho指向的是平台的成熟度。宽泛地说,x86_64比AArch64更成熟;Arm从1980年代中期就存在,但真正的64位扩展比x86晚了12年才出现。
过去二十年Arm一路挤进数据中心,可x86的根基仍然深得多,往回追溯有几十年的积累。
另一个细节是维护性。Vera是板载的,Turin是插槽式的。服务器里换芯片本来就不常见,但Turin换起来更容易。对于要快速铺开的机架级部署,这种差别会被放大。
Ho提到合作伙伴对Turin有经验,这句话暴露了硬件团队当时的思考位置——他们需要的是已经被验证过的东西,而不是需要一起磨合的新平台。
OpenAI的机队里有大量硬件可选,未来Jalapeño完全可能换一套主机系统,也许配上Arm的AGI,也许配上英伟达的Vera。但就现在而言,Turin是合适的选择。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.