随手先关注,不错过每日AI热讯速递
①
8 月 25 日,OpenAI 在Hot Chips(全球顶级芯片架构会议,厂商在此公布下一代芯片细节)上首次公布自研推理芯片Jalapeño的实测结果。
这是 OpenAI 第一颗自研芯片,只承担推理(让模型在训练后实际回答问题、生成内容的过程),不参与训练[2]。
OpenAI 硬件负责人Richard Ho在媒体会上称,结果显示其性能相对现有技术水平的领先非常显著[1]。
测试采用SemiAnalysis发布的公开基准InferenceX,覆盖GPT-OSS 120B、DeepSeek R1 670BKimi K2.5 1T三个模型[1][2]。
对比对象是英伟达商用系统:GPT-OSS 120B 对GB200,DeepSeek R1 与 Kimi K2.5 对GB300[2]。
Jalapeño 用更低的功耗跑出了更高的吞吐[2]。
![]()
②
核心数据上,Jalapeño 在三个模型上单位功耗峰值吞吐比商用系统提升1.5 至 1.9 倍,端到端延迟降低1.7 至 3.6 倍,交互式负载性能提升2.1 至 4.1 倍[2]。
以 DeepSeek R1 为例,每千瓦吞吐约为对比系统的1.7 倍,端到端延迟降低 3.6 倍;Kimi K2.5 延迟降低 3.4 倍[2]。
更极端的是同等解码速度下的对比:Jalapeño 每千瓦 token 吞吐是现有最佳加速器的54 至 104 倍(视模型而定)[2]。
SemiAnalysis CEODylan Patel评价称,第一代芯片通常不具竞争力,但 OpenAI 正在击败英伟达 Blackwell 甚至 Rubin[2]。
需要说明的是,Jalapeño 没有使用多 token 预测、投机解码(用猜测多个后续词加速生成的解码优化技术)等技巧,而部分对比系统用了——它的成绩还有进一步空间[2]。
![]()
图:SemiAnalysis 性能对比信息图——同等解码速度下,Jalapeño 在 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 上每千瓦 token 吞吐为对比系统的 54-104 倍(来源:[2])
③
开发速度是另一个看点。OpenAI 与博通(Broadcom)合作开发,设计于2024 年中期启动,2025 年 11 月送交流片[1][2]。
完整周期约16 个月;OpenAI 称从首个芯片设计到流片蓝图只用了9 个月[1][2]。
开发过程中,OpenAI 自家 AI 模型直接参与了芯片设计与优化[2]。
OpenAI 表示,Jalapeño 只是一个多代际平台的开端——Gen 2 深度开发中、Gen 3 成形中,并计划2026 年底开始在自有算力设施中小规模部署,2027 年扩大规模[1][2]。
CFOSarah Friar同日发文阐述全栈战略:数据中心、芯片、模型、开发者平台、产品、设备一体设计。她强调,Jalapeño 是补充而非替代——OpenAI 将继续广泛部署英伟达等合作伙伴的加速器[2]。
④
争议同样存在。SemiAnalysis 指出,更公平的对比对象应是同为 HBM4 内存的Vera Rubin平台:Jalapeño 每兆瓦输出 token 仍更多,但每 token总拥有成本与 Rubin 大致持平[2]。
而且 Rubin 系统已向客户发货,Jalapeño据报道尚未走出工程样品阶段;英伟达与 AMD 已公布在 DeepSeek V4 Pro、Kimi K3 等更大模型上的成绩,这些模型还没在 Jalapeño 上测过[2]。
即便如此,SemiAnalysis 认为英伟达的CUDA 护城河可能已经失效——OpenAI 能在自家芯片上如此快地适配新模型,削弱了软件生态壁垒[2]。
对国内关注者而言,这传递的信号很直接:头部大模型公司正在加速算力自主化,推理成本将成为决定模型公司能否大规模盈利的关键变量。英伟达是 OpenAI 最大的投资者与算力伙伴之一,双方关系兼具合作与竞争[2]。
希望这篇文章能帮你快速看清 OpenAI 自研芯片的进展。欢迎在评论区分享你对自研芯片浪潮的看法。
参考来源:
[1] TechCrunch:OpenAI's Jalapeño chip is built for fast inference at scale, benchmarks showhttps://techcrunch.com/2026/08/25/openais-jalapeno-chip-is-built-for-fast-inference-at-scale-benchmarks-show
[2] The Decoder:OpenAI's first custom chip “Jalapeño” reportedly beats Nvidia's Blackwell and Rubin in inference benchmarkshttps://the-decoder.com/openais-first-custom-chip-jalapeno-reportedly-beats-nvidias-blackwell-and-rubin-in-inference-benchmarks
欢迎分享、点赞、推荐
一起拥抱AI
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.