网易首页 > 网易号 > 正文 申请入驻

最新英伟达经济学:每美元性能是AMD的15倍,买越多省越多是真的

0
分享至

梦晨 发自 凹非寺量子位 | 公众号 QbitAI

为什么AI算力霸主永远是英伟达?

不算不知道,一算吓一跳:在英伟达平台每花一美元,获得的性能是AMD的15倍。

尽管英伟达卖的更贵,但只要买齐一套,就更省钱。



来自Signal65的一份最新详尽报告揭示了这个现实,一定条件下生成同样数量的token,英伟达的成本只有AMD的十五分之一。

这份报告基于SemiAnalysis Inference MAX的公开基准测试数据,时间跨度从2025年10月到12月,覆盖了从密集模型到前沿MoE推理模型的全场景测试。



黄仁勋的“买的越多,省的越多”原来是真的。



MoE时代:8卡系统撞上Scaling天花板

AI模型正在经历一场架构革命,打开Artificial Analysis排行榜就会发现,智能度排名前十的开源模型清一色都是MoE(Mixture of Experts,专家混合)推理模型。



另一项来自OpenRouter的数据显示,超过50%的token流量正在被路由到推理模型上。



MoE架构的核心思路是把模型参数拆分成多个专门化的“专家”子网络,每个token只激活其中一小部分。

以经典的DeepSeek-R1为例,它拥有6710亿总参数,但每个token只激活370亿——这让它能以更低的计算成本提供前沿级别的智能。



问题随之而来。当专家分布在多块GPU上时,GPU之间的通信延迟会导致计算单元空闲等待数据,这些空闲时间直接转化为服务商的成本。

报告指出,无论是英伟达B200还是AMD MI355X,所有8卡系统在超出单节点规模后都会撞上“扩展天花板”(scaling ceiling)。

英伟达GB200 NVL72的解法是把72块GPU通过NVLink连接成一个单一域,提供130 TB/s的互联带宽。

在软件层面,整个系统就像一块巨型GPU一样运作。配合英伟达Dynamo推理框架的分离式预填充-解码调度和动态KV缓存路由,这套架构能够有效突破8卡系统的通信瓶颈。

模型越复杂,英伟达的优势越明显

报告测试了三类典型模型:模型越复杂,英伟达的优势越明显。

在密集模型Llama 3.3 70B上,英伟达B200对比AMD MI355X的领先幅度相对温和。

在基线交互性(30 tokens/sec/user)下,B200的性能约为MI355X的1.8倍;当交互性要求提升到110 tokens/sec/user时,这一差距扩大到6倍以上。



中等规模的MoE模型GPT-OSS-120B开始让差距变得更加显著。

这款OpenAI开源模型拥有1170亿总参数,但每个token只激活约51亿参数。在2025年12月的测试数据中,100 tokens/sec/user交互性下B200的性能接近MI355X的3倍。

在更符合推理模型需求的250 tokens/sec/user条件下,差距扩大到6.6倍。



两个平台的绝对性能相比10月都有显著提升,英伟达的峰值吞吐从约7000 tokens/sec跃升至14000以上,AMD则从约6000提升到8500左右,但相对差距反而拉大了。



真正的分水岭出现在前沿推理模型DeepSeek-R1上。

这款模型集MoE路由、大参数规模和高强度推理生成于一身,对基础设施的要求极为苛刻。

测试结果显示:在25 tokens/sec/user交互性下,GB200 NVL72的每GPU性能是H200的10倍、MI325X的16倍;在60 tokens/sec/user下,相比H200的优势扩大到24倍,相比MI355X达到11.5倍;在75 tokens/sec/user下,GB200 NVL72的性能是B200单节点配置的6.5倍,是MI355X的28倍。



更关键的是,GB200 NVL72能够达到竞争平台根本无法企及的水平,在28卡配置下可以输出超过275 tokens/sec/user,而MI355X在相当吞吐水平下的峰值只有75 tokens/sec/user。

Token经济学:贵了1.86倍,便宜了15倍

直觉上,性能更强的平台应该更贵。事实也确实如此:根据Oracle Cloud的公开定价,GB200 NVL72的每GPU每小时价格为16美元,MI355X为8.60美元,前者是后者的1.86倍。

如果参照CoreWeave的定价,GB200 NVL72相比上一代H200的价格也贵了约1.67倍。



但报告的计算揭示了一个反直觉的结论:

在25 tokens/sec/user交互性下,GB200 NVL72的性能优势为5.85倍,除以1.86倍的价格溢价,每美元性能仍是MI355X的3.1倍。

在75 tokens/sec/user交互性下,28倍的性能优势除以1.86倍的价格,每美元性能达到MI355X的15倍,这意味着生成同等数量的token,英伟达平台的成本只有AMD的十五分之一。



与上一代产品的对比同样惊人。

报告估算在DeepSeek-R1的典型工作负载下,GB200 NVL72相比H200的性能提升约20倍。



而GB200 NVL72价格仅上涨1.67倍,换算下来每美元性能提升约12倍,单token成本降至H200的十二分之一。



MoE推理让网络成为推理成本的瓶颈,而机柜级的GB200 NVL72恰好解决了这个问题。价值的衡量标准正在从单纯的算力转向“每美元能产出多少智能”。

报告在结论中指出,AMD的竞争力并未被完全否定——在密集模型和容量驱动的场景下,MI325X和MI355X仍有用武之地。

AMD的机柜级解决方案Helios也在开发中,可能在未来12个月内缩小差距。

但就当前的前沿推理模型而言,从芯片到互联到软件的端到端平台设计,已经成为成本效益的决定性因素。


[1]https://signal65.com/research/ai/from-dense-to-mixture-of-experts-the-new-economics-of-ai-inference/

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
绍伊古抵达中国

绍伊古抵达中国

参考消息
2026-02-01 20:03:05
随着尤文图斯4-1,国际米兰2-0,科莫0-0,意甲最新积分榜出炉

随着尤文图斯4-1,国际米兰2-0,科莫0-0,意甲最新积分榜出炉

侧身凌空斩
2026-02-02 06:06:19
赵睿承认错误:扳平两罚不中很不应该 许利民回应质疑是无事生非

赵睿承认错误:扳平两罚不中很不应该 许利民回应质疑是无事生非

醉卧浮生
2026-02-01 22:37:08
儿子丢了、父亲走了、妻子跑了,央视主持张泽群如今落到这般田地

儿子丢了、父亲走了、妻子跑了,央视主持张泽群如今落到这般田地

蜉蝣说
2026-01-31 15:10:43
善恶到头终有报!68岁瘫在轮椅上的张铁林,如今的下场怪不了别人

善恶到头终有报!68岁瘫在轮椅上的张铁林,如今的下场怪不了别人

草莓解说体育
2026-02-01 19:54:59
德约:阿尔卡拉斯还有大把时光,未来10年我们还会交手很多次

德约:阿尔卡拉斯还有大把时光,未来10年我们还会交手很多次

懂球帝
2026-02-01 20:46:10
狱中离世14年后获无罪,当事人律师发声

狱中离世14年后获无罪,当事人律师发声

澎湃新闻
2026-02-01 11:55:05
十二生肖守护佛:你的专属佛缘与祝福

十二生肖守护佛:你的专属佛缘与祝福

霁枫
2026-02-01 10:53:12
我娶了县长痴呆25年的女儿,晚上我准备打地铺,她说:不许睡地上

我娶了县长痴呆25年的女儿,晚上我准备打地铺,她说:不许睡地上

千秋文化
2026-01-05 22:15:53
海外失联十几天!28岁中国留学生仍未找到,曾给家人发信息……

海外失联十几天!28岁中国留学生仍未找到,曾给家人发信息……

环球网资讯
2026-02-02 09:09:18
郑爽彻底垮了!抱娃与张恒当街互撕,穿搭邋遢状态诡异疑精神失常

郑爽彻底垮了!抱娃与张恒当街互撕,穿搭邋遢状态诡异疑精神失常

八卦王者
2026-02-01 21:14:07
艾滋病数据冲上热搜,背后是你看不到的性需求

艾滋病数据冲上热搜,背后是你看不到的性需求

十点读书
2026-02-01 18:38:37
第一批独生子女的扎心现实:父母去世后,成了举目无亲的“孤儿”

第一批独生子女的扎心现实:父母去世后,成了举目无亲的“孤儿”

千秋文化
2026-02-01 20:31:47
6亿播放,全网追更,国内最生猛“创业真人秀”让我老实打工

6亿播放,全网追更,国内最生猛“创业真人秀”让我老实打工

新周刊
2026-01-31 16:07:20
陈松伶自曝晚年将住养老院!遗产早被惦记,外甥女:所有都是我的

陈松伶自曝晚年将住养老院!遗产早被惦记,外甥女:所有都是我的

科学发掘
2026-02-01 01:25:59
90后产妇生娃时遇上"生理需求",男医生:见怪不怪,现场解决

90后产妇生娃时遇上"生理需求",男医生:见怪不怪,现场解决

大果小果妈妈
2026-01-15 20:13:44
中超“恒大系”复燃?曝郑智刚上任,就招募多名前恒大队友加盟!

中超“恒大系”复燃?曝郑智刚上任,就招募多名前恒大队友加盟!

罗掌柜体育
2026-02-01 10:52:47
即日起:广州城区1小时18分钟抵茂!不用去广州白云站了!

即日起:广州城区1小时18分钟抵茂!不用去广州白云站了!

茂名油城圈
2026-02-02 00:11:34
张雪峰:本科已严重饱和的五个专业,1、临床医学,2、法学,3、计算机…考研是唯一出路!

张雪峰:本科已严重饱和的五个专业,1、临床医学,2、法学,3、计算机…考研是唯一出路!

李东阳朋友圈
2025-08-22 09:31:34
2月3日,油价将迎调整

2月3日,油价将迎调整

财闻
2026-02-01 22:36:02
2026-02-02 11:11:00
量子位 incentive-icons
量子位
追踪人工智能动态
12092文章数 176369关注度
往期回顾 全部

科技要闻

元宝发10亿红包,阿里千问:我跟30亿

头条要闻

汽车销售巨头破产清算:总部人去楼空 子公司贴上封条

头条要闻

汽车销售巨头破产清算:总部人去楼空 子公司贴上封条

体育要闻

德约大度祝贺阿卡 幽默互动逗笑纳达尔

娱乐要闻

周杰伦带王俊凯陈奕迅聚餐 畅聊音乐

财经要闻

国六货车被迫"换头" 每次收费超200元

汽车要闻

岚图汽车1月交付10515辆 同比增长31%

态度原创

游戏
数码
家居
亲子
公开课

《仁王3》试玩版Steam最高在线人数近4万!远超初代

数码要闻

罗技新鼠标:敢说改变你游戏方式

家居要闻

现代几何彩拼 智焕童梦居

亲子要闻

2-5岁孩子如何在家做早教?用好这些小道具,孩子进步超快!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版