网易首页 > 网易号 > 正文 申请入驻

Kimi K3时刻:中美AI产业链叙事要变天?

0
分享至


上周全球市场直接把大家跌懵了,真假小作文趁机甚嚣尘上。除了韩国加息、地缘问题导致的流动性去杠杆因素外,另一个市场相对一致性的大跌归因——K3大模型的发布也被拿来反复讨论,以及与此一同被抬出来还有“中美竞争”的老生常谈。

K3所代表的中国大模型明显缩短了前沿大模型的追赶进程,并且还依赖本身的成本优势(模型架构、人才、电力等)、开源优势给终端用户增加了优质大模型的另一个选择。

笔者认为,K3受制于短期算力供给,在性价比和输出速度上并不存在优势,因此实际短期对闭源模型龙头影响有限,但开源模型首次大幅缩小与顶尖闭源模型的技术差距,意义重大,也是纯大模型商业模式边际恶化的一次拐点。

对于独立AI Lab来说,很可能会因此拉长头部大模型厂商扭亏为盈的拐点等待期。

但这并不代表AI全行业的商业模式证伪。开源大模型的技术突破,短期给资金雄厚的追赶者们、中小企业本地部署需求增加大参数量模型的投入信心,中长期则因为开源模型降低门槛,加速AI大模型的大宗商品化进程,提高全行业的AI渗透,最终促使中游CSP等企业服务、下游C端应用层高速发展期的更快到来,共同做大AI的增量蛋糕。

#01

当大模型竞争开始蔓延到头部

今年上半年,头部模型Lab密集发布各自的前沿大模型。就更新频次上,北美依旧是Anthropic和OpenAI保持模型创新的主要战斗力,xAI、Meta、Google紧随其后。中国大模型虽然并不领先,但生态则是百家争鸣。


企业端极其看重模型质量,因此一路领先的Anthropic在ARR表现上是一超多强。2月,Anthropic搬出口碑超预期的Opus 4.6,流水ARR重新加速。从25年四季度月均增速9% MoM,一下子飙至2026年1-2月的25% MoM。

随后的Opus 4.7、4.8虽不如当初的Opus 4.6带来的惊艳(体验升级的超预期幅度),但总归性能不断上升,以及同行中直到4月Open AI才搬出能与之有一战之力的GPT-5.5,因此Anthropic迎来了专属于自己的“春天”,从3月至6月,ARR月环比增速保持在30%以上。


但独立C端用户上,价格是第一考虑因素,因此中国大模型靠着性价比+开源优势,在OpenRouter渠道(个人和中小团队用户为主)的Token用量占比持续上升,6月起已经正式超过美国大模型,从而结构性的带动整体Token单价从2026年开始出现了一波下滑。


两个阵营原本相安无事,各自扫好门前雪。企业高端需求继续被Anthropic拿捏,Fable一会关一会开,部分需求悄悄转移到了OpenAI、智谱。个人普通需求中,除了一部分默默薅腾讯HY3.0的免费羊毛,其他需求则继续享受DeepSeek、小米、Minimax等高性价比方案。

但作为AI商业模式最易落地的场景,Coding市场蛋糕原本已被Anthropic独吞。很快我们看到北美的OpenAI、Google,以及中国的智谱、Kimi在研发目标上的战略调整,集中算力资源提升大模型的Coding能力。

进入7月,战火才真正燃了起来:

(1)首先是北美内部互撕,OpenAI推出的GPT 5.6-Sol性能上快速看齐Fable 5。比较Artificial Analysis智能评分和Arena投票打分,两者差距都已经非常小。

而Sol的单价只有Fable 5的30%,Artificial Analysis评测的单任务成本指标里,Sol也只有Fable 5的38%。

(2)其次是东方卷王中国大模型的跃跃欲试,上周Kimi带着一款智能性同样可以归为一梯队的基模K3,打入了Anthropic和OpenAI的核心阵营。

K3的AA智能评分仅仅位列Fable、Sol之后,而靠着长周期任务的Agent优势,K3甚至在Arena榜单中被投成了榜一。

下图为各家AI Lab最前沿大模型的AA智能评分,虚线代表北美厂商,实线代表中国厂商。可以看到,综合实力看北美厂商依旧有优势,但二季度以来,智谱、Kimi先后进入TOP 5,与老大Anthropic的研发差距已经从6-12个月缩短到3个月。


#02

K3短期竞争影响有限、但意义重大

作为继DeepSeek之后第二个令全球印象深刻的中国之光,Kimi K3是纸面实力还是真硬气?相对一梯队的同行又有哪些优劣势?

1. 除了中国特色,大模型迭代还是“越大越好”

Kimi K3是一款开源权重大模型,除了最底层的代码和训练数据库不公开外,其他部分会在7月27日全网开源。在第三方评测的核心指标榜单上,K3均排在前列,部分指标(来自Arena的前段代码领域)甚至被评到第一。

总的来说,K3的优势在前端开发和智能体上,UI审美高级、网页生成完成度较高,也更擅长处理长周期多工程任务。

而上述核心能力提升,主要源于总参数规模明显扩大、相比于其他同期的中国大模型,K3的总参数量达到了2.8万亿,将DeepSeek V4的1.6万亿刷新了最高记录。

不过这个参数量仍然不能和GPT 5.6、Fable 5差不多5-10万亿级别的量级相比,所以为了继续提高性能,无论是闭源还是开源,目前大模型的迭代思路仍然是遵循Scaling Law规律,因此未来最前沿的大模型,在参数量大幅提升的趋势是非常明确的。


2. 实际性价比不高

K3发布后,Anthropic宣布将Fable 5从7月20日起永久性纳入Max及Team订阅体系。但实话说,至少目前为止Kimi K3的性价比并不高,尤其是和GPT-5.6-Sol相比。

在单价低一半下,K3的Token使用效率偏低、推理速度偏慢,这使得从实际执行任务的角度,K3消耗成本相比GPT-5.6-Sol只便宜了10%(0.95/1.04=91%)。


在下图的“智能性&单任务成本”综合对比表中,也不属于“绿色”的综合优势领域。


从结果看,似乎Kimi并不具备性价比。但底层技术路线上,Kimi仍然在致力于提高训练效率。其中两个核心技术的创新,据Kimi自己说相比上一版本的大模型K2,带来了2.5x的缩放效率的提升。

中国AI Lab往往受困于高端芯片供应和资金短缺(独立模型厂商),导致训练大模型时并不能像欧美龙头一样随心所欲。比如大模型整体性能强悍的Anthropic,目前仍主要用Dense稠密模型架构,意味着每一次Token的处理,都需要每个参数参与计算。

而每此运行时只激活其中小部分参数的MoE稀疏架构,则成为中国开源大模型厂商退而求其次的最优选择(OpenAI自GPT-4起也开始采用)。

2024年初DeepSeek就是通过对MoE稀释架构做了显著的工程优化,将训练效率和成本进一步得到了很大改善,引起全球侧目,也是影响行业发展方向的里程碑时刻。

而Kimi的K3大模型则通过继续扩大模型稀疏度,从而降低了无效算力消耗,每次运行激活率不足2%(该架构一共设置896个专家,每次激活16个)。

K3的有效激活率再次刷新了此前DeepSeek V4 Pro创下的3%记录,而性能接近的GLM-5.2,激活率则有5%。同梯队的北美大模型,甚至大多处于10%的激活率。每次运行时专家激活率越低,越能减少训练过程中的冗余计算量,从而使得训练效果和运行效率得到显著优化。

除此之外,K3对训练效率的提升还得于另外两个自研核心技术——KDA(Kimi Delta Attention)和注意力残差机制

后者“注意力残差机制”主要是解决大模型在深度场景的信息传递问题,减少因模型层数扩张、加深而带来信息传递损耗问题。

这两个技术都是用来解决传统Transformer(采用全注意力)在“长上下文”上的弊端:一个是在训练阶段的算力消耗较高,另一个则是在推理解码阶段对KV Cache占用空间过大。当下前沿大模型已经大多为100万Token,未来有希望继续向上突破。因此针对上下文的算力瓶颈,是全行业需要解决的核心问题。

而Kimi是将全注意力和线性注意力结合起来形成混合型,不需要保留每个历史Token完整KV值,仅在现有记忆状态无法解释新信息时才将误差补充写入,其他时期历史信息压缩在可持续更新的状态中。Kimi官方披露,通过KDA技术可以减少75%的KV Cache。

3. 高部署门槛

大参数量能快速提高模型性能,但随之而来的就是对硬件部署门槛要求也会提高。

尽管K3减少了75%的KV缓存,但K3本身模型参数上去了,总参数逼近3T级别。虽然每次推理只用到896个专家中的16个,也就是对应500亿参数,但所有专家权重都必须常驻显存中,因此整体模型权重的存储需求(原始权重1.4T,还要加上一些量化因子、路由表、共享层以及运行缓存等)超1.5TB。

这表明,仅加载模型就需要占用1.5T的HBM容量。但NV DGC B200单节点8颗GPU总显存约1.4T(180GB*8),只能勉强装下原始权重,但几乎没有空间给到实际运行。

这种情况下,就需要上GB300机柜。Kimi官方的建议是K3的最佳部署为包含至少64颗加速器的高带宽超级节点。按道理来说,除了72颗GPU的GB300 NVL72,包含64颗GPU的华为昇腾950 Superpod也可以满足K3的运行需求。

而等到模型权重开源后,哪怕是本地部署最小规模的K3推理集群,也要至少8颗NV A100,硬件成本超400万元RMB。

因此上周因为K3的一句KV Cache减少75%而加剧的存储恐慌,显然是“鬼故事”。市场混淆了单位需求和整体需求的区别,KDA技术只是降低了单Token存储和计算成本,但并不代表说所有推理过程的硬件需求整体压缩了。与此同时,开源模型本身也会进一步扩大全行业对硬件部署的需求规模。

就实测来看,由于参数量上去了,导致K3的算力紧缺已经相当明显:据调研199元/月的登月套餐Allegretto,K3只能用10小时+,海豚君亲测49元/月的初级套餐Andante,低频使用了三天也遭遇了算力告急(实际使用时会自动从K3模型切换到K2.6)。

不仅如此,Kimi官方也发了公告,暂停新增订阅,以保证存量用户的使用体验(额度和响应速度)。


#03

变天的不是行业,而是Anthropic

但仍有悲观声音喊出,Anthropic和OpenAI本身模型迭代带来的性能边际提升已经缩小,同时中国大模型技术追赶上来了,中式内卷下,又会进一步加剧大模型行业竞争。因此Anthropic的ARR(年化收入)很可能因此放缓,进而导致商业模式再次遇阻。

AI 龙头的商业化能否走通,确实会影响全行业的军备竞赛预期。AI的颠覆性,让科技巨头不敢离开战场;但AI ROI的变化趋势,决定着科技巨头是否会暂时放慢投入速度

因此在当前产业链预期打满下,Capex哪怕只是降低增长斜率也会导致市场短期出现崩盘迹象。在周期顶部,低估值只是计算错觉。

市场关注度最高的Anthropic ARR,在近一年有明显的一超多强优势,核心原因就是它主打AI Coding这个易落地的应用场景。目前市场预期今年能够实现经营利润转正,这要比更倚重C端的OpenAI,先一步看到商业模式走通。

在上半年的3-6月,Anthropic的ARR经历了一次明显加速。目前7月数据还没出来,前两天小作文传出的Yipit测算值795亿(21天),被Yipit打假了。

笔者暂时按照与预测值差不多的20%月均环比增速估算7月。8月之后考虑到竞争加剧,那么增速按趋势缓慢下滑下,预计到年底能够达到1180亿。对比年初公司制定的今年260亿收入和市场预期的年底1000亿ARR,目标达成的难度不是很大。



但今年超目标是早已priced in的市场预期,如若下半年的ARR环比增速真如上述谨慎预期下降至年底的5%,隐含年化增速70%,对Anthropic上市后的估值弹性必将不利。

不过笔者认为,出于上述所讨论的算力瓶颈问题导致的“无性价比优势+输出速度劣势”,以及产品生态的布局(大模型、Claude code、专业领域Agent等),我们对Kimi K3对Anthropic的竞争影响短期没那么悲观,再加上川普正在考虑出台限制中国AI的相关政策,因此中国大模型的出海之路(尤其是企业端需求)可能没有想象中那么顺畅。

反过来说,就算Anthropic的“势头走弱”(比如OpenAI目前已经有正面竞争的实力,GPT-5.6-Sol在智能性上已经相差无几,但胜在便宜,以及后续若Google追赶上来),也不带代表全行业跟着完蛋。

如下图所示。北美作为全球AI投入最快、规模最大的市场,目前AI在各个领域的渗透率可以说是全球最高。目前20%的企业或多或少的已经采用AI,26年初一次显著跃升后,预计今年有望继续上升3ppt。

分行业上,得益于AI原生能力的替代性更加丝滑,Coding领域渗透率最高。其他领域,行业渗透率看着高,但这里面仍然是IT部门是目标人群。

公司内其他岗位的渗透,以及To C的端侧AI(包括具身智能),是AI未来增长方向。但这需要配合相应的产品形态、成熟渠道触达到更多的用户。这里往往涉及偏专业定制化的产品终端设计,因此需要时间和资金投入,其中降低算力门槛是加速AI在Coding之外领域渗透的核心关键。




#04

大模型混战升级的思考

Kimi K3的出现,弱化了市场对Anthropic技术壁垒的信仰,但也给了资金雄厚的追赶者们,尤其是本身有生态、渠道优势的Big Tech们更大的投入信心。

但同时大模型行业的残酷竞争也被撕开最后的幻想。尤其是对于独立AI Lab来说,一年数十亿至上百亿的基础设施+训练成本,换来的是从以前12个月的领先优势,到如今只有3个月的溢价红利期,那么这笔账是很难算的明白的。


尤其是在成本大头——算力硬件价格全球统一下(实际因为大国卡脖子,中国采购高端芯片的成本溢价直接爆表),中国大模型的“性价比”优势部分来源于人才(中国AI工程师平均年薪与美国同行存在3-5倍差距)、电力(核心区中国便宜30-50%)的绝对差额,但更多的还是靠忍受亏损的“补贴”,实际也就是投资人买单,包括地方政府的补贴。

如下图:

(1)2026年A&O两家的毛利率目前都已经在60%上下,但智谱预计在2026年的毛利率还要继续削弱到30%以下。

(2)而如果考虑到负担更重的训练成本,经营亏损差距还将拉大,这一点光靠销售、管理等其他经营开支的低价优势,难以做有效对冲。

因此一定程度上可以说,盈利结构发生显著变化的拐点,源于下半年中国高端自主芯片的量产。




笔者在年初覆盖智谱&MiniMax的深度报告中也曾提及,在缩放定律失效之前,竞争不会停歇,人人都认为自己有机会训练出下一个超越同行的前沿大模型。这种情况下,大模型公司会是持续的吞金兽,而公司商业模式本质上就变成了一场持续融资的资本竞赛。

下半年起,我们陆续会看到一梯队的AI Lab登上最大的融资舞台,Anthropic、OpenAI以及DeepSeek、Kimi将陆续筹划上市。当所有选手都拥有一样的融资通道时,最终的决战也会开始。

AI主权问题可能会将全球分割成数个战场,上游资源的地缘掣肘推高成本,人才流动下各方又拥有旗鼓相当的硬实力,上述因素都会使得这将成为一个持久战。

反过来混战期间,大模型的商业模式会更加难以看清,何时盈利、能否盈利也将在大模型厂商的每一次投入和融资时被投资人反复拷问,跑分刷榜来推动顺利融资的现象可能会出现得更加频繁。

而这个时候,拥有原有企业平台生态和渠道优势的CSP厂商,在开源大模型实力显著提升、大幅缩小与闭源模型差距的情况下,更有希望摆脱裸卖算力的低利润率模式。同时,通过结合原本产品服务,将硬件方下移的议价权收益,从滋润了大半年的模型厂端,拿回更多的话语权。

公众号最近更改了推送规则,不再按时间顺序推送,而是根据人工智能算法有选择性向用户推送,有可能以后你无法看到赖博士的文章推送了。

解决方法是将《赖博士说》的公众号“星标”,顺手点下文末右下角的“在看”,系统会默认我们公众号的文章符合你的喜好,以后赖博士的文章就会在第一时间推送到你面前。


赖博士说


赖博士说

帮你站在高处,重新理解财富


赖博士说

公众号:@赖博士说

视频号:@赖博士说

小红书:@赖博士说

今日头条:@赖博士说

Youtube:@赖博士说

免责声明:本公众微信平台“赖博士说”所载的资料及说明只可作一般性参考资料来阅读。平台不会就文章内资料、或因使用此等资料之正确性、准确性、可靠性或其他方面所导致的后果作出任何保证或其他声明。平台有酌情权随时删除、暂时停载或修改本帐号上的各项资料而无须给予任何通知或理由。若资料内容涉及产品资料,一概只可作一般性参考且并非适用于各产品及服务的所有条款及细则。详细资料请参阅有关产品及服务之协议。本文内容仅供内部参考及培训使用,并不构成任何法律、税务、投资或其他专业意见。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“我不想最后举动污染地球” 美国14州已允许人类堆肥

“我不想最后举动污染地球” 美国14州已允许人类堆肥

摸鱼算法
2026-07-22 21:54:33
BBA多款车型集体大降价

BBA多款车型集体大降价

第一财经资讯
2026-07-23 15:17:41
抢在中方发话前,菲律宾通知70国,日本最想要的,中国给了菲律宾

抢在中方发话前,菲律宾通知70国,日本最想要的,中国给了菲律宾

起喜电影
2026-07-23 17:45:50
交社保的人越来越少,领退休金的人越来越多,这可怎么办?

交社保的人越来越少,领退休金的人越来越多,这可怎么办?

健康管理师的号
2026-07-22 08:33:41
复用火箭进入亚军争夺战,朱雀三号再不快点,第二名也难保

复用火箭进入亚军争夺战,朱雀三号再不快点,第二名也难保

巅峰高地
2026-07-23 19:28:24
涉嫌严重违纪违法,珠海市金湾区人民法院原副院长黄敏被查

涉嫌严重违纪违法,珠海市金湾区人民法院原副院长黄敏被查

南方都市报
2026-07-23 20:04:03
美媒晒湖人9新援赞佩林卡!湖媒盼做收尾交易:4换4华盛顿+莱夫利

美媒晒湖人9新援赞佩林卡!湖媒盼做收尾交易:4换4华盛顿+莱夫利

颜小白的篮球梦
2026-07-23 09:29:35
饰演“小贱贱”的瑞安·雷诺兹亲口确认:新《死侍》电影正在开发中

饰演“小贱贱”的瑞安·雷诺兹亲口确认:新《死侍》电影正在开发中

时光慢旅人
2026-07-22 00:41:22
小米澎湃OS 4界面曝光!「液态玻璃」上身,流畅度猛涨40%

小米澎湃OS 4界面曝光!「液态玻璃」上身,流畅度猛涨40%

泡泡网
2026-07-22 14:55:06
23亿!中国第一大独角兽企业的华南总部,施工现场!

23亿!中国第一大独角兽企业的华南总部,施工现场!

GA环球建筑
2026-07-23 16:31:05
砸锅卖铁也要跟中国通铁路?这个穷国赌的大,一手烂牌打成王炸!

砸锅卖铁也要跟中国通铁路?这个穷国赌的大,一手烂牌打成王炸!

让生活充满温暖
2026-07-23 09:43:49
最高40.7℃!“高温+雨水”轮番来袭,成都接下来天气→

最高40.7℃!“高温+雨水”轮番来袭,成都接下来天气→

红星新闻
2026-07-23 19:55:32
“摸奶子”再惹争议,OPPO的流量反噬开始了

“摸奶子”再惹争议,OPPO的流量反噬开始了

品牌头版
2026-05-13 10:18:15
同学聚会,班花多次膈应我:没钱还来蹭饭吃?第二天她被公司开除

同学聚会,班花多次膈应我:没钱还来蹭饭吃?第二天她被公司开除

荔枝人物记
2025-07-09 14:39:32
马杜罗,有新消息

马杜罗,有新消息

极目新闻
2026-07-22 08:55:38
原来有钱后返贫这么简单!网友:买了的东西还要花钱维护的叫负债

原来有钱后返贫这么简单!网友:买了的东西还要花钱维护的叫负债

夜深爱杂谈
2026-07-23 20:15:32
颈棱蛇,我国唯一头部呈三角状的无毒蛇,还常伪装成毒蛇吓唬天敌

颈棱蛇,我国唯一头部呈三角状的无毒蛇,还常伪装成毒蛇吓唬天敌

农夫也疯狂
2026-07-17 13:26:21
美军连炸8晚后,伊朗宣布“退群”,美国发全球警告,特朗普急了

美军连炸8晚后,伊朗宣布“退群”,美国发全球警告,特朗普急了

游古史
2026-07-20 12:37:21
武汉光谷断崖式招商背后:独角兽撤资的真相,令人沸腾!

武汉光谷断崖式招商背后:独角兽撤资的真相,令人沸腾!

生活新鲜市
2026-07-23 18:25:51
菲律宾卡点挑衅,故意在仁爱礁闹事,只为让王外长接见鲁比奥?

菲律宾卡点挑衅,故意在仁爱礁闹事,只为让王外长接见鲁比奥?

踏青云看世界
2026-07-22 21:38:59
2026-07-24 01:11:00
赖博士说
赖博士说
分享海外投资、金融理财、读书心得,关注一切与成长和赚钱的人与事。帮你站在高处,重新理解财富。
170文章数 14关注度
往期回顾 全部

科技要闻

中国数学家王虹、邓煜获菲尔兹奖

头条要闻

女副部王峻被处理:大搞权钱交易 泄露工作秘密

头条要闻

女副部王峻被处理:大搞权钱交易 泄露工作秘密

体育要闻

勇士24岁的MVP,也是个勒布朗?

娱乐要闻

梁朝伟汤唯19年后境遇反转

财经要闻

梁文锋当不成赛博圣人

汽车要闻

领克07GT正式上市14.58万起 把纯粹驾趣还给旅行

态度原创

教育
时尚
旅游
房产
军事航空

教育要闻

鲍鹏山:凡是给你一个办法,说能解决你孩子学习问题的,说不定就是骗子

女人不管多大年纪,夏天都要准备几条长裙,显瘦端庄又大方

旅游要闻

厌倦拥挤热门景区不妨来这里,森林瀑布相伴,夏天不用开空调!

房产要闻

狂抢111轮,溢价39%,楼面价刺破9500!海口土拍杀疯了!

军事要闻

"镐山"之后美再威胁袭伊基础设施 伊朗:将以牙还牙

无障碍浏览 进入关怀版