网易首页 > 网易号 > 正文 申请入驻

马斯克再点赞,Kimi K3 冲击波!中国又一颠覆了“美国领先中国”的固有认知

0
分享至

AI · 深度观察

Kimi K3 冲击波

2.8 万亿参数、登顶全球编程榜、把“中美差距”从一年压到三个月——一款中国开源模型,第一次让华尔街因为中国 AI 而紧张。

综合新华社、彭博社、月之暗面官方技术博客、华尔街见闻及多家权威报道 | 2026-07-19

7 月 16 日深夜,上海,WAIC 2026 开幕前夜。没有发布会,没有预告片,月之暗面把 Kimi K3 悄悄挂上了官网。然后,全球炸了。

三天后,彭博社发出一篇报道,标题很克制,但分量不轻:《Moonshot 的 Kimi,颠覆了“美国领先中国”的固有认知》。同一周,费城半导体指数跌入技术性熊市,华尔街把这一幕称为“Kimi 时刻”。

一个中国开源模型,为什么能让大洋彼岸的科技股抖一抖?这篇稿子,我们把官方说法、国内通稿、外媒、学者、华尔街、半导体分析师和资本市场的话都摆出来,看看这场“冲击波”到底冲击了什么。

先把事说清楚:K3 是什么

7 月 16 日,月之暗面正式发布 Kimi K3;17 日凌晨起,它已经在 Kimi App、Kimi Work、Kimi Code 和 Kimi API 全线上线。官方给它的定位是“迄今能力最强的模型”。


几个硬指标,均来自月之暗面官方技术博客:2.8 万亿参数、MoE 架构、100 万 token 上下文、原生视觉理解;新架构 Kimi Delta Attention(KDA)加注意力残差(AttnRes),官方称扩展效率比 K2 提升约 2.5 倍;两个变体分别是 K3 Max(对话与智能体)和 K3 Swarm Max(大规模并行)。

最关键的一句:完整权重将在 7 月 27 日前开源。官方称它是“全球首个开源的 3T 级(万亿参数)模型”,也是“目前全球参数最大的开源模型”——据公开资料,它一步跨过了 DeepSeek V4、百度文心大模型 5.0 等此前最大的开源模型。新华社的通稿里,也用了“标志着我国人工智能模型发展迈出新的一步”这个表述。

技术上,它做对了什么

参数大不等于能力强。历史上不少“大模型”参数堆上去,性能却原地踏步,被业内调侃为“大而无当”。Kimi K3 不同,它在架构上动了两处关键手术。

第一处:KDA 混合线性注意力。传统 Transformer 处理超长序列时,计算量会随序列长度平方增长,业内叫它“注意力税”。KDA 用线性注意力替代了其中一部分二次计算,让 100 万 token 的上下文窗口从“纸面参数”变成推理中真正可用的资产。

第二处:注意力残差(AttnRes)。这是 Kimi 今年展示的架构成果,思路借鉴了让深度学习过去十年脱胎换骨的残差连接(ResNet),把同样的手法用到了注意力机制上,让超大模型训练得更稳。Kimi K3,是这项成果第一次完整落地。

两处创新叠加,官方给出的结论是:相比 K2,整体扩展效率提升约 2.5 倍——也就是说,同样的算力投入,K3 能榨取出比 K2 多得多的能力。

跑分:它真的能打吗

先看最炸的数据。在第三方榜单 Frontend Code Arena(arena.ai)上,Kimi K3 拿到 1679 分,排第一,超过 Claude Fable 5 的 1631 和 GPT-5.6 Sol 的 1618。这是有史以来,第一次有开源模型在这个榜单上登顶。

但这里得泼盆冷水:这个排名,Arena 自己标的是 “Preliminary”(初步结果)。伯克利的 Ion Stoica 也说,初步结果、尤其在编码上,K3 才和 Fable、GPT-5.6 Sol “处于同一水平”。所以别看到“第一”就上头。

把官方公布的基准表摊开看,K3 是“多点开花”,不是“全面碾压”:


(数据来源:月之暗面官方技术博客,经第三方报道整理;另据高盛引述 arena 数据,K3 在 Frontend Code Arena 的多个细分方向上,7 个里拿了 6 个第一)

但 FrontierSWE、GDPval 这些项目上,它和 Fable 5 还有明显差距。第三方机构 Artificial Analysis 给的综合智能指数约 57 分,和 Opus 4.8、GPT-5.5 同档,落后于 Fable 5 与 GPT-5.6 Sol。

有意思的是,月之暗面自己在博客里列了三个“认怂”的地方:一是对思考历史敏感,智能体框架没回传完整历史就可能翻车;二是太主动,模糊指令下会替你做预期外的决定;三是整体用户体验,和 Fable 5、GPT-5.6 Sol 比还有可感知差距。一个发布当天就坦白短板的公司,反而让人更信它的跑分。

马斯克第二次点赞

7 月 17 日凌晨,K3 发布的消息传到海外。特斯拉 CEO 马斯克在相关评测报道的评论区留下了四个字:“Impressive.”(据多家媒体报道)

这已不是他第一次公开肯定 Kimi。在开发者社区,更多人把它比作又一个“DeepSeek 时刻”——这个词在 2025 年初 DeepSeek R1 发布时被广泛使用,指的是中国团队以远低于预期的成本,做出逼近全球顶尖水平的开源模型,引发全球 AI 格局震荡。Kimi K3,被许多人认为具备同等量级的影响力。

当然,“Impressive”是褒奖,不是认输。K3 整体仍落后于两款最强闭源,这一点连月之暗面自己都没回避。

华尔街的恐慌与辩论

7 月 17 日,K3 发布的消息传导至美股。费城半导体指数(SOX)当日收跌 1.63%,较 6 月 22 日创下的历史高点累计下跌 20.2%,正式跨入技术性熊市门槛;英伟达从高点回落超 20%,美光、Arm、英特尔等芯片股均出现显著回撤。彭博社直接将这一定义为“Kimi 时刻”。

高盛 · 悲观派

合伙人、股票业务负责人 Rich Privorotsky 将本轮下跌定性为“去杠杆事件”,警告“算力扩张时代”或已走到尽头。他的核心判断是:一家无法匹配西方最大规模预训练算力的中国实验室,靠架构创新、合成数据、强化学习和后训练迅速缩小了差距——“这并非证明扩展定律失效,而是表明扩展不再是唯一的制胜路径”。

高盛 · 7/18 报告 · 另一面

同一家投行两天后的报告却给出了积极解读:K3 标志中国开源模型智能水平已触及全球大规模普及的临界点,定价能力随之提升。据其估算,K3 成本较同类美国顶级模型低约 40%。

有意思的反差就在这里:Kimi 这次没走 DeepSeek 那种“便宜到离谱”的路线。官方 API 定价缓存命中输入 0.30 美元、未命中 3.00 美元、输出 15.00 美元 / 百万 token——业内估算,这比国产模型此前的低价策略提价约 2 到 3 倍,却仍比美国旗舰便宜近一半。月之暗面押的注是:靠编码和高利润智能任务的硬实力,收更高的价。

同一事件,两套叙事,同一个事实:华尔街正在重新评估中国 AI 的含金量。

开源:把刀柄递给全世界

K3 最让业界震动的决定,不只是性能,而是它的开源承诺。完整模型权重将于 7 月 27 日前开放,企业、政府可在自有系统上定制部署、微调,无需向月之暗面付费。

过去业界有个默认认知:开源模型永远在追赶闭源,且至少落后一代——等开源追上,闭源又往前迈了一步。K3 第一次把这条鸿沟压到了“肉眼可见的近处”。一个能力逼近全球前沿的模型,愿意把权重完整交出来,这不只是商业策略,更像一种宣言:开源与闭源的差距,可能从“年”被压缩到“月”。

数据印证着这股势头。据 Hugging Face 季度报告(经多家媒体引述),中国开源模型的全球下载量占比已反超美国(报告给出的数字约为 58% 对 28%)。K3 的到来,会进一步改写这张地图。而对很多把“合规”当命门的企业,模型能私有化部署、数据不出域,比省那点调用费更打动人。

新华社通稿里的深意

一个值得注意的细节:K3 发布当天,新华社即发了通稿。通稿写道:“新一代模型 Kimi K3 于 16 日发布,参数规模达 2.8 万亿。这是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新的一步。”

同一个节点,2026 世界人工智能大会(WAIC)于 7 月 17 日在上海开幕,国家领导人出席开幕式并发表主旨讲话,主题正是“携手构建公正合理的全球人工智能治理体系”,讲话中明确提出“鼓励开源开放、合作共享”。国家级平台为开源模型背书,与 K3 的开源姿态,形成了时间点上的呼应。

它意味着什么

第一,对中国 AI 而言:从 DeepSeek V4 到 Qwen 3.7,从智谱 GLM-5 到 Kimi K3(据行业梳理),中国 AI 正在完成从“追赶者”到“并跑者”的切换——参数规模、性能表现、开源生态、定价能力,四个维度同步推进。不过,虎牙 CEO 黄俊洪在 WAIC 腾讯 AI 应用创新论坛上给了另一视角:“当前 AI 领域模型能力的差距正持续收窄,但工程化能力的差距正在逐步拉开。”技术追赶只是第一关,真正的决战或在工程落地与规模化应用。

第二,对全球 AI 格局而言:OpenAI、Anthropic 凭借“规模 + 闭源”建立的护城河,正在被开源社区以更低成本、更快速度填平。如果开源模型能提供八成以上的性能且完全免费,闭源模型凭什么收溢价?答案必须是:持续不断地创新。这种压力,客观上会加速整个行业的进步。彭博还点出一个反直觉变量——OpenAI、Anthropic 迫于美国审查压力推迟发布,这种“放缓”反而可能给中国留出追赶窗口。

第三,对每一个普通人而言:K3 已在 Kimi App、Kimi Work、Kimi Code 和 Kimi API 全面上线。写代码、做分析、处理长文档、读懂复杂图表——这些曾需要专业技能的工作,正以极低的门槛向所有人敞开。AI 的普惠化,正以 K3 这样的产品为节点,一步一步发生。

收尾

写完这篇,我反而觉得最该记住的,是月之暗面自己那句坦白:K3 整体仍落后于 Fable 5 和 GPT-5.6 Sol。不神化,才看得清。

2025 年初,DeepSeek R1 让全球 AI 圈第一次正视中国团队。2026 年 7 月,Kimi K3 让华尔街第一次因为中国 AI 而感到紧张。从“追赶者”到“冲击波”,这条路,中国 AI 走了不到两年。

下一个“时刻”,会是什么?


参考资料(均为公开权威报道与官方信息)

  • 新华社 / 财联社 通稿(2026-07-16/17):Kimi K3 发布,2.8 万亿参数、全球最大开源模型

  • 月之暗面官方技术博客(Kimi K3 技术报告):架构、基准、定价、局限、开源计划

  • 彭博社 Bloomberg(2026-07-18):Moonshot's Kimi Upends Conventional Wisdom on US Lead Over China

  • arena.ai(Frontend Code Arena):K3 登顶,标注 Preliminary(初步结果)

  • Artificial Analysis:K3 综合智能指数约 57,与 Opus 4.8 / GPT-5.5 同档

  • 华尔街见闻、腾讯网、东方财富网(2026-07-17/18):SOX 技术熊市、“Kimi 时刻”、高盛“去杠杆事件”与“扩展不再是唯一制胜路径”

  • IT之家、科创板日报:上线信息、张予彤关于 ARR 的表态

  • 澎湃新闻:港股 IPO 传闻与 ARR 数据(公司未正式回应)

  • 新华网 / 央广网:WAIC 2026 开幕式与主旨讲话(强调“鼓励开源开放、合作共享”)

  • 上证报(东方财富引述):虎牙 CEO 黄俊洪 WAIC 论坛发言

  • SemiAnalysis:KDA 与硬件需求分析(高效架构反而刺激 GPU/HBM/网络长期需求)

  • CSDN(引述 Hugging Face 季度报告):中国开源模型全球下载量占比反超美国

为伟大思想而生!

AI+时代,互联网思想(wanging0123),

第一必读自媒体

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
灾难事件中的歌颂叙事,越来越让人反感

灾难事件中的歌颂叙事,越来越让人反感

黔有虎
2026-07-10 17:13:47
手握100万,继续存银行,还是趁机买房?马云和曹德旺的看法一致

手握100万,继续存银行,还是趁机买房?马云和曹德旺的看法一致

猫叔东山再起
2026-07-21 10:10:07
从欧美看中国隐患:70年产权到期,高楼就是垃圾?炸不掉还修不了

从欧美看中国隐患:70年产权到期,高楼就是垃圾?炸不掉还修不了

观史搜寻着
2026-07-19 17:25:04
包工头与食堂大姐相好5年,项目完工提分开,这才意识到晚了

包工头与食堂大姐相好5年,项目完工提分开,这才意识到晚了

磊子讲史
2025-06-28 16:28:57
CCTV5直播时间表:7月21足协杯1/8决赛!上海双雄出战 泰山迎劲敌

CCTV5直播时间表:7月21足协杯1/8决赛!上海双雄出战 泰山迎劲敌

越岭寻踪
2026-07-21 11:01:30
凌晨6点,四川乐山苏稽古镇成排房屋被火吞噬!1400年历史古镇差点毁于一旦

凌晨6点,四川乐山苏稽古镇成排房屋被火吞噬!1400年历史古镇差点毁于一旦

听心堂
2026-07-20 11:51:59
广东19个月大男童溺亡后续,父亲让两幼儿坐充气船,心太大了

广东19个月大男童溺亡后续,父亲让两幼儿坐充气船,心太大了

九方鱼论
2026-07-21 09:00:39
倪萍称邹市明没有是非观后,为何被全网群嘲?孙宇晨一针见血

倪萍称邹市明没有是非观后,为何被全网群嘲?孙宇晨一针见血

翰飞观事
2026-07-20 14:23:20
日本命不该绝?东京南海发现巨型金矿,刚要狂欢,专家:挖不出来

日本命不该绝?东京南海发现巨型金矿,刚要狂欢,专家:挖不出来

霁寒飘雪
2026-07-21 14:22:59
《武林外传》“丐帮小米”郑州开设的爱心午餐今起停餐3周,回应:天太热没空调,6年来没好好休息过,还需兼顾拍戏,早餐爱心粥正常供应

《武林外传》“丐帮小米”郑州开设的爱心午餐今起停餐3周,回应:天太热没空调,6年来没好好休息过,还需兼顾拍戏,早餐爱心粥正常供应

极目新闻
2026-07-20 10:31:38
国防科技大学出来是什么军衔,享受什么待遇?出来从事什么工作?

国防科技大学出来是什么军衔,享受什么待遇?出来从事什么工作?

众生的世界观
2026-07-03 19:21:40
德国名记:拜仁不要落入皇马的转会陷阱,应坚定留住奥利塞

德国名记:拜仁不要落入皇马的转会陷阱,应坚定留住奥利塞

懂球帝
2026-07-21 16:54:22
570分竟然滑档了,出分时全家摆了两桌庆祝,结果孩子没学上了

570分竟然滑档了,出分时全家摆了两桌庆祝,结果孩子没学上了

牛锅巴小钒
2026-07-21 11:15:59
OpenAI紧急叫停GPT-6!

OpenAI紧急叫停GPT-6!

新智元
2026-07-21 08:30:36
视频揭露菲军方挑衅摆拍全流程

视频揭露菲军方挑衅摆拍全流程

环球网资讯
2026-07-20 23:12:32
离婚30年一分没分到,狄波拉为何还哭得最惨?真体面还是太卑微?

离婚30年一分没分到,狄波拉为何还哭得最惨?真体面还是太卑微?

东方不败然多多
2026-07-21 08:46:47
“躲着机组人员抽烟,抽了好几口”,一男子在飞机上吸电子烟,被处理

“躲着机组人员抽烟,抽了好几口”,一男子在飞机上吸电子烟,被处理

南方都市报
2026-07-21 14:59:36
刘邦47岁才起兵,你以为前半辈子白活了?错,他早就是沛县顶流了

刘邦47岁才起兵,你以为前半辈子白活了?错,他早就是沛县顶流了

云居历史
2026-06-25 21:13:09
打脸马斯克,诺兰《奥德赛》票房狂飙,口碑也爆,但差评怎么说?

打脸马斯克,诺兰《奥德赛》票房狂飙,口碑也爆,但差评怎么说?

阿废冷眼观察所
2026-07-21 17:22:05
孙子到底跟谁最亲?DNA早已给出答案,爷爷和姥姥才是最大赢家

孙子到底跟谁最亲?DNA早已给出答案,爷爷和姥姥才是最大赢家

一口娱乐
2026-07-20 15:22:02
2026-07-21 18:03:00
互联网思想 incentive-icons
互联网思想
AI时代,互联网思想观察
2547文章数 16925关注度
往期回顾 全部

科技要闻

OpenAI高管:Kimi K3强到没法用"蒸馏"解释

头条要闻

媒体:破船成仁爱礁"钉子户" 菲方说白了就是眼馋油气

头条要闻

媒体:破船成仁爱礁"钉子户" 菲方说白了就是眼馋油气

体育要闻

西班牙队夺冠游行庆典:200万人,狂欢5小时

娱乐要闻

谢贤被曝已火葬,狄波拉携儿女送别

财经要闻

百虾竞速上车:4条路线争夺车载AI话语权

汽车要闻

热爱驾驶的更棒选择 极氪8X让大块头也有大乐趣

态度原创

亲子
健康
数码
房产
公开课

亲子要闻

每孩每年3600元,官方:首次育儿补贴申请截止时间延长

“斑块”患者要小心中风?

数码要闻

英特尔发布8864显卡驱动,为三款游戏解决着色器编译版本冲突

房产要闻

最高奖励15万!免学费!海南民办高中,疯狂抢人!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版