19号中午,上海世博展览馆,“月之暗面”旗下的大模型Kimi展台,一下子涌来100多号人排队,多数是年轻人,也有家长带着小朋友。
Kimi的工作人员也有点儿懵,“就是搞了一个小小的抽奖活动,一等奖送66万 token,另外还有冰箱贴之类的小纪念品。也许是前几天发布的K3,大家比较关注吧。”
![]()
参展观众在“月之暗面”旗下的大模型Kimi展台排队。
Kimi的展台一共也就20来平,和谷歌一起挤在场馆一个小角落,三天前在世界AI领域投下重磅炸弹的Kimi K3大模型标志,占了小半面墙。
![]()
Kimi展台将K3大模型宣传放置显眼位置。
如果你不知道现在中国什么东西最热,如果你不知道未来中国什么东西最热,来上海的世界智能大会。在这里,一个不起眼的角落,也许就将改变全世界。
一、登月般壮举,吓崩美股
“月之暗面”选择发布大模型的时机十分巧妙,在世界人工智能大会召开前一天,Kimi K3“横空出世”。它拥有2.8万亿个参数,是目前全球参数最大的开源模型。
参数就像人脑里的神经连接,2.8万亿这个数字说明模型能把更多的知识和规律装进“脑子”,懂得更多、想得更深、答得更准。
美国的闭源大模型不公布参数,已知的模型参数,如DeepSeek V4 Pro (1.6万亿) 和Kimi K2 (约1万亿),虽然规模也很庞大,但都和K3差了1万亿参数以上,这相当于差了“好几个大模型”的体量。
这么聪明的大脑还是开源的,免费的,对于各个企业来说,相当于给了你一个拥有博士学位的AI员工,而且不要钱,允许你根据自家需求对它进行改造,能不心动吗?
“月之暗面”计划在 7 月 27 日前发布Kimi K3完整模型权重,允许企业和政府自行定制并在其系统上运行。
![]()
美媒称,Kimi K3是登月般壮举的产品。
美国Axios新闻网惊呼“中国刚刚抹去了美国在人工智能领域的领先地位”,称Kimi K3是登月般壮举的产品。
Kimi K3的发布甚至引发了华尔街的恐慌,被市场称为“Kimi时刻”(Kimi Moment),与一年前DeepSeek引发的冲击相提并论。发布当天(当地时间7月17日),美股三大股指全线收跌,科技股成为重灾区。谷歌、Meta、英伟达、特斯拉等巨头股价跌幅均超过2%,费城半导体指数更是较历史高位回撤超过20%,正式进入技术性熊市。
![]()
17日,美股大型科技股多数下跌,科技股成为重灾区。
彭博社报道标题称,Kimi K3打破了“美国领先中国”的固有认知,其发布也引发了华尔街对“DeepSeek 2.0时刻”的担忧。
美国媒体一贯喜欢耸人听闻,大惊小怪,是不是有意捧杀中国大模型企业,值得画个问号。这里仅粗浅分析一下,美国为什么这么害怕中国大模型的开源路径,以及中国大模型为什么要选择开源路径。
二、美国跑车PK中国汽车,美国博士生PK中国研究生
日本媒体前几天罕见报道,印度企业正在越来越多使用中国的开源大模型,不仅价格比美国OpenAI等大模型便宜,而且采取开源模式,方便他们在中国大模型参数基础上进行适合自己的改造。
印度的开发者甚至做了一个比喻,美国模型价格昂贵,但很多基础性工作根本用不着它们,“这就像在拥堵的城市道路上开跑车,大材小用。”
言下之意,中国的大模型可能像是普通轿车、公交车,甚至是印度遍地都是的三轮车,总之不管什么车,开到目的地的都是好工具。
日本媒体看热闹不嫌事儿大,反正自家也没出什么好的大模型,转而介绍美国大模型公司在印度、中东等地正在攻城掠地,而中国是美国公司不可小瞧的竞争对手云云。
对于中美的差距,双方的观点大致一致。去年这个时候,大部分中国专家认为中国大模型企业和美国的差距在半年以上,Kimi K3大模型出现后,国内很多说法都认为目前差距缩小到2—4个月左右。加州大学伯克利分校教授、Arena榜单联合创始人Ion Stoica表示,过去中国开源模型落后美国前沿模型约6—9个月,现在可能只落后2—3个月。
对于这个差距,MiniMax副总裁严奕骏形容,如果美国大模型是博士生,中方也应该是研究生,“世界上并非所有工作都需要最聪明的人去做,大多数工作大学生就能完成,所以选择中国大模型的会越来越多”。
美国选择闭源,要保护的就是研究生到博士生的这个差距,把顶尖的技术做成护城河,让外界不能轻易窥探其中奥秘。
最简单易懂的例子,就是可口可乐。到目前为止,可口可乐的配方仍是商业秘密,公司不会对外注册成专利,否则就意味着所有的人都知道你的配方。所以无论什么行业都有一个金规:最有价值的想法,永远都在脑子里,跟谁也不能说。
三、“要么在餐桌前,要么在菜单上”
美国选择闭源另一个原因,则是其云商业模式决定的。闭源模型是微软、谷歌等云服务商的“黄金搭档”。通过API和独占功能,它们能把客户牢牢锁定在自己的云生态中。开源模型会让客户更易迁移,削弱云服务的议价权。
这个模式简单说,就跟你使用苹果手机一样。用了苹果手机,就得进入它独特的生态,好处是安全,坏处自然是以后都得被牢牢锁定在这个生态内。一旦你想把你的东西迁移到别的系统中,很多东西难以流通,所以不得不花高价钱继续留在系统内。
比如你使用OpenAI的模型(如GPT-4系列),你无法下载、无法自行部署。使用它的唯一方式,就是通过网络调用它的API。此时,模型运行在哪家云、用什么芯片,完全由OpenAI和微软决定(目前主要是Azure和英伟达GPU)。用户被剥夺了选择权。如果有一天想迁移时,会发现自己的数据和微调成果都带不走,所以再一次不得不花高价钱,继续留在牌桌上。
美国大模型公司建立的是一个AI界的“苹果商店”,卖的从来不是一个孤立的模型,而是一个环环相扣、深度绑定的技术生态与权力体系。
行业内对美国的这种做法形容为赢家通吃,不做单纯的商务合作,“要么归顺,要么出局”。美国前国务卿布林肯常挂在嘴边的外交比喻更生动,“如果你不在餐桌上,就会出现在菜单上。”
![]()
美国前国务卿布林肯有一句旧台词,“在国际体系中,你不在餐桌上,就会出现在菜单上。”
四、中国选择开源的最大好处
相比之下,中国的大模型则显得没有那么挑剔,持开放的态度,并不在乎用户的前世今生,更愿意在一个大的生态系统共同成长。
不光是大模型企业,很多科技公司在出海的过程当中也一直秉持着这样的一个理念。一家机器人企业曾讲过一个案例,他们生产的机器狗在美国市场很受欢迎,一个很重要的原因是他们的产品支持二次开发。客户可以把机器狗用作山火巡检,工厂巡逻,甚至当成保安对着暴徒喷辣椒水,中国企业的做法就是都可以支持,都可以配合,你需要什么插口提前给你预留,狗卖到你家之后想做什么改变,随时找中国企业沟通。你想要把数据留在你自己的企业内,留在自己国家内,都没有问题,都可以做方案支持。
美国企业的做法则相反,你也可以对机器狗做上述改造,但是必须听我安排,预留什么插口我说了算。使用一段时间之后,我要收取服务费,并且你的数据必须在存储在我的生态内。总而言之,所有的内容必须是机器人企业的生态之内。
在商言商,中国企业做生意从来不是做慈善。对于美国企业的做法,行业内认为这只是路径的不同,并无道德上的高低。对国内大模型公司来说,选择开源一个非常重要的好处,就是可以最大程度集纳开源社区的专业人士意见。
和国内普通民众就能大量接触AI产品不同,在国外使用AI产品的人多是专业人士。全世界都可以通过全球最大的AI开源社区Hugging Face下载部署千问等中国国产大模型,同时中国的开发者也能在这个平台当中接触全世界各国顶尖人士,他们的反馈意见非常容易对中国企业形成反哺。一些改进意见及时且专业,对中国大模型的更新迭代,也起到了非常关键的指引作用。
五、写在最后
回到开头Kimi展台的场景,年轻人排大队,只是那点token或者是冰箱贴吗?巴菲特经常说,别人恐惧时我贪婪,别人贪婪时我恐惧。
![]()
在Kimi展台排队的年轻人
但在中国,当人们扎堆时,好多时候这些场景得多思考——当年轻人愿意为这样一个企业打卡,当他们愿意为这些富有创新精神,敢于打破枷锁的产品点赞,这比再多的国际称赞,都更值得我们骄傲。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.