网易首页 > 网易号 > 正文 申请入驻

拿OpenAI的钱,用国模的底座:110亿美元独角兽加入Kimi千亿义子团

0
分享至

这两天,湾区发生了一件挺有意思的事。OpenAI 亲手投资的一家当红炸子鸡,居然疏远了 GPT,基于中国开源模型训自家模型。

这个主角是在法律 AI 领域大名鼎鼎的 Harvey。

可能有朋友知道,Harvey 的投资人不仅有 OpenAI,还有红杉和 a16z。现在它估值 110 亿美元,是全球身价最高的法律 AI 公司。

就是这样一家和 OpenAI 关系匪浅的明星创企,却选择自己训模型,还是基于 Kimi K3 做的后训练。


Harvey 在 K3 基础上后训练出来的模型 Tenet,虽然还在预览阶段,但效果已经不错。

相较基础版 Kimi K3,Tenet 在 Harvey 自己的测评 LAB (Legal Agent Benchmark)中,完成任务的数量接近翻倍,all-pass 率从约 11% 提高到 19.7%。

在合同任务上 Tenet 排名第一,比 K3 多完成20%,全通过率提升2%。


这一回,国产开源模型在硅谷独角兽里当上了“基模之父”。

OpenAI“亲儿子”,为什么选中国开源模型?

Harvey 在法律 AI 届的分量远不止投资方和估值闪耀这么简单。

它已经服务超过2400家客户,遍布70多个国家。在美国营收最高的100家律所中,75家以上在使用它。

而 Harvey 和 OpenAI 的关系,也不只是拿过一笔投资。

早在2024年,双方就合作做过法律定制模型,还把约100亿 token 的美国案例法数据加入训练。Harvey 此后也一直采用多模型策略,接入OpenAI、Anthropic 和Google 等公司的模型。

但后面的事情就有点尬了。

就在今年,OpenAI 发展出了自己的法律业务,先是高调招人,又是和律所合作。Anthropic 也推出了面向律师的文档审查插件。

对 Harvey 来说,这属于交着 API 费用,还被投资人和供应商一起偷家...


这种应用被大模型卷的情况,这几年很常见,一般不是功能被吞,就是 API 费用高还没法换。这也是搞应用的公司,现在都喊着要自己做模型的原因。

但 Harvey 要训自己模型的挑战还在于,法律是最不能拿模型“凑合用”的行业之一。

就比如一份并购尽调,可能要从几百份文件里找出控制权变更条款,判断交易是否触发,再给出风险等级和修改建议。就算前面几十个判断都做对,只要漏掉一个会影响交易的条款,整份交付物就可能失去价值。


*Harvey页面。它能协助律师做合同审查、并购尽调、法律研究等复杂工作

面对这种超高的行业要求,再加上预训练的难度,Harvey 似乎只剩下了一个选择:找到一个能力足够强的开源基座,再猛猛后训练。

Kimi K3 也是因为这个原因进入了 Harvey 的视野。

目前最权威的模型测评榜单 AA 榜里有个 Harvey 自己出的、专门针对法律领域的 Harvey LAB-AA 评测,包含了120项私有任务,覆盖24个法律领域。

K3 在这项测评里的“全项通过率”是26.7%,排在第一。第二名是 Claude Fable 5,才 14.2%。

这个成绩把 Harvey 的 Head of AI Research 惊到了。

他说 Harvey 之前觉得就算是最前沿的模型,在法律领域也还不够好。K3 是第一个,在法律场景接近前沿模型的开源模型,也是他们第一次考虑用开源模型,打开了新世界。


有了这个成绩打底,Harvey 选定了 K3 做基模,又为训练搭建了大概1750个法律任务环境,还找了一帮执业律师制定细则,给模型做后训练强化学习。

就这样,在大约150块英伟达 B300 上跑了两个月后,Harvey 第一个属于自己的模型诞生了。

Kimi的基模“义子团”不止Harvey

其实在 Harvey 之前,Cursor 已经把同一条路走过一遍。

今年3月,Cursor 发布编程模型 Composer 2。虽然刚开始他们 “不小心忘记说明”基础模型来自 Kimi,但开发者还是迅速扒出了基座是 K2.5。

后来成为 Cursor 金主的马斯克那会儿也亲自下场,在帖子下面回了一句:Yeah, it's Kimi 2.5.


被光速打脸后,Cursor 承认自己使用 K2.5 做了基座。

这个模型的技术报告里还披露,当时选基模时 Cursor 考察了模型的编程知识、多次修改后的状态追踪能力,以及在自家基础设施中的运行效率等维度,排除 GLM-5 和 DeepSeek V3.2 选了 K2.5。

再往细扒,我发现基于 Kimi 这个“基模之父”长大的“义子团”还在扩容。

另一个 Coding Agent Devin 在今年7月发布 SWE-1.7 时,承认它使用的底座是 Kimi K2.7。

还有一家英国 AI 公司 Cosine。它的产品专门用来维护大量银行、航空、大型政企核心系统跑着的遗留老旧代码 。今年4月,它拿 Kimi K2.6 训练出了代码模型 Lumen Outpost。


如果再把视角拉到国产模型的使用趋势变化,最近这半年还发生了好几件事。

今年5月,Airbnb 的 CEO Brian Chesky 确认,公司的客服聊天机器人使用阿里 Qwen。7月,DoorDash 联合创始人说,公司把难度较低的编码任务交给 Kimi K2.6,最难的部分继续用 Anthropic 的 Fable,因为“这种搭配质量更好,成本也更低”。

OpenRouter 的数据也能看到走势。

从2月8日起,美国公司经由该平台使用中国模型的每周 token 占比持续超过30%,最高达到46%。这个数据过去12个月的平均值只有 11%,2025 年上半年更是低到 4.5%。


这种中国模型快速被 Pick 的现象,也引起了硅谷投资人的关注。

8月初,投资人 Jason Calacanis 在一档播客里预测,一些每年向 OpenAI、Anthropic 支付5000万到1亿美元的大客户,可能会转向其他模型。

他还点名 ElevenLabs、Figma 和 Lovable 也会离开,使用 Kimi 或者 DeepSeek 做出自己的模型。


垂直公司的新“武器”

Jason Calacanis 说这话的时间是8月初,Harvey 时隔20天官宣用 K3 做基模,属实给他猜着了。

而且,Harvey 这次的经历还给整个市场验证出一条路径:

足够好的开放权重模型+行业专家数据+后训练,理论上能让任何垂类公司训出自己的前沿模型。

说实话这条路也不算轻松。1750 个法律任务环境,以及一波专业律师制定的评分标准,也不是随手能凑齐的条件。

但反过来看,这恰恰也是 Harvey 这类垂直公司的优势。模型厂商拥有算力和基础模型,却没有 Harvey 多年来积累的法律数据、律师反馈和真实工作流。

过去闭源模型领跑,垂类公司里积累的数据一般只能用于设计 Prompt、搭建工作流,或者围绕 API 做产品封装。

到了今年,像 K3 这种开放权重模型的能力追上来,垂直公司不必再只是在不同模型之间做选择,也不必满足于在通用模型外面搭一层产品。

只要正确发挥出专业能力,它们理论上都能成为“后训练仙人”,训出更贴合业务的专属模型。

今天 Harvey 先冲了,接下来在金融、医疗、制造业...等等领域,会出现更多的 Tenet。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
全红婵近照变化太大了,熬过了最难的发育关,小姑娘彻底长开了,模样跟以前判若两人

全红婵近照变化太大了,熬过了最难的发育关,小姑娘彻底长开了,模样跟以前判若两人

In风尚
2026-08-22 06:04:58
只有美国印度算超级大国?剑桥教授:世界强国只有4个,没有印度

只有美国印度算超级大国?剑桥教授:世界强国只有4个,没有印度

誮惜颜a
2026-08-05 12:41:03
最高院:提供 “口交” “肛交”等进入式性服务,是否属卖淫行为?

最高院:提供 “口交” “肛交”等进入式性服务,是否属卖淫行为?

周军律师聊案子
2026-04-21 09:50:16
哨兵被队友遗忘,深埋地下9年,发现时仍坚守军需库,双目已失明

哨兵被队友遗忘,深埋地下9年,发现时仍坚守军需库,双目已失明

芊芊子吟
2026-08-26 14:55:15
陈诚悍将夏楚中,抗战神勇但人品极差,败退到台湾无力养九个孩子

陈诚悍将夏楚中,抗战神勇但人品极差,败退到台湾无力养九个孩子

黑句本
2025-11-18 21:40:50
十年前就在研制,十年后仍未露面,轰20设计方案极可能经过了大改

十年前就在研制,十年后仍未露面,轰20设计方案极可能经过了大改

军武吐槽君
2026-08-26 16:09:35
如何一眼看出两个人私下里发生了秘密关系?网友:海关需要你

如何一眼看出两个人私下里发生了秘密关系?网友:海关需要你

夜深爱杂谈
2026-08-21 20:04:26
央视选角大翻车?顶着张歪瓜脸,演特警像混混,连段奕宏都救不了

央视选角大翻车?顶着张歪瓜脸,演特警像混混,连段奕宏都救不了

阿讯说天下
2026-08-20 11:47:44
中国25岁女留学韩国后续:凶手为“男友”,具体身份曝光,与亲属聊天内容公布

中国25岁女留学韩国后续:凶手为“男友”,具体身份曝光,与亲属聊天内容公布

李晚书
2026-08-26 11:57:18
伊朗获邀参加“麦加共同防务协议”,特朗普从急着打击到急着谈判!

伊朗获邀参加“麦加共同防务协议”,特朗普从急着打击到急着谈判!

新民晚报
2026-08-26 09:59:33
“他的智商已经不是普通人了”,宝妈公开厌恶天才儿子:只想揍他

“他的智商已经不是普通人了”,宝妈公开厌恶天才儿子:只想揍他

泽泽先生
2026-08-06 11:01:17
车长5.355米!理想新车曝光:9月2日正式发布

车长5.355米!理想新车曝光:9月2日正式发布

科技阿维
2026-08-27 10:44:45
独生子+父母有退休金,现实里的含金量,远比想象中更实在

独生子+父母有退休金,现实里的含金量,远比想象中更实在

蝉吟槐蕊
2026-08-25 13:10:05
姆巴佩帽子戏法征服伯纳乌,穆里尼奥:他真的太棒了

姆巴佩帽子戏法征服伯纳乌,穆里尼奥:他真的太棒了

失我者永失qq
2026-08-27 16:21:14
56岁张延和港星张锦程离婚,结束逾20年婚姻,男方发声证实

56岁张延和港星张锦程离婚,结束逾20年婚姻,男方发声证实

开开森森
2026-08-26 14:38:10
姑娘,别什么衣服都穿着进泳池的,亮点一览无余,太尴尬了

姑娘,别什么衣服都穿着进泳池的,亮点一览无余,太尴尬了

舞指飞扬
2026-08-26 07:26:07
8月25日俄乌最新:50国发表反俄宣言

8月25日俄乌最新:50国发表反俄宣言

西楼饮月
2026-08-25 20:54:42
“不愧是江浙沪,人脚一双泰兰尼斯”,幼儿园合照火了,现实差距一目了然

“不愧是江浙沪,人脚一双泰兰尼斯”,幼儿园合照火了,现实差距一目了然

妍妍教育日记
2026-08-24 19:52:34
深圳交通运输局原局长韩立清,任罗湖区代理区长

深圳交通运输局原局长韩立清,任罗湖区代理区长

南方都市报
2026-08-27 10:22:07
金蝉脱壳:15年领走18亿,暴雷前套现30亿,不签字不做法人,他才是恒大最“精明”的人

金蝉脱壳:15年领走18亿,暴雷前套现30亿,不签字不做法人,他才是恒大最“精明”的人

z千年历史老号
2026-08-24 22:04:25
2026-08-27 17:07:00
四木相对论 incentive-icons
四木相对论
唠唠科技,看看世界
182文章数 3关注度
往期回顾 全部

财经要闻

英伟达,营收翻倍大增,指引碾压预期

头条要闻

重磅打"虎" 江西省委副书记、省长叶建春被查

头条要闻

重磅打"虎" 江西省委副书记、省长叶建春被查

体育要闻

因为这条规则,欧联冠军一个夏天散伙了

娱乐要闻

包贝尔幽会后陪老婆!曾炫耀谈7个女友

科技要闻

苹果邀请函:新CEO、折叠屏iPhone都要来了

汽车要闻

领克900:心之所向皆可抵达 | 潮汕篇

态度原创

游戏
亲子
家居
房产
公开课

《霓虹深渊2》科隆展宣布秋季全平台上线!

亲子要闻

我们面剂子就是在满满的爱里长大的小孩啊

家居要闻

2026建博会(广州) 公装联探展交流活动

房产要闻

落户江东!京东海南总部方案曝光!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版