网易首页 > 网易号 > 正文 申请入驻

韩国AI独角兽获AMD参投3亿元,以300亿参数模型媲美中美顶尖模型

0
分享至

“过去,美国和中国的大模型遥遥领先于其他所有对手,但如今情况已不复存在。”说这句话的是韩国 AI 初创公司 Upstage 的创始人兼 CEO 金成勋(Sung Hun KIM)。

近日,该公司获得了 4500 万美元的投资(约合人民币 3 亿元),投资者包含亚马逊和 AMD 等,这使得该公司的总融资额达到了 1.57 亿美元。金成勋表示:“我们仅使用其他公司 10% 数量的 AI 芯片,就打造出了一款顶尖前沿大模型,成本效率远超同行。”该公司所研发的名为 Solar 的系列大模型,也被《金融时报》认为性能能够媲美中美两国的先进大模型,并被认为有希望代表韩国进军全球 AI 竞赛。与此同时,该公司也致力于帮助韩国实现“在全球 AI 竞赛中弥补差距”的目标。

据了解,金成勋出生于韩国,博士毕业于美国加利福尼亚大学圣克鲁斯分校。博士毕业之后,他曾在韩国互联网软件公司奈良视觉有限公司(Nara Vision Co. Ltd)担任 CTO 6 年左右。后在香港科技大学担任副教授一职将近 14 年。2020 年,他在韩国创办 Upstage 公司并担任 CEO。目前,其谷歌学术的 H 指数达到 58。

有意思的是,金成勋此前的工作经历主要在中国香港完成,在中国的工作经历想必也为他的创业带来了一定助力。

露西·帕克(Lucy Park)是该公司的另一位联合创始人,其博士毕业于韩国首尔科技大学,目前是该公司的首席产品官。

该公司于 7 月推出的 Solar Pro 2 模型,已成为韩国首款被独立基准测试分析机构 Artificial Analysis 认定为“前沿模型”(frontier model)的大模型。

根据 Artificial Analysis 的智能指数,Solar Pro 2 在多项基准测试中的综合得分高于 Anthropic 的 Claude 3.7 Sonnet Thinking、DeepSeek 的 V3 以及 OpenAI 的 GPT-4.1——排名仅次于全球前十的前沿模型。

金成勋强调,尽管 Solar Pro 2 的“参数”仅为 300 亿,但性能已超越多家老牌企业的模型。他表示,公司之所以能实现这一突破,是因为采用了名为“深度扩展”(DUS,Depth-Up Scaling)的训练方法:通过对基础模型进行信息层的移除与新增,在计算效率与模型性能之间找到了平衡。该方法包含深度维度扩展与持续预训练两个核心环节。与其他采用专家混合(MOE,Mixture-of-Experts)技术的大模型扩展方法不同的是,深度扩展方法无需进行复杂调整,即可实现高效的训练与推理。实验结果表明,深度扩展方法虽然原理简洁,但能有效将小型高性能语言模型扩展为更大规模的模型。经深度扩展方法扩展的模型无需额外模块(如门控网络、动态专家选择模块)。因此,使用深度扩展方法扩展的模型具备以下特点:首先,无需为实现最优训练效率而设计专属训练框架;其次,无需为实现快速推理而依赖专用 CUDA 核函数。最终,经深度扩展方法扩展的模型可无缝集成到现有训练与推理框架中,同时保持较高效率。值得注意的是,深度扩展的相关论文也是金成勋目前引用量最高的论文。

据了解,Solar Pro 2 擅长为金融、法律、医疗领域的企业处理复杂计算任务,目前已被英特尔以及三星、韩华(Hanwha)的保险子公司采用。该公司还表示,五家“美国大型保险公司”也有意引入该模型,以辅助核保流程。

前沿模型的参数规模通常在 1000 亿至 2000 亿之间,这意味着它们需要更强的计算能力来完成运算。在 Artificial Analysis 最新指数中排名第一的 xAI 公司 Grok 4 模型,参数规模更是高达 1.7 万亿。而 Solar Pro 2 不仅在韩语处理方面较为出色,它在关键基准测试中,性能超越了许多参数规模大得多的模型。该公司在公司官网博客中写道:“Solar Pro 2 充分证明,小型模型依然可以引领行业发展。”

在 Ko-Arena-Hard-Auto 基准测试中,Solar Pro 2 的性能与 GPT-4、Claude 3 相当。这一结果凸显出,即便在复杂的对抗性场景中,Solar Pro 2 也能生成自然且准确的响应,具备与顶尖模型抗衡的能力。

除在 Ko-Arena-Hard-Auto 基准测试中表现突出外,Solar Pro 2 在各类通用韩语自然语言处理任务中均展现出稳定性能。它在 Ko-MMLU、Hae-Rae、Ko-IFEval 等关键基准测试中稳居领先地位。从文本摘要、翻译,到文档理解与开放式问答,在各类任务中,它均能与参数规模大得多的顶尖模型相媲美,甚至实现性能超越。其优势还覆盖韩语专业领域,可处理法律、金融、医疗等领域的文本内容。

该公司在官方博客中写道:“Solar Pro 2 不仅在韩语及其他语言的理解上表现卓越,其设计目标更超越了‘预测下一个词’的基础功能。”凭借多步推理能力与高精度分析能力,Solar Pro 2 可应对复杂数学计算、文档摘要、逻辑推导等各类任务。

当开启高级推理模式(Advanced Reasoning Mode)时,Solar Pro 2 在各类复杂任务中均展现出较好能力。配套基准测试表中的数据清晰表明,它在以下领域的性能优势显著:

  • 能够提升多步任务处理性能,在 MMLU、MMLU-Pro、HumanEval 等通用推理基准测试中均取得优异成绩,可为此提供佐证;
  • 擅长解决高级数学问题,在 Math500、AIME(以复杂数学推理著称的基准测试)等测试中表现突出;
  • 在复杂代码编写与软件工程任务中能力强劲,在 SWE-Bench Agentless 等基准测试中的成绩可印证这一点;
  • 实现了极高的“每参数推理效率”。

尽管 Solar Pro 2 仅为 310 亿参数模型,但其性能可与参数规模超自身两倍以上的模型抗衡。与此同时,Solar Pro 2 针对“与外部工具进行智能交互”进行了优化。它不仅能够理解语言,更能模仿人类行为模式,比如与环境交互、自主思考、执行必要功能。

金成勋认为,这一突破意味着韩国已跻身“拥有先进 AI 模型的少数国家”行列。目前,除了美国的 OpenAI、谷歌等行业领军企业,以及中国几家公司之外,全球拥有世界级前沿模型的机构寥寥无几,其他仅包括法国的 Mistral 以及中东地区由政府支持的 AI 企业。其认为,韩国老牌科技企业此前在 AI 领域“过于谨慎,错失良机”,而 Upstage 的成就已让韩国重新回归“研发超人类智能机器”的竞赛赛道。另据悉,Upstage 计划在未来一年内研发出一款参数规模达 1000 亿的新模型。

参考资料:

https://www.linkedin.com/in/hunkimup/

https://arxiv.org/pdf/2312.15166

https://www.lucypark.kr/

https://seng.hkust.edu.hk/about/people/faculty/sung-hun-kim

https://scholar.google.com/citations?hl=zh-CN&user=JE_m2UgAAAAJ&view_op=list_works&sortby=pubdate

运营/排版:何晨龙

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
伊朗储油罐要满了

伊朗储油罐要满了

第一财经资讯
2026-04-22 09:23:54
订单锐减,广东东莞15年电气大厂经济性裁员

订单锐减,广东东莞15年电气大厂经济性裁员

微微热评
2026-04-22 11:48:16
民政局提示走红网络!离婚不是工作人员造成的,请勿发泄负面情绪

民政局提示走红网络!离婚不是工作人员造成的,请勿发泄负面情绪

火山詩话
2026-04-21 16:36:16
耀兵沧海,乌克兰扫雷舰队将赴波斯湾,英国“游骑兵”亮剑乌东

耀兵沧海,乌克兰扫雷舰队将赴波斯湾,英国“游骑兵”亮剑乌东

史政先锋
2026-04-22 20:53:11
拉科塞维奇抵达东莞!借队友的电动车,去买了床上用品

拉科塞维奇抵达东莞!借队友的电动车,去买了床上用品

体育哲人
2026-04-22 17:29:46
中南医院护士长王婷:颜值、身材、能力“三绝”,各种奖拿到手软

中南医院护士长王婷:颜值、身材、能力“三绝”,各种奖拿到手软

汉史趣闻
2026-04-21 10:45:23
郭德纲发文,德云社再变动,释放3个强烈信号,岳云鹏地位又变了

郭德纲发文,德云社再变动,释放3个强烈信号,岳云鹏地位又变了

削桐作琴
2026-04-21 15:24:39
窜访宣布取消后,国民党表态,民众党向大陆摊牌,赖清德亲自回应

窜访宣布取消后,国民党表态,民众党向大陆摊牌,赖清德亲自回应

小兰聊历史
2026-04-22 15:18:30
突发!特朗普,彻底失控!

突发!特朗普,彻底失控!

财经要参
2026-04-22 18:45:56
雷霆三少谁赚得最多?哈登4.2亿,杜兰特5.9亿,看到威少我服了

雷霆三少谁赚得最多?哈登4.2亿,杜兰特5.9亿,看到威少我服了

云隐南山
2026-04-22 03:15:00
德国百年巨头倒下时,浙江修鞋匠花4500万买下,如今年入70亿

德国百年巨头倒下时,浙江修鞋匠花4500万买下,如今年入70亿

毒sir财经
2026-04-19 22:12:53
江苏南京与安徽马鞍山跨省地铁开通运营

江苏南京与安徽马鞍山跨省地铁开通运营

财联社
2026-04-22 17:52:06
姜文:我的女儿世界第一美,原以为是吹牛,看到照片后,没说谎!

姜文:我的女儿世界第一美,原以为是吹牛,看到照片后,没说谎!

TVB的四小花
2026-04-22 15:48:16
玉林烤鸭品牌创始人、玉林餐饮集团董事长邹胜利去世,北京烹饪协会:沉痛悼念

玉林烤鸭品牌创始人、玉林餐饮集团董事长邹胜利去世,北京烹饪协会:沉痛悼念

界面新闻
2026-04-22 14:23:15
2021年陕西女子给外甥补课,不料引狼入室,停电后外甥果断出手

2021年陕西女子给外甥补课,不料引狼入室,停电后外甥果断出手

纪实文录
2025-02-28 16:24:01
何鸿燊最后11年过得是什么样的日子?说出来可能颠覆很多人的认知

何鸿燊最后11年过得是什么样的日子?说出来可能颠覆很多人的认知

人生录
2026-04-22 19:01:34
连续两场1分未得,这到底是火箭全队的问题还是后场投手的问题?

连续两场1分未得,这到底是火箭全队的问题还是后场投手的问题?

稻谷与小麦
2026-04-22 22:19:21
2-1险胜却似“葬礼”:皇马赢了球,伯纳乌为何提前离场?

2-1险胜却似“葬礼”:皇马赢了球,伯纳乌为何提前离场?

落夜足球
2026-04-22 14:34:48
美加州热气球耗尽燃料降民居后院 13乘客淡定挥手 房主:难以置信

美加州热气球耗尽燃料降民居后院 13乘客淡定挥手 房主:难以置信

环球趣闻分享
2026-04-22 13:40:09
个人收款被查了!2026年个人收款高于这个数,要小心!

个人收款被查了!2026年个人收款高于这个数,要小心!

新浪财经
2026-04-21 22:04:32
2026-04-22 22:52:49
DeepTech深科技 incentive-icons
DeepTech深科技
麻省理工科技评论独家合作
16613文章数 514897关注度
往期回顾 全部

科技要闻

对话梅涛:没有视频底座,具身智能走不远

头条要闻

女生3万5买的比熊犬俩月后瘫痪 给犬做治疗花了20多万

头条要闻

女生3万5买的比熊犬俩月后瘫痪 给犬做治疗花了20多万

体育要闻

网易传媒再度签约法国队和阿根廷队

娱乐要闻

蜜雪冰城泰国代言人 被扒出辱华黑历史

财经要闻

医院专家号"秒空"!警方牵出黑色产业链

汽车要闻

纯电续航301km+激光雷达 宋Pro DM-i飞驰版9.99万起

态度原创

旅游
教育
时尚
艺术
健康

旅游要闻

春来普陀,赴一场绣球花的河畔之约

教育要闻

民办普高集中补录分数门槛降低!成都公布2026年民办中小学招生优化政策

用了8年还心动,这笔钱是花得真值啊

艺术要闻

无花不风景

干细胞抗衰4大误区,90%的人都中招

无障碍浏览 进入关怀版