网易首页 > 新闻中心 > 新闻 > 正文

天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑

0
分享至

(原标题:天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑)

       6月10日,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)对外宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,证明天数智芯有支持百亿级参数大模型训练的能力。

图 天数智芯产品线总监宋煜

       在北京市海淀区的大力支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。

图 天数智芯大模型训练全栈方案

       在三方的共同努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。与国际主流的A100加速卡集群相比,天垓100加速卡集群的收敛效果、训练速度、线性加速比相当,稳定性更优。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。

图 基于天垓100算力集群的AquilaCode大模型训练性能采样

       天垓100率先完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要的一步。这一成果充分证明了天垓产品可以支持大模型训练,打通了国内大模型创新发展的关键“堵点”,对于我国大模型自主生态建设、产业链安全保障具有十分重大的意义。

       接下来,天数智芯将与合作伙伴们继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,进一步夯实我国算力基础,助力人工智能产业自主生态建设。

       关于智源研究院

       北京智源人工智能研究院(简称“智源研究院”)是人工智能领域的新型研发机构。2018年11月14日,联合北京多家人工智能领域优势单位共建。智源研究院的愿景和目标是聚焦原始创新和核心技术,建立目标导向与自由探索相结合的科研体制,营造全球最佳的学术和技术创新生态,推动北京成为全球人工智能学术思想、基础理论、顶尖人才、企业创新和发展政策的源头,率先成为国际领先的人工智能创新中心,推动人工智能产业发展和深度应用,改变人类社会生活,促进人类、环境和智能的可持续发展。

       关于天数智芯

       上海天数智芯半导体有限公司(简称“天数智芯”)是中国领先的通用GPU 高端芯片及超级算力系统提供商。天数智芯以“服务国家战略”为己任,坚持“四个面向”,致力于开发自主可控、国际领先的高性能通用GPU产品,探索通用GPU赶超发展道路,加快建设自主产业生态,为全产业提供高端算力解决方案。未来,天数智芯将坚持中国特色的自主自强创新发展道路,打造更可信、更高效、更绿色的世界一流算力引擎,赋能千行百业数字化转型,促进我国数字经济高质量发展,开启中国引领世界走向元宇宙、数字孪生的崭新一页。

       关于爱特云翔

       爱特云翔专注为政企客户提供大数据中心、云计算、人工智能服务,是以“cloud + AI”为技术基座的科技创新型企业。爱特云翔目前拥有淄博临淄、宁夏中卫、青岛即墨等三个大数据产业园和IDC,总机柜数为2.2万个,已具备覆盖华北、华中、华东、华南的光纤网络,建立有北京、上海、淄博软件与算法研发中心、济南技术支持中心、深圳硬件设计中心、聊城智能物联生产线,及全国各地子公司等分支机构。

相关推荐
热点推荐
儿媳照顾50岁农村公公,酒后公公行夫妻之事,公公:儿媳经验丰富

儿媳照顾50岁农村公公,酒后公公行夫妻之事,公公:儿媳经验丰富

魅老八足球
2024-05-13 13:49:37
湖人大概率会放弃丁威迪,他们可以考虑追逐这位热火后场铁闸?

湖人大概率会放弃丁威迪,他们可以考虑追逐这位热火后场铁闸?

稻谷与小麦
2024-06-02 02:18:32
解放战争中,如果国民党获得胜利,今天的中国会是什么样

解放战争中,如果国民党获得胜利,今天的中国会是什么样

史诗长歌
2024-05-13 13:34:32
巴黎奥运会,这还能办吗?恳请中国代表团三思!

巴黎奥运会,这还能办吗?恳请中国代表团三思!

开心体育站
2024-06-01 19:14:04
结婚34年于蓝打胎两次,出轨被原谅,田方逝世后仅给她留下两百元

结婚34年于蓝打胎两次,出轨被原谅,田方逝世后仅给她留下两百元

可乐86
2024-05-29 09:09:04
大s哭了!儿童节箖箖与奶奶张兰连线,希望奶奶赚100w,对话温馨

大s哭了!儿童节箖箖与奶奶张兰连线,希望奶奶赚100w,对话温馨

圈里的甜橙子
2024-06-01 23:35:43
大陆中止ECFA关税减让后,台公布民调,称76%民众不认同九二共识

大陆中止ECFA关税减让后,台公布民调,称76%民众不认同九二共识

说天说地说实事
2024-06-01 07:51:39
铁头喷漆事件上了抖音百科,律师称他只要回国就没事了

铁头喷漆事件上了抖音百科,律师称他只要回国就没事了

映射生活的身影
2024-06-01 23:55:19
中国女排3-0泰国!李盈莹23分,朱婷首发砍17分,合影露出笑容

中国女排3-0泰国!李盈莹23分,朱婷首发砍17分,合影露出笑容

体育哲人
2024-06-01 21:23:13
比亚迪秦L实测续航超2400公里!欧阳明高院士:插电混动技术比增程更强,美国人终于明白为啥要加100%关税了【附新能源汽车行业市场前景分析】

比亚迪秦L实测续航超2400公里!欧阳明高院士:插电混动技术比增程更强,美国人终于明白为啥要加100%关税了【附新能源汽车行业市场前景分析】

前瞻网
2024-05-30 18:51:15
值吗?贝林转会皇马总价可达1.339亿欧,处子赛季23球13助

值吗?贝林转会皇马总价可达1.339亿欧,处子赛季23球13助

直播吧
2024-06-02 05:22:30
张兰自曝患病!头上脖子长满白斑引人担忧!网友:跟大S有关!

张兰自曝患病!头上脖子长满白斑引人担忧!网友:跟大S有关!

娱乐八卦木木子
2024-06-02 04:04:59
成都蓉城官方:俱乐部已收到国际足联通知邮件,注册禁令已解除

成都蓉城官方:俱乐部已收到国际足联通知邮件,注册禁令已解除

直播吧
2024-06-01 18:21:12
多特0-2丢欧冠,赛后穆里尼奥上演暖心一幕,球迷:真正的风度

多特0-2丢欧冠,赛后穆里尼奥上演暖心一幕,球迷:真正的风度

侧身凌空斩
2024-06-02 06:00:56
微信上从不发朋友圈的人,不是低调,十有八九是这三种人!

微信上从不发朋友圈的人,不是低调,十有八九是这三种人!

华人星光
2024-06-01 15:40:05
马斯克脑机接口公司首位「用户」:80%设备已脱落,生活被颠覆了

马斯克脑机接口公司首位「用户」:80%设备已脱落,生活被颠覆了

爱范儿
2024-06-01 12:08:17
红军时期,为何要组建西路军西征?是时候告诉大家真相了!

红军时期,为何要组建西路军西征?是时候告诉大家真相了!

小新历史
2024-06-01 18:28:03
切糕都得甘拜下风,卡车摊榴莲有啥“套路”?买回家之后,我懂了

切糕都得甘拜下风,卡车摊榴莲有啥“套路”?买回家之后,我懂了

煮菜婆
2024-05-30 22:36:12
绝对王者!皇马是欧冠时代首个决赛20+球的球队 是其他队至少2倍

绝对王者!皇马是欧冠时代首个决赛20+球的球队 是其他队至少2倍

直播吧
2024-06-02 05:33:13
有这样的老板你几点回家?

有这样的老板你几点回家?

花小萌和你聊情感
2024-06-01 18:09:35
2024-06-02 07:32:49

头条要闻

小伙投资300万在瑞典开拉面馆生意火爆 1碗面卖100元

头条要闻

小伙投资300万在瑞典开拉面馆生意火爆 1碗面卖100元

体育要闻

女排最强2主攻合体 合砍40分打懵泰国

娱乐要闻

白玉兰提名:胡歌、范伟争视帝

财经要闻

实锤!普华永道,危!

科技要闻

余承东:不卷价格!雷军:将双班制生产!

汽车要闻

吉利银河E5 Flyme Auto智能座舱首发

态度原创

教育
房产
旅游
亲子
数码

教育要闻

父母吵架时,孩子在想什么?

房产要闻

重磅!琼海出台楼市新政:住房出租、挂牌计划出售,都可减套数!

旅游要闻

台北故宫博物院新展:文书珍品里的端阳时节

亲子要闻

弟弟每次见到姐姐回家就粘着,寸步不离,受委屈也是找姐姐诉苦

数码要闻

消息称 AMD 锐龙 9000 系列 Zen5 桌面处理器将于 7 月上市

无障碍浏览 进入关怀版
×