网易首页 > 网易号 > 正文 申请入驻

多个领域突破!科大讯飞深度推理大模型讯飞星火X1全新升级

0
分享至

4月20日,科大讯飞深度推理大模型——讯飞星火X1迎来全新升级。作为当前业界唯一基于全国产算力训练的深度推理大模型,升级后的星火X1在数学、代码、逻辑推理、文本生成、语言理解、知识问答等通用任务上效果显著提升,在模型参数比业界同类模型小一个数量级的情况下,整体效果对标OpenAI o1和DeepSeek R1,再次证明了基于国产算力训练的全栈自主可控大模型具备登顶业界最高水平的实力和持续创新的潜力。

星火X1除了在常见通用任务取得显著进步之外,由于融入了更多场景复杂类型数据,模型的泛化性也取得了进步,多个行业任务上展现出了业界领先的能力。在重点行业如教育、医疗、司法等进一步扩大了领先优势。

面向企业和广大开发者,讯飞星火X1首发“快思考、慢思考统一模型”,全新升级模型定制优化工具链,进一步降低大模型私有化部署和定制门槛;同时,讯飞星火X1 API已上线讯飞开放平台开放服务,作为首个支持全国产算力微调的推理大模型,讯飞星辰MaaS平台同步上线了星火X1微调服务。

讯飞星火X1全面升级,通用能力比肩国际顶尖模型水平

升级后的星火X1在多个任务上效果继续突破,展现出优异的性能。根据最新测试集评测结果,星火X1在通用任务效果评测中全面对标OpenAI o1和DeepSeek R1,在数学、知识问答等方面表现突出。

※测试集合来源:自建测试集主要来自真实的大模型请求任务数据,来源分布包括讯飞星火APP、星火大模型API、业界主流任务数据等;公开测试集主要以数学、答题、推理、代码等外部典型测试集为主。

数学答题和复杂的数理逻辑推理方面,星火X1能够准确识别出复杂的数学公式,不仅给出完整的解题思路,输出结果也严谨清晰;在逻辑推理时全方位思考,思考可能出现的每一种假设,表现出更强的严谨性和准确性。代码能力上,星火X1不仅提高了代码生成的准确率,对生成代码逻辑理解也进一步提升,能够应对更复杂的编程需求,思考问题的多种可能性,帮助开发者快速实现功能。在语言理解方面,模型输出内容、格式更加符合用户指令要求,能够给到更加准确且深度思考的结果,生成内容更加连贯、准确。

此外,星火X1的长思维链能力支持图像输入,可以对输入的图像进行关联思考,对于图像中的多种复杂元素,探究可能的含义和目的,进行更深层次的信息整合和推理。

多个行业任务业界领先,讯飞星火X1部署更简便,定制门槛更低

本次星火X1升级不仅提升了通用能力,也同步增强了面向行业的解决方案能力,助力产业智能化转型。由于融入了更多场景复杂类型数据,模型的泛化性也取得了进步,多个行业任务上展现出了业界领先的能力。在重点行业,如教育、医疗、司法等进一步扩大了领先优势。以司法行业为例,对于行业专业需求,例如根据材料总结案件事实以及判决理由,升级后的星火X1能够精准把握用户指令,详细分析争议点,快速定位关键信息,并输出准确内容,为行业用户提供专业、可靠的智能支持。

※测试集合来源:真实场景测试集。

值得一提的是,全新升级的讯飞星火X1在行业实际应用中具有显著优势。

在技术创新和模型部署方面,星火X1首发“快思考、慢思考统一模型”,由一个模型同时支持两种思考模式,提升了模型处理不同复杂度任务的能力,满血版星火X1仅需4张卡(华为910B)即可部署,简化了私有化部署流程。

同时,星火X1还全新升级了模型定制优化工具链,支持SFT(监督微调)、强化学习两种模型定制优化方案,只需16张卡(华为910B)即可完成行业定制优化,有效降低了企业AI的定制门槛,使各行业能更便捷地落地AI应用价值。

三大核心技术突破,国产AI迈向自主可控新阶段

讯飞星火X1的全新升级背后,是一系列独特的技术创新与理念突破。

首先,提出基于问题难度的大规模多阶段强化学习方法,在复杂推理、数学、代码、语言理解等场景全面提升模型效果及泛化性;同时提出强化学习动态更新算法,基于样本采样长度动态调整强化学习更新速度,进一步提升深度思考强化学习效率及效果。

其次,统一模型下的快慢思考混合训练方法,充分发挥快慢思考数据相互促进作用,实现基于系统指令控制模型是否深度思考,支撑下游更高效便捷地部署使用;

第三,实现多项工程技术创新,显存动态卸载技术大幅提升长文本推理并发、训推共卡协同实现高效训推资源转换、推理引擎冬眠机制实现快速拉起和恢复,实现国产算力平台上高效和稳定的强化学习训练全流程。

在中美科技竞争日趋激烈的背景下,星火X1选择的全国产化技术路径更具深远意义。最近,科大讯飞与华为昇腾联合团队在前期工作基础上再获突破,升级MoE模型的PD分离+大规模专家并行系统方案,实现了集群推理性能翻番,包括PD分离部署提升20%+性能、MTP多token预测技术提升30%+整体性能、专家负载均衡算法优化使集群吞吐提升30%+,以及异步双发射技术降低服务请求调度耗时提升10%系统性能。坚定自主可控算法创新和系统工程创新,使得基于国产算力的星火大模型能够快速迭代进步,在实际应用场景取得显著效能优势,在当前国际形势下也更具战略韧性。

此次讯飞星火X1的全面升级,不仅展示了中国人工智能技术在国产算力平台上的创新突破,也为各行各业数字化转型提供了新的可能。作为基于国产算力训练的大模型代表作,星火X1的表现证明,在技术自主可控的道路上,中国AI已具备与国际顶尖模型同台竞技的实力。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
李泽楷被她迷得疯狂,林丹为她不顾孕妻,她究竟有什么魅力?

李泽楷被她迷得疯狂,林丹为她不顾孕妻,她究竟有什么魅力?

丰谭笔录
2026-01-11 07:25:08
离春节仅一个月,辛柏青传来好消息,近况曝光,朱媛媛可以安心了

离春节仅一个月,辛柏青传来好消息,近况曝光,朱媛媛可以安心了

银河史记
2026-01-13 12:30:15
赖清德支持的赖瑞隆初选胜出,将代表民进党参选2026年高雄市长

赖清德支持的赖瑞隆初选胜出,将代表民进党参选2026年高雄市长

海峡导报社
2026-01-13 12:16:03
外国人对中国的误解有多深?网友:很多时候感觉外国人也挺没见识

外国人对中国的误解有多深?网友:很多时候感觉外国人也挺没见识

带你感受人间冷暖
2025-12-20 00:10:07
出圈了!代旭儿子小名叫代劲,妻子尹雨航被称女版鹿晗

出圈了!代旭儿子小名叫代劲,妻子尹雨航被称女版鹿晗

爱吃冰棍的小痞子
2026-01-13 12:02:06
网传《歌手2026》阵容,可信度太高,谁会得“冠军”呼之欲出

网传《歌手2026》阵容,可信度太高,谁会得“冠军”呼之欲出

楚楚号
2026-01-12 06:48:55
一颗榴莲,快让东南亚卷成“晋西北”了!

一颗榴莲,快让东南亚卷成“晋西北”了!

流苏晚晴
2026-01-07 20:13:10
美国国务院要求美国公民立即离开伊朗

美国国务院要求美国公民立即离开伊朗

财联社
2026-01-13 08:12:06
再次提醒,红旗河工程全是骗局!所有工程人,一定要远离

再次提醒,红旗河工程全是骗局!所有工程人,一定要远离

荷兰豆爱健康
2026-01-12 11:32:56
马克龙吐槽扎心了!欧洲好日子彻底到头!

马克龙吐槽扎心了!欧洲好日子彻底到头!

达文西看世界
2026-01-13 14:47:48
沙特1-0胜澳大利亚,庆幸避开中国队,澳队欲哭无泪

沙特1-0胜澳大利亚,庆幸避开中国队,澳队欲哭无泪

大昆说台球
2026-01-12 16:10:14
85%的血管淤堵,根本不用过度治疗!医生:做好3件事,比吃药管用

85%的血管淤堵,根本不用过度治疗!医生:做好3件事,比吃药管用

孟大夫之家1
2026-01-09 15:47:05
丹麦女首相为了讨好美国,像疯狗一样咬中国,结果美国要吃它狗腿

丹麦女首相为了讨好美国,像疯狗一样咬中国,结果美国要吃它狗腿

百态人间
2026-01-12 16:23:16
假如美国真把加拿大、格陵兰岛并入版图,将没有国家能与美国抗衡

假如美国真把加拿大、格陵兰岛并入版图,将没有国家能与美国抗衡

扶苏聊历史
2026-01-10 07:30:03
俄媒:土耳其希望加入巴沙防务联盟

俄媒:土耳其希望加入巴沙防务联盟

参考消息
2026-01-12 14:13:51
大力扩充“突击部队”!西尔斯基的亲军卫队,为何最霸道?

大力扩充“突击部队”!西尔斯基的亲军卫队,为何最霸道?

战风
2026-01-12 15:13:40
1951年,58师全军抗命,师长:出了事脑袋给主席送去!结果怎样?

1951年,58师全军抗命,师长:出了事脑袋给主席送去!结果怎样?

史海孤雁
2026-01-05 16:35:10
土豪有多任性?看完开眼界了,穷限制了我的想象啊

土豪有多任性?看完开眼界了,穷限制了我的想象啊

夜深爱杂谈
2026-01-03 22:15:07
朱雨玲夺冠不到24小时,恶心一幕发生,遭殃的何止孙颖莎、王曼昱

朱雨玲夺冠不到24小时,恶心一幕发生,遭殃的何止孙颖莎、王曼昱

李健政观察
2026-01-13 11:01:43
章泽天首录播客探梁朝伟3亿豪宅,刘嘉玲讲话时她偷笑如高中生

章泽天首录播客探梁朝伟3亿豪宅,刘嘉玲讲话时她偷笑如高中生

无心小姐姐
2026-01-12 18:58:26
2026-01-13 16:03:00
互联网那些事 incentive-icons
互联网那些事
深挖品牌故事,探寻商业逻辑
1912文章数 6050关注度
往期回顾 全部

科技要闻

每年10亿美元!谷歌大模型注入Siri

头条要闻

78岁陶华碧"出山救子" 老干妈"触底反弹"1年大卖54亿

头条要闻

78岁陶华碧"出山救子" 老干妈"触底反弹"1年大卖54亿

体育要闻

CBA还能众筹换帅?

娱乐要闻

周杰伦以球员身份参加澳网,C位海报公开

财经要闻

中国一口气申报20万颗卫星,意味着什么?

汽车要闻

限时9.99万元起 2026款启辰大V DD-i虎鲸上市

态度原创

房产
游戏
数码
本地
公开课

房产要闻

重磅调规!417亩商改住+教育地块!海口西海岸又要爆发!

PS玩家冲!港服节日特惠更新:大镖客、剑星超好价

数码要闻

2025全球Mini LED背光市场达143亿美元 中国贡献近六成份额

本地新闻

云游内蒙|到巴彦淖尔去,赴一场塞上江南的邀约

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版