中经记者 陈佳岚 广州报道
大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。
9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。是目前端侧模型中首个原生支持最长100万Token上下文的产品,两款模型将百万级信息处理能力带到本地设备。
《中国经营报》记者留意到,两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化。基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练。
在具体场景中,星火X2.5系列展现出较强的任务执行能力。个人办公场景中,星火X2.5端侧模型可覆盖数据处理、文档生成和文档翻译等环节。以Loomy上的办公案例为例,用户上传销售明细表并提出销售分析和中英文部门业绩报告的交付需求后,星火X2.5-4B首先编写脚本完成数据汇总、关键指标提取和趋势分析,随后生成约3000字的中文部门业绩报告,并沿用原有结构和格式生成英文版报告,最后完成内容、结构和排版校验,实现从原始数据分析到双语报告交付的完整流程。
以智能家居为例,在Domux测试集上,星火X2.5-1.7B控制指令端到端执行正确率达90.3%,平均响应时间仅0.85秒。
而在机器人应用场景中,星火X2.5-4B和1.7B同样适用于机器人及其他需要持续感知和连续执行的场景。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。
据介绍,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架。即日起,模型权重已在Hugging Face、GitHub等平台开放,对应API也已上线讯飞星辰MaaS平台。
据悉,9月7日,科大讯飞还将正式发布星火X2.5-293B通用大模型,进一步升级代码和智能体等核心能力。
(编辑:吴清 审核:李正豪 校对:翟军)
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.