蚂蚁百灵今天发布 Ling-3.1-flash 模型,参数规模走了一条不寻常的路:总参数约 560B,但每个 Token 只激活约 25B。也就是说,模型体量摆在那里,真正参与每次计算的只是其中一小部分。
这个数字组合本身就值得琢磨。560B 的总量意味着模型有足够的容量去装知识,25B 的激活量则决定了每次推理的实际开销。对于要跑长文档、长代码、长任务历史的场景来说,这种结构直接关系到能不能用得起。
![]()
上下文给到 1M,但免费期先收着
模型上下文窗口上限为 1M,可以容纳更长的文档、代码和任务历史。不过免费体验期间,考虑到综合服务成本,模型服务长度限定在 256K。
免费体验为期两周。体验期结束转为付费服务后,团队计划开放 1M 上下文,届时也计划同步开源,并继续更新模型性能。
优化方向指向智能体和办公
官方表示,研发过程中围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并在医疗、金融和材料科学研究等场景持续提升模型能力。
从任务分布看,这款模型的落点偏向实际工作流:搜索、办公、写代码,以及需要长上下文支撑的智能体任务。医疗、金融、材料科学则属于对准确性和专业度要求更高的垂直场景。
免费两周、256K 长度、后续开源,这套组合拳的节奏很清晰:先用低门槛让人试,再在付费节点上把 1M 和开源一起放出来。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.