IT时代网8月13日消息,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。这是 Qwen-Max 级别的模型首次开源权重,总参数 2.4T,每个 Token 激活 95B 参数,原生支持 262144 Token 上下文,并可扩展至 1010000 Token。
Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期智能体任务的端到端完成能力。官方云端版 Qwen3.8-Max 基于该开放权重模型构建,并叠加了更多面向生产环境的能力。
评测覆盖了编程智能体、通用智能体、专业工作和长上下文等方向。与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型相比,各项结果互有高低,并在 PaperBench、IFBench 等基准中取得所列模型里的较高成绩。
从技术细节看,每个 MoE 层包含 512 个专家,每个 Token 选择 10 个路由专家,同时激活 1 个共享专家;模型还进行了多步 MTP 训练,让推理引擎具备一次预测多个后续 Token 的能力。
在后训练环节,团队把任务从单任务扩展到跨天任务,把工作空间从多文件扩展到复杂异构目录,并构建了统一的奖励系统与在线数据均衡器,以支撑强化学习的稳定扩展。
![]()
注:本文综合自IT之家等,文中包含AI辅助创作的内容。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.