阿里千问把刚发布一个月的旗舰 Qwen3.8-Max 又升级了,推出 Qwen3.8-Max-0902。参数规模没变,仍是 2.4T 参数和 100 万 Token 上下文。这次主要继续做 Coding 和 Cowork 后训练,重点补编程、复杂工作流和长时间 Agent 任务。
阿里公布的对比表里,0902 在 8 项编程评测上全部高于原版。TerminalBench 3.0 从 11.3 涨到 29.0,DeepSWE 1.1 从 56.6 涨到 69.3,QwenSWEbench V2 从 55.1 涨到 70.0。职业任务 JobBench 也从 53.4 涨到 64.0。
和 Claude Opus 5 相比,0902 仍输掉多数编程项目,但在 MLS-Bench-Lite、SWE-Atlas QnA 和 QwenSWEbench V2 三项超过对方。多模态四项相比原版只涨了 0.4 到 3 分,这轮升级的重点明显就是让 Agent 更会写代码、更会干活。上述成绩目前都是阿里自测。
Qwen3.8-Max-0902 现已上线 QwenCloud API,价格保持不变,仍为输入 2 美元、输出 6 美元/百万 Token。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.