Qwen3.8-Max-Preview测评报告来了。
上两天才测了Kimi K3,今天就发现Qwen3.8-Max预览版模型已首发上线,阿里tokenplanhold及colour新模型还提供限时优惠,白天credits消耗限时一折,夜间更低,所以哥肯定得赶紧去测下,看下是否真的能打了。废话不多说,祖传测试,用例拿出来。
·开测第一题:强约束。指令遵循句子生成测试,速度还不错,明显比Kimi K3快很多,且很明显结果是1-10结尾。看一下语句是否通顺,不错,都是没有问题的。好久没有看到有模型把这题做到全对的了,希望后续的测试也能给我个惊喜。
![]()
·第二题:四点问题。答案正确,不错。
·第三题:密码锁推理题。答案应该是12753,答案也是对的,看来这模型有戏。赶紧看一下编程题。
·第四题:实现个精美浏览器操作系统。这速度确实可以,没有像上次测Kimi K3那样等得我头晕,整个界面看上去也不错。玩一下,基本功能没有问题。玩一下,太空射击游戏,内置的游戏做的也不错,UI不错,也没有出现功能性问题。
![]()
·第五题:实现个3D赛车游戏测试。玩一下,玩起来感觉还不错,没有看到什么明显错误。
![]()
·第六题:无第三方库。实现一个高颜值Trello看版。打开看一下,这个UI不错,基本和原生Trello一模一样。看一下基本功能,列表和代办卡片增改没有问题,列表和卡片拖动也没有问题。有一个小问题就是代办的删除,我没有找到地方删,而列表删除是没有问题的。
![]()
整个测评下来,这个模型确实能打。虽然最后一道编程题有点小问题,但是瑕不掩瑜。回顾下Kimi K3上次的测评,第一题是错了两句,第五题赛车题是车子一直往右拐无法控制的,最后一题也有点输入框高度的问题。所以就这套测试用力来说,我更喜欢这个模型多点,况且速度真的快多了。
这一集就到这了,AI产品狙击手每天分享免费AI工具和技巧,关注我。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.