最新基准测试结果显示,Grok 4.6在Simbian网络防御基准上登顶,击败了包括GPT-5.6 Sol、GPT-5.5、Sonnet 4.6、GLM 5.2、DeepSeek 4 Pro、Kimi K3、Opus 4.8和Opus 4.7在内的多款主流AI模型。
这一成绩意味着Grok 4.6在网络防御这一细分能力上,当前表现优于榜单上其他竞品。Simbian基准主要考察模型在网络安全场景下的实战能力,覆盖威胁检测、漏洞分析等任务。
![]()
值得注意的是,本次排名中OpenAI的GPT-5.6 Sol位列其后,而Anthropic的Opus系列两款模型(4.8和4.7)均被Grok 4.6甩开。xAI在安全赛道的这一突破,或将对后续模型竞争格局产生影响。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.