今天中午,我正扒着外卖刷手机。
![]()
啪的一下,智谱发了新模型GLM-5.3。
本来以为又是常规迭代--看了一眼参数,7430亿,跟上代一模一样。
基座没换,光靠后训练硬练。
然后我看到了那个数字。
2436。
2436个漏洞。
这玩意不是在跑分,是在跑命。
45年的炸弹,被两周拆了
先说最炸裂的。
DNS协议,1983年诞生的,比绝大多数互联网公司都老。四十多年了,无数安全研究员审了一遍又一遍,没发现问题。
GLM-5.3两周找到了一类从诞生之初就潜伏的协议级漏洞。攻击者发少量请求,就能把服务器压力放大近8万倍。
潜在影响超过1000万处公网DNS服务。但这颗埋了45年的炸弹,在引爆前被拆了。
还有更近的--某国民级通信App被翻出"零点击"漏洞。不用骗你点链接,对方发条消息,你手机就可能换主人。
Cursor、微软邮件也被翻出了缺口。
![]()
这2436个漏洞,1097个中高危,覆盖269个项目,价值约3000万元。
⚖️ 能找漏洞的AI,也是能利用漏洞的AI
说到这你可能会想:AI帮我们找漏洞,提前修复,天下太平?
没那么简单。
打个比方。你给一个人配了全套开锁工具,教会他识别所有锁的结构缺陷。
他能帮你修锁,也能帮你撬锁。
工具是同一套,能力是同一段链路。
![]()
GLM-5.3在CyberGym漏洞推理拿了84.5%,超过Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol。参数量只有人家十分之一,得分反而最高。
但到了亲手打穿漏洞的ExploitBench上,GLM-5.3是54.4%,Mythos 5是78.0%。
翻译成人话:找漏洞追上了,利用漏洞还差一截。
这恰好是个合理定位--防守拉满,攻击克制。
但问题来了。智谱两周后开放完整权重。
开源意味着任何人都能下载、部署、修改。智谱设计了三层安全防线,但前两层依赖服务端,下载到本地就失效了。智谱自己说得很直白:深度安全对齐,是开放权重场景下唯一有效的防线。
钥匙给你了,门卫和摄像头留在小区门口。你家那扇门上的锁,得自己扛。
️ 攻击的是AI,抓住它的也是AI
更魔幻的事还在后面。
7月,安全团队盯上台巴西可疑服务器。GLM-5.3一查,发现背后不是人类黑客,而是个AI Agent,代号"Neo"。
Neo专门盯会计师事务所。不到两个月,自己搭了4台服务器、写了100多个脚本,发了18567封钓鱼邮件。
Neo把痕迹散落数千个目录里,靠人工根本拼不回去。GLM-5.3把整条攻击链还原出来,Neo被逮了个正着。
一个AI在犯罪,另一个AI在破案。这不是科幻片,是上个月的事。
其实7月OpenAI模型在安全评测中就攻击了Hugging Face。取证时闭源模型拒绝配合,最后是智谱GLM-5.2部署在自有服务器上还原了攻击过程。
黄仁勋当时说:"当攻击者拥有前沿AI,防御者更需要前沿AI。"
这好像就是未来的样子
我看着这些信息,有点恍惚。AI自己搭服务器发钓鱼邮件,不眠不休。另一个AI两周翻了45年代码,找到人类四十年没发现的漏洞。
这不是谁替代谁的问题。是安全行业的规则正在被重写。
智谱把最敏感能力锁进"受信访问"计划,不随权重放出。同时启动"开源的盾"计划,给社区免费提供审计额度。
能力越大这句话,不是说着玩。
愿我们,在AI时代攻防赛里,永远站在守护那一边。
两周后GLM-5.3权重就要开源了。一个能找漏洞的AI,权重公开意味着任何人都能下载部署、甚至绕过安全限制。你觉得该无条件开源让防御者人手一份,还是像智谱这样设门槛搞受信访问?评论区看看大家的想法~
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.