谷歌母公司Alphabet发布了新一代AI模型Gemini 4 Argon,官方称这是它迄今最强大的模型。它能处理的任务包括编程、研究和写作,但谷歌真正想强调的,是它在网络安全上的特殊能力。
这款模型没有面向所有人开放。谷歌只把它推给了一批精选的网络安全合作伙伴,走的是自家安全计划Fairwind Program的渠道。换句话说,绝大多数开发者和企业现在还用不上它。
![]()
专门为防御性网络工作训练
谷歌表示,Argon是专门为防御性网络工作训练的。按照公司的说法,它可以“自主发现、验证并修补关键软件漏洞”。这句话里的三个动作——发现、验证、修补——构成了一个完整的闭环,而不是只做其中一步。
除了安全,Argon在编程和工程上也被认为表现不错。谷歌提到,自家员工已经在日常工作中使用这个模型,包括调试和代码库迁移。公司还强调了它解析视觉内容的能力,比如分析长视频或图表里的信息。
谷歌在周三的一篇博客中写道:“Argon为在复杂、长周期的工作流中维持深度推理而构建,它正在从根本上改变我们在谷歌工作和构建的方式。”
对标名单上写着GPT-6和Fable
顶级AI实验室近来都在争相发布越来越强的模型,一边互相较劲,一边又警告AI可能失控。不久前,OpenAI发布了Astra,称其为自家最好的模型。今年早些时候,Anthropic的Fable发布时,公司也用了类似的说法。
各家都在努力把自己的服务宣传得比对手更强。谷歌在博客中声称,在一系列AI基准测试上,Argon的得分显著高于OpenAI的GPT-6 Astra,以及Anthropic的Fable和Opus模型。谷歌引用了Vals的数据来支撑这一说法——这是一家越来越受欢迎的AI基准测试初创公司,其AI模型指数显示Argon目前处于领先位置。
这些对比数字来自谷歌自己的博客,是公司单方面的说法。基准测试本身如何设计、测试环境是否一致,这些细节决定了分数能说明多少问题。
从“落后”到月活十亿
谷歌曾经被认为在“AI竞赛”中处于落后位置,但最近凭借Gemini尝到了甜头。公司在8月宣布,其应用每月用户超过十亿。这个数字让它足以与OpenAI竞争——后者最近也宣布ChatGPT月活达到十亿。
把这两件事放在一起看,谷歌这次发布Argon的姿态就清楚了:一边用十亿月活证明自己的产品规模,一边用基准测试分数证明自己的技术上限。而Argon只向少数安全合作伙伴开放,说明谷歌在网络安全这个方向上选择了先小范围验证,而不是直接铺开。
对于关注AI能力边界的从业者来说,Argon值得留意的不是它又刷新了哪个榜单,而是“自主发现、验证并修补漏洞”这个能力组合——如果它真能稳定跑通,安全团队的日常工作方式会被重新定义。当然,目前能验证这一点的,只有那批拿到访问权限的合作伙伴。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.