英伟达在AI推理能力评测上放出一记重拳。8月22日晚间,英伟达官方账号发布消息:其自研编码框架在ARC-AGI-3的25个公开游戏中取得100%满分,一口气解决了全部183个关卡。
这套框架并非通用大模型,而是专门为优化CUDA GPU内核而构建的编码工具。换句话说,英伟达没有靠堆模型参数量,而是从底层计算优化入手,把推理能力推到了评测天花板。
![]()
从“难跑”到“人人可跑”
英伟达在推文中同步抛出一个判断:有了智能体(agent)的辅助,行业正在从“自己跑模型、优化内核、做后训练非常困难”的世界,转向“几乎人人都能做这件事”的世界。
这个转变的潜台词很直接——过去,训练和优化AI模型与内核是顶尖工程师的专属技能,门槛高、周期长、算力消耗大。而英伟达这套自研编码框架的满分表现,意味着底层优化工作正在被自动化工具大幅接管。
100 million AI builders
推文末尾还留了一个问题:“1亿AI构建者,什么时候?”
这显然不是随口一问。满分通关ARC-AGI-3只是起点,英伟达真正想验证的是:当编码框架足够智能,AI开发的门槛会不会降到普通工程师甚至非技术人员也能参与的程度?
ARC-AGI系列评测向来以“反套路”著称,专门设计人类容易上手但AI容易翻车的抽象推理任务。此次25个公开游戏全部满分,说明这套框架在未知任务上的泛化能力已经相当扎实。
对行业意味着什么
如果英伟达这套框架从实验室走向生产环境,最直接的影响是CUDA内核优化的效率将大幅提升。过去需要数周人工调优的GPU计算任务,未来可能交给编码框架自动完成。
更进一步,当“优化”这件事被自动化,AI模型的开发周期会被显著压缩。英伟达设想的“1亿AI构建者”如果真的到来,行业竞争将从“谁更会调参”转向“谁更会用工具”。
当然,满分成绩目前仅限于ARC-AGI-3的25个公开游戏,更复杂的隐藏测试和真实生产环境的表现,还有待进一步验证。但至少在这个时间点,英伟达用一套自研编码框架,给“AI开发民主化”这个命题交出了一份相当有分量的答卷。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.