NVIDIA通用编码智能体AVO在ARC-AGI-3交互推理基准上拿下100%成绩,完成全部25个公开环境中的183个关卡,无一失手。
不靠规则,靠试错
![]()
AVO的特殊之处在于不依赖预设规则或目标,而是通过试错观察环境反馈来学习。更关键的是,它在上下文重置后仍能长期积累记忆,持续优化策略。
Claude Opus 5驱动
该智能体由Claude Opus 5驱动,此前曾自主运行七天优化GPU代码。这次在ARC-AGI-3上的满分表现,意味着通用编码智能体在抽象推理和交互学习能力上又迈了一步。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.