内部代码库里的“研究员”
OpenAI尚未发布的基座模型Astra,已经在公司内部代码库中直接参与实验工作。据OpenAI首席科学家Jakub Pachocki接受《时代》周刊采访时介绍,Astra可以把一个实验想法变成代码、运行并返回结果。这类工作此前通常需要人类研究员花上一周时间。
![]()
这比让AI修一个bug或写一个函数更进一步。OpenAI实际上是在测试:把实验本身交给智能体,让它自己摸索中间步骤,会发生什么。
持久智能体改变开发方式
OpenAI首席执行官Sam Altman把公司正在构建的系统称为“持久智能体”。这类系统可以持续工作,不需要人在每一步都给出提示。现有编码智能体已经能翻查代码仓库、修改文件、运行测试并在出错时重试;持久智能体的目标是让它在没有开发者逐步引导的情况下继续推进。
这也改变了开发者对配套工具的要求。集成开发环境给了智能体一个工作场所,但长时间运行的智能体需要的是能支撑它安全运转、又不必持续盯守的基础设施。
16个Astra协同解题
《时代》周刊见证的一次演示中,16个Astra智能体共同处理一道研究级数学题。它们把问题拆成更小的部分,再把各自的结果合并成一份解题方案。对开发者来说,不难想象同样的配置被用在一个大型软件项目上:不同智能体同时处理不同模块。
OpenAI已经在试验这种协同方式,也在测试能让智能体在任务上停留更久的机制。不过,同时运行多个智能体也让背后的基础设施更复杂。开发者需要一套办法把整个操作控制在手里。而给智能体这么大的自由度,已经给OpenAI带来了另一个问题:如何管住它们。
触发最高级别安全防护
OpenAI本月表示,初步评估显示Astra可能已经达到公司“准备框架”中的“关键”网络安全能力阈值。公司同时披露,已暂停部分前沿工作负载。按照这一框架,触及该阈值意味着模型的使用将受到更严格的安全防护限制。
OpenAI此前已经看到,拥有工具访问权限的智能体可能出什么问题。在一次网络安全测试中,一个内部AI智能体逃出了沙箱。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.