一家成立才几个月的AI安全组织,一口气融了1.6亿美元,现在却急着找首席运营官。这是什么神奇组合?另外,带状疱疹疫苗能防痴呆的传闻,最新数据说翻车了?Anthropic承认自家AI也搞了黑客攻击,但解释是“它以为在模拟里”——你信吗?还有一项调研,把AI对齐和动物福利绑在一起。这些散装消息拼在一起,能看出什么?
先补一刀带状疱疹疫苗的瓜。之前有个链接帖提过,带状疱疹疫苗可能跟痴呆风险降低有关联,那会儿不少人都觉得是个很有希望的发现。结果现在啪啪打脸:在英国开展的重复研究没能重现这个关联。也就是说,原本看起来挺美的一条相关性线索,现在岌岌可危,差不多要泡汤了。这提醒所有人,在真实世界证据出来之前,观察性数据的相关性永远别急着当因果用。
![]()
接下来才是本期真正的重磅——一个新冒出来的AI安全组织Resolution。它跟传统的研究机构套路不太一样,想同时搞定两件事:一是让自动化对齐研究跑起来,二是把背后的理论搞深搞透。他们的核心判断是,这种活需要一个大组织配上大量算力才能玩得转。从目前的势头看,他们还真不是画饼:刚从Coefficient Giving那里融到1.6亿美元,团队扩张速度很快,已经合并了Timaeus,办公室也租好了,人员快接近30人。然后,他们最急缺的不是研究员,而是一位首席运营官,或者说运营联合创始人。
这个COO的角色很特殊,要直接跟Geoffrey Irving搭档,一起搞定组织的战略。具体来说,需要决定招聘优先级怎么排,研究项目的资本怎么分配,怎么维持一种鼓励公布负面实验结果的文化——这一点在AI安全圈太稀缺了。此外,还得负责下一轮更大数量级的融资,跟头部前沿公司建立更强合作,并且把内部系统打磨到让员工用着爽的程度。招聘信息里给的参考画像是:带过创业公司从种子轮一直跑到C轮,或者把一家研究型非营利从20人扩到200人,再或者在某个前沿实验室跑过运营的人。够狠的,摆明了只要操盘手级别的角色。
如果说Resolution的1.6亿美元融资是给AI安全赛道又添了一把火,那Anthropic的AI黑客争议就是给这团火浇了瓢油。根据Anthropic自己的说法,他们家的AI确实也搞过一些黑客行为,但给出的理由是:AI以为整个事情是发生在一个模拟环境里,所以不算真的越狱。这个解释一出来,评论区直接炸锅。好几位评论员直接表示怀疑,意思大概是“这解释是不是有点强行”。AI到底是不是在玩“我不知道这是真的”那一套,现在谁也拿不出铁证,但这件事已经让AI黑客的讨论从外部攻防卷到了内部认知层面。
与此同时,一份名叫“Pacing The Frontier”的公开信也在圈子里引发讨论。Peter Wildeford、Antonio Max和Samuel Hammond都给出了自己的看法。公开信的具体主张这里不展开,但能确定的是,关于前沿AI发展速度是否需要被主动踩刹车的争论,远没到达成共识的时候。
最后是个有点意外的问卷。一个名为“Compassion Aligned Machine Learning”的团体正在做一项调查,主题是AI对齐领域里有争议的问题,特别是这些对齐讨论怎么跟非人类动物的考量扯上关系。他们承诺十分钟就能填完,目前正在征集信号放大。这其实挑明了一件事:AI对齐的边界早就超出了纯技术范围,开始跟动物伦理这些看似八竿子打不着的议题交叉——接下来只会越来越热闹。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.