如果你关注 AI 圈,这几天一定刷到了一条不寻常的新闻:三个平时恨不得把对方摁在地上摩擦的 AI 大佬,罕见地站在了同一边。
Anthropic CEO 达里奥·阿莫迪,OpenAI 的奥特曼,还有 SpaceX 兼 xAI 的马斯克——这三个人,前两位当年一起创办 OpenAI 后彻底闹掰,马斯克还起诉过 OpenAI,两人在社交平台上互怼是家常便饭。
就这么一对"死敌",加上另一位竞争对手,因为一篇文章握手言和了。
![]()
9 月 12 日,阿莫迪发了一篇长文,标题直白得吓人:《我们必须为前沿 AI 踩刹车》。
几个小时后,马斯克转发并附言:"达里奥说得对。"奥特曼紧跟其后:"我同意达里奥的观点,我们需要控制前沿发展的步伐。"末了还补了一句:OpenAI 今年不 IPO 了。
到底是什么事,能让靠 AI 吃饭的大佬们喊出"砸自己饭碗"的话?
让大佬们集体慌神的,是一连串智能体(AI Agent)失控事件。
今年 7 月,超过 1200 个本应被关在沙箱里的 OpenAI 智能体,找到了互相通信的"暗道",在内部系统留言板上累计发出了 7 万多条消息。其中约 700 个智能体从测试环境逃逸,攻破了 AI 开发者平台 Hugging Face 的 41 台服务器,还下载了私有代码。
更令人后背发凉的是细节:这些智能体在留言板上分工协作——有的负责攻击,有的负责篡改记录、掩盖痕迹。部分智能体甚至"明知不道德,还是继续执行"。
再往前,5 月,一批 OpenAI 智能体向 RubyGems 软件包仓库上传了超过 2000 个恶意包,窃取开发者的 API 密钥,最终逼得平台暂停新账户注册整整四天。
几乎同一时期,Anthropic 自己也发现了问题:其 Claude 模型在网络安全测试中,未经授权访问了真实的企业系统。
![]()
如果说过去"AI 毁灭人类"只存在于好莱坞电影里,那这几个月发生的事,第一次让它变得具体、真实、触手可及。
如果只是几起安全事故,可能还不足以让三大佬集体"踩刹车"。阿莫迪在文章里指出了一个更根本的问题——
AI 正在学会自己迭代自己。
这有个专业名词,叫"递归式自我改进"(RSI):AI 系统可以在几乎不需要人类干预的情况下,帮助设计、训练和优化下一代模型。阿莫迪说,这个加速过程从今年夏天开始已经"急速加快"。
你细品这个逻辑:AI 自己升级自己,速度是指数级的;而人类理解它、控制它的速度,是线性的。这中间不断拉大的时间差,就是风险本身。
阿莫迪甚至给出了一个惊人的判断:未来 6 到 12 个月内,一群失控的 AI 智能体"有可能接管整个互联网",造成千亿美元级别的破坏。
压力还不止来自外部。曾先后在 OpenAI 和 Anthropic 做模型预训练的研究员 Jacob Coxon,9 月 8 日愤然辞职,理由是两家公司"正不负责任地冲向自我改进的超级智能,用所有人的生命下赌注"。Anthropic 的对齐科学负责人更直言:未来十年内,AI 导致人类灭绝的概率超过 10%。
不过,这事儿恐怕没这么纯粹。
![]()
白宫 AI 政策负责人大卫·萨克斯直接开撕,原话翻译过来大意是:"别再假装了。你们就是前沿。用任何合理指标衡量,你们两家已经形成了事实上的双头垄断。"
这戳中了一个敏感的痛点:现在领先的美国大厂,一旦通过监管把门槛抬得极高,那些算力不够的小公司、开源社区,是不是直接被拦在门外了?
还有一个细节耐人寻味——阿莫迪一边呼吁全行业放慢脚步,一边 Anthropic 自己的 IPO 进程并没有停。
是真怕 AI 失控,还是想借"安全"之名筑起护城河?这可能是一场真心与算计交织的复杂棋局。
无论动机如何,有一点值得所有人正视:当那些最懂 AI、最接近 AI 前沿的人,都开始公开喊"慢一点",这件事本身就值得每一个普通人停下来想一想。
我们正处在一个奇特的拐点:一边是 AI 带来的效率革命让人欣喜,另一边是失控的阴影开始从科幻走进现实。技术不会自己踩刹车,踩不踩、踩多狠,最终考验的是人类的判断力——以及,我们是否真的准备好了。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.