Exa 发布了 Exa Snapshot,一个收录 4000 亿张历史网页快照的索引。它支持像搜索过去一样检索网页——不是搜现在的网页,而是搜网页曾经的样子。
官方给出的使用场景有三个:预测模型回测、实验室强化学习训练,以及探索前 AI 时代的网络。这三个方向指向同一件事——把互联网的历史状态变成可检索的数据层。
![]()
为什么历史网页值得被索引
预测模型回测需要知道某个时间点上世界是什么样,实验室做强化学习需要大量真实环境样本,而研究前 AI 时代的网络,则需要看到还没有被 AI 生成内容覆盖的互联网原貌。这三类需求都要求网页的过去状态可被定位和调用。
Exa Snapshot 把 4000 亿张快照做成索引,等于给这些需求提供了一个统一的检索入口。
发布之外的一个细节
作者 Jason Liu 转发了这次发布,并感叹视频是用 Astra 剪辑的。这条转发本身不改变 Snapshot 的能力边界,但说明发布内容在圈内被注意到了。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.