我让一个AI智能体去抓取Hacker News上排名前10的文章,解释清楚它是怎么收集的,然后把成品放进我的DEV编辑器里。指令很清楚:保存为草稿,不要发布。
抓取新闻本身并不难。真正的难点在于,你得给它足够的权限,让它在我的登录账户里完成这最后一步,但又绝不能给它点击“发布”的权限。
这件事里其实藏着两种完全不同性质的活儿,它们需要的权限等级天差地别。一个是去读Hacker News的公开数据,另一个是在我已登录的DEV账户里创建草稿——这是要改变私人账户状态的。
如果把一整个功能齐全的浏览器直接交给AI去做第一件读数据的活儿,那等于平白无故给了它多余的武器和通行证,而任务本身根本用不着。公开信息的抓取路径里,既没有登录验证的上下文,也不具备执行第二步操作所需的权限。问题的关键不是“哪个浏览器工具能把所有活儿都包了”,而是“这个任务到底是在哪一步真正需要动用浏览器的”。
说到公开数据那一步,其实只要一个抓取工具就够了。我最开始是在一个轻量级的页面会话中打开Hacker News,然后去查询它的文章链接。这么做确实能跑通,但并不意味着它就是必要的。Hacker News本身就有公开的API,用最普通的HTTP请求就能拿到一模一样的结果。在2026年7月19日凌晨,我分别用页面查询和API抓取跑了一遍,前10条新闻的排名、标题和网址,两边结果完全吻合。
看来我为这第一步调动的能力,超出了产出结果的实际需求。对于这个公开数据环节,一个简单的抓取就足以胜任。
事情的转折发生在结果要被存进DEV编辑器的那一刻。公开数据的抓取路径能拿到数据,但它根本就没带着那个已登录的编辑环境,也没有创建草稿这种持久状态的权限。
这里就需要用到Unchained了。它是一个有引导的浏览器工作区,专门用来处理那些“最终结果必须发生在一个真实网站里面,而不是单纯返回一段文本”的任务。它的引导路径会启动一个专用的、持续存在的Chrome工作区,不会去碰你本来就已经打开的那些Chrome个人资料或标签页。
Unchained负责驾驶操控,而你来负责导航定向。你定义好最终要达成的结果、划清行动边界、设定好审核点。然后Unchained就在这个合同框架内,去执行具体的浏览器操作步骤。
为了这次任务,我设定的合同非常明确。结果就是:要把写好的文章放进已登录的DEV编辑器里。行动边界是:只能选择“保存草稿”,永远不能碰“发布”。而审核点就是:返回一个已经保存好的草稿状态。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.