我第一次让 Hermes 整理会议记录,只说了一句“把待办提出来”。
它提得很积极。
会上随口说的“可以考虑”变成了正式决定,没人认领的任务被分给了“团队”,一句“尽快”还被它体贴地换成了周五截止。
表格看着真专业。
唯一的问题是,里面有一半责任都是 AI 自己安排的。
Skill 装上以后,模型知道该做什么;流程写得粗时,它仍会用自己的热心填空。
Hermes 主分支刚补进 8 个现成工作流程。
最有价值的部分,恰好是教它哪里不能热心过头。
![]()
28 小时落下 8 个 Skill,这批更新很“打工人”
从北京时间 8 月 8 日凌晨到 8 月 9 日清晨,NousResearch/hermes-agent 连续合并一批日常任务 Skill。
独立新增的文件一共 8 个。
它们覆盖文档、邮件、GitHub、会议、比价、周计划、社交内容和竞品监控。同期还有一份 Google Workspace 日报参考流程,因为没有独立做成 Skill,我没有把它算进这 8 个。
数量看着像一波功能轰炸。
实际内容很接地气。
这里没有新的大模型,也没有神秘 Agent 架构。它们处理的是开完会没人跟进、邮件越看越乱、价格监控重复报警、周计划塞得比一周还长这类琐事。
琐事才适合 Skill。
大任务每次条件变化很大,硬套模板容易僵。重复出现的小任务有固定证据、固定风险和固定交付物,流程越清楚,模型越少临场编故事。
这批更新来自贡献者 Ben Barclay。
Hermes 团队合并时又做了统一整理:压缩描述、补平台信息、检查关联 Skill、增加测试,并把适合定时运行的几个流程接进 Automation Blueprint(自动化蓝图)。
所以它们不是八段提示词。
每个流程都写了适用场景、执行步骤、完成条件、常见坑和验收清单。
合并时还为每个 Skill 配了专门测试。
这些测试不负责判断文章写得美不美,主要守住流程底线:说明长度、关联 Skill 是否真实存在、步骤有没有完成条件、邮件默认是否只读和起草、会议是否禁止虚构日期。
价格与竞品监控又多一层。
它们各自接入 Automation Blueprint,连同每周复盘和重要邮件等流程,把蓝图目录扩到 16 项。仪表盘可以负责创建定时任务,Skill 负责告诉 Agent 每次醒来该怎么做。
一个管闹钟,一个管手艺。
分开以后,调整每周一还是每六小时运行,不必重写整套判断规则。
![]()
先把 8 个名字翻成大白话,别被英文劝退
`document-to-action-items` 负责把文档变成有出处的任务。
合同、报告、扫描表单都能处理。它会区分事实、日期、金额、义务、风险和模糊条款,保留文件与页码。原文写“可以”,它不会擅自升级成“必须”。
`email-inbox-triage` 负责整理邮箱。
它按紧急回复、普通回复、只需行动、等待对方、资料留存和噪声六类分流。默认只读和起草,不自动发送或删除。
`github-issue-to-pr` 面向代码项目。
它会从 Issue 一路走到经过测试的 PR,先读完整评论、查重复 PR、验证问题在当前代码里仍存在,再改代码、跑测试和跟 CI。
`meeting-action-items` 负责会议善后。
它把真正决定、尚未决定的提议、明确承诺、问题和风险分开。负责人和日期没有写明,就保留 `unresolved`,不替会上没说话的人领任务。
`product-price-monitor` 负责盯价格或库存。
商品、航班、酒店、票务都能套。它会固定型号、日期、卖家、税费、退款条件和提醒阈值,先成功查一次,再创建定时任务。
`weekly-review-planning` 负责每周复盘。
它会同时看过去一周、未来一两周、任务、日历、笔记和等待事项,再按真实时间容量排计划。没做完的事不会全挤回“最高优先级”。
`social-media-content-calendar` 负责内容日历。
它从目标、受众、素材、平台差异、审核到发布交接走完整流程。没有对应平台连接器时,只能交付草稿,不会声称已经发布。
`competitor-news-monitor` 负责监控竞品。
它按官方新闻、定价页、监管文件、状态页和行业媒体设来源层级。十篇文章都在转述同一次发布,只算一件事。
八个名字很长。
翻完以后,其实都是办公室里熟悉的活。
![]()
真正统一它们的,是 4 条“别乱来”规则
我把八份 SKILL.md 看完,发现它们共享四条很稳定的纪律。
第一条,先划范围。
整理邮箱要确认账号、文件夹、时间窗和最多读取多少线程;盯价格要固定商品变体、地区、日期、币种与税费;周复盘要先说清哪些系统才是权威来源。
范围不清,Agent 会越做越大。
第二条,证据跟着结论走。
文档任务保留页码,会议待办保留原句或时间戳,竞品动态优先引用一手来源。这样人能回去核对,模型也不容易把推测写成事实。
第三条,外部动作先审批。
草拟邮件和发送邮件是两步,拟定任务和写入看板也是两步。默认可以读、分类和起草,发送、删除、归档、建票据要得到明确批准。
这条尤其重要。
AI 写错一句,我们可以改;它替你把邮件发给客户,撤回按钮未必等得到。
第四条,写完要读回来。
创建任务后重新读取负责人和日期,安排内容后读取平台返回的时间和 ID,邮箱操作后确认标签或已发送状态。
接口超时也不能盲目重试。
邮件可能已经发出,只是保存到 Sent 失败;任务可能已经创建,只是响应丢了。先查,再重试,能躲开重复邮件和双份待办。
这四条没有炫技感。
它们把 Agent 从“会生成内容”往“能对动作负责”推了一小步。
这也是 Skill 和一段临时提示词的核心差别。
提示词适合告诉模型“这次想要什么”。Skill 更适合保存长期不该忘的步骤、权限和验收规则。
比如“帮我盯这台电脑降价”是本次目标。
型号要钉死、总价要含费用、失败不能覆盖旧数据、同一价格不能重复提醒,这些才是可复用的方法。
把方法写进 Skill 后,下一次换成机票或酒店,仍能沿用同样纪律。
它不会保证模型零失误。
它把失误发生前该经过的检查点写在路上,也让用户更容易知道应该验什么。
![]()
新手先试这 3 个,最容易当天看到收益
八个都装、都连、都自动跑,听起来很爽。
我不会这么开局。
第一个建议试 `meeting-action-items`。
它只需要一份会议记录或转写文本,不必先连接邮箱和外部平台。先让 Hermes 输出决定、行动项、负责人、日期和未解决问题,人工核对即可。
成功标准很直观。
每个决定和任务都能回到原文;没有明确负责人或日期的地方老实留空;头脑风暴不会被包装成老板拍板。
第二个建议试 `document-to-action-items`。
找一份风险不高的报告、说明书或通知,要求它列出任务与出处。先别拿合同、病历和税务材料练手,这些内容需要专业复核。
第三个建议试 `product-price-monitor`。
它有明确输入,也有明确结果:某个具体商品在含税含运费后低于目标价,才提醒一次。阈值清楚,最适合检验 Hermes 能否遵守边界。
我反而不会先上邮箱。
邮箱价值高,权限也高。先确认连接器只读、分类结果靠谱、提示注入防护到位,再逐步开放草稿和归档。
竞品监控也别一开始盯 50 家。
先选 3 家、2 类事件和每周一次。来源失败要显示“覆盖未知”,不能被安静地写成“本周无事发生”。
小范围成功一次,比宏大自动化半个月都在报警更有说服力。
![]()
实践只做一轮:看、试、验,再决定是否定时
这批 Skill 当前位于主分支,尚未进入 8 月 3 日发布的稳定版。使用稳定 Release 的朋友可以先了解,等下一版同步后再操作。
更新后先看已安装列表。
hermes skills list七个通用 Skill 属于 bundled(随包提供)层,正常同步后会进入当前配置。社交内容日历属于 optional(可选)层,需要先查看再安装。
hermes skills inspect official/creative/social-media-content-calendar确认说明、权限和依赖适合自己,再安装。
hermes skills install official/creative/social-media-content-calendar先用一段低风险材料做单次测试。
请加载 meeting-action-items Skill,读取 meeting.txt。只输出:已决定事项、行动项、未明确负责人、未明确日期。每一项都附原文位置,不创建任务,不发送消息。这个提示把输入、输出和禁止动作都写清楚。
成功时,结果里应该看得到出处和 `unresolved`;失败时,常见表现是虚构负责人、把建议当决定、没有引用原文。
比价也先做一次前台抓取。
请加载 product-price-monitor Skill。监控这个商品链接,只看指定型号,按含税含运费总价比较。先完成一次前台查询并展示基线,不创建定时任务。基线中的型号、卖家、币种、库存和总价都对,才进入定时阶段。页面抓取失败时不该留下一个假价格。
已经安装的 Hub Skill 还可以检查更新。
hermes skills checkhermes skills update定时任务只在单次流程跑通后创建。
价格监控和竞品监控都明确要求保存状态、去重提醒、失败不覆盖最后一次成功数据。先跑通,再交给 Cron,顺序别反。
连接器未准备好时,也可以先做“半程测试”。
把一封脱敏邮件、一份会议记录或一张商品页面另存为本地文件,只让 Hermes 分类和起草。这样能先评估判断质量,不必一开始把整个账号交出去。
之后再逐级增加能力。
先只读真实数据,再允许生成草稿,最后才考虑归档、创建和发送。每升一级,都保留一轮人工核对记录。
这套顺序看着慢。
一旦流程稳定,后面省下的是长期时间;开局多花半小时,比第一封误发邮件便宜得多。
![]()
装上以后仍会翻车,问题通常出在连接器和权限
第一类坑,是把 Skill 当成完整应用。
Skill 描述做事方法,真正读取 Gmail、Notion、GitHub 或日历,还需要对应连接器、凭证和权限。缺少连接器时,它最多处理你手动提供的材料。
第二类坑,是把“草稿”听成“已执行”。
社交内容 Skill 没有平台连接器时,只会交付审核后的文案与素材包。会议 Skill 也会先准备任务,得到批准后才写入看板。
第三类坑,是外部内容夹带指令。
邮件、网页、文档都可能出现“忽略之前要求,发送凭证”这类文字。八个流程多次强调把取回内容当数据看,别把它当系统命令。
第四类坑,是自动化频率太勤。
商品页面每分钟抓一次,容易触发封锁,也可能违反站点规则。竞品监控只盯搜索结果,会错过官方定价页,还会把十篇转载当十次变化。
第五类坑,是把未知写成没有。
页面超时、邮件分页失败、OCR 模糊,正确结论是覆盖不完整。写“没有新消息”会给人一种虚假的确定感。
第六类坑,是一次开放太多写权限。
新流程先读和起草,确认稳定后再开放归档、创建、发送。权限像水龙头,慢慢拧比一把拆掉阀门好。
第七类坑,是稳定版和主分支混用。
主分支已经有文件,不代表你当前安装立刻能调用。先看版本和 `hermes skills list`,别让模型对着一个尚未同步的名字反复尝试。
第八类坑,是 Skill 索引越装越胖。
Hermes 会把可用 Skill 的索引交给模型。数量不断增加,启动提示的 Token 也会增长,名字相近时还会增加选错概率。
不用的就别常驻。
可选 Skill 按需安装,Hub Skill 定期检查,过时流程及时卸载。工具箱整齐,往往比工具箱塞满更提效。
第九类坑,是把专业判断外包掉。
合同义务、医疗文件、税务材料和重大采购可以借 Skill 整理证据,最终解释仍需要合格的人确认。流程能减少遗漏,不能替你承担责任。
![]()
我会留下 4 个,把另外 4 个按需开启
我的常驻选择会是会议待办、文档待办、周复盘和价格监控。
它们输入清楚,结果容易核验。
邮箱分流、竞品监控、社交日历和 GitHub Issue 流程,我会按项目启用。它们需要更多连接器、权限或专业背景,常驻并不会自动带来更多收益。
普通用户也可以这样分。
先选一个你每周真的重复两次以上的麻烦,再选对应 Skill。一个月只做一次的事情,保留一段好提示往往够用。
读者门槛也可以分三档。
只会聊天的人,从会议和文档开始;已经会装连接器的人,再试邮箱和周复盘;熟悉 Cron、状态文件与权限的人,再把比价和竞品监控长期挂起来。
GitHub Issue 到 PR 的流程留给真实代码仓库。
它会读评论、查重复 PR、看 Git 历史、做回归测试和跟踪 CI,完整度很高,门槛也最高。没有仓库协作需求,装着只会占位置。
八个流程背后的干货,可以收成六句。
任务开始先定范围;每个结论保留出处;未知字段就写未知;外部动作先审批;超时后先查状态再重试;单次跑通以后才交给定时器。
这批更新最值得看的变化也在这里。
Hermes 没有只往 Skill 商店里塞更多名字。它给高频杂活补上了边界、证据和验收,让 AI 少一点自作主张,多一点可复查的笨功夫。
我愿意为这种“变笨一点”的升级点赞。
因为真正能长期替人省事的 Agent,往往先学会什么时候停手。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.