返回博客2026年9月4日1 分钟阅读

24 万星的 Hermes Agent,把自动任务学到的东西沉淀成了 Skill

摘要

Hermes Agent 再次出现在 GitHub Trending:新版本不只加了 Bot Mode 和 MCP 管理界面,更把 cron 的连续性、记忆与人工批准放进同一条长期运行的 Agent 工作流。

北京时间 9 月 4 日清晨,NousResearch/hermes-agent 在 GitHub Trending Today 显示新增 778 stars。我在北京时间 05:02 复查时,GitHub API 给出的累计数是 240,768★。这两个数说的不是同一件事:778 是 Trending 卡片里的当天增长,240,768 是仓库累计值,不能把前者写成总星数,也不能用总星数假装今天新增。GitHub Trending 与 仓库 API 可以分别核对。

这次热度的入口是 8 月 31 日发布的 v2026.8.31,也就是 v0.21.0。它当然塞进了很多容易被转发的功能:桌面端的 Bot Mode、Agent 间私信、能在运行中纠偏的子 Agent、MCP 管理页和可被 Agent 操作的内置浏览器。但我觉得真正值得细看的是一个很朴素的变化:每天早上跑一次的自动任务,能不能记得昨天做过什么,并把可复用的经验留下来?我会利用 Hermes 的这次版本,把这条链路拆开。期望对大家有所帮助。

自动任务终于不必从零开始

很多 Agent 自动化都卡在一个尴尬处境。它们可以定时发日报、巡检仓库、抓一批链接,却常常把每次运行当成一次全新的对话。昨天已经报过的内容会再报一遍;一次排障得到的操作顺序,也只留在一段很快被压缩的聊天记录里。

Hermes 的 README 原先就把自己描述为带“学习循环”的 Agent:它能保存记忆、检索过去会话,并从复杂任务中创建 Skill 或在使用中改进 Skill。这里最关键的区分是,记忆和 Skill 并不是同一种东西:前者更接近跨会话仍然成立的事实或偏好,后者则是把某一类任务的步骤、边界和检查方式写成可再次调用的程序性说明。

v0.21.0 把这个区分推进到 cron。官方 release note 说明,定时任务现在能读写持久记忆;打开 continuity=true 后,一次运行的输出可以进入下一次;每个任务还有自己的持久记事本。对于监控型任务,内容没有变化时还可以跳过 LLM 调用。

第一次运行:发现异常 → 记录已通知的对象与处理步骤
下一次运行:读取上次状态 → 只比较新变化 → 决定是否继续通知
反复出现的任务:把稳定步骤提炼为 Skill → 下次按 Skill 执行

这不是让模型“更有记性”的口号,而是把去重、延续和经验沉淀放到定时任务的输入输出里。它尤其适合日报、价格或发布监控、例行备份检查、不断追加材料的研究任务。真正的收益不是少写一段提示词,而是让每次执行能接上前一次留下的判断。

Skill 应该比聊天记录更具体

Hermes 在 README 中列出的 Skill 系统,兼容 Agent Skills 开放标准,并把它定位为“procedural memory”。这条说法需要谨慎理解:Skill 不是自动获得正确答案,也不是把一个错误操作永久固化。它只是给 Agent 一份可以检查、修改、重复使用的任务说明。

比如一次仓库巡检,聊天记录里可能混着临时路径、这次的报错和用户偏好;如果其中只有“先确认工作区是否干净,再运行构建,最后把失败按新旧分开报告”是可复用的,就应把这段流程变成 Skill,而不是把整段聊天塞进长期记忆。Hermes 在 9 月 3 日的提交也在修正这层分流:任务中学到的知识优先写进对应 Skill,只有跨所有会话都适用的内容才进入 memory。

这种边界比“Agent 会自我改进”更重要。可复用流程应当能被人读懂,也应当能在下一次失败时被改掉。否则,所谓学习只是把上次碰巧成功的路径变成难以追踪的隐性状态。

这个版本为什么把 Agent 放进了同一张桌子

v2026.8.31 并非一个轻量补丁。发布说明记录了自 v0.20.0 以来约 5,800 次 commits、2,475 个合并 PR 和 760 多位贡献者。这些是版本汇总窗口里的累计数据,不是本周或当天的开发量;它们至少解释了为何一个已有基础的项目仍会在近期获得新一轮注意力。

这次更新中,Bot Mode 让多个有名字的 Agent 可以出现在同一组聊天中,hermes peer 让不同 Agent 之间的消息留在可检查的对话里;delegate_task 则允许用户查看、纠偏或停止仍在运行的子任务。它们共同指向一个变化:当 Agent 不止帮你完成一次请求,而是分工、定时运行并接力工作时,协调记录本身也应是产品的一部分。

同样的取向也出现在 MCP 上。新版本把服务器目录、导入、健康检查、重新认证提示和用量信息集中到桌面端的一个入口。工具越多,越不应把“配置成功”当成“长期可靠”。知道某个 MCP 是否还可用、会带来多少 schema token,以及谁允许它访问什么,比继续叠加连接器更接近真实使用。

别把持久化误会成无条件信任

一套会记忆、会写 Skill、会跑 cron 的 Agent,最需要确认的不是“它会不会很聪明”,而是它能够在哪些地方改动持久状态。Hermes 的这次 release 同时加强了这层限制:对 AGENTS.md、Skill 和 memory 存储的写入需要明确批准,并加入了终端错误、.env 读取和日志等路径的脱敏修复。安全更新说明 值得在安装前完整读一遍。

这并不等于所有风险都消失。README 也列出它可接入 Telegram、Discord、Slack、WhatsApp、Signal、CLI,以及本地、Docker、SSH、Modal、Daytona 等多种后端。接入面越广,越要逐项确认模型提供商、外部工具权限、消息平台账号、密钥储存和远程执行范围。不要把“支持”理解成默认安全,也不要把一次成功的定时任务直接升级成无人值守的高权限流程。

对于已经有重复性工作的人,最小的尝试是挑一个只读任务:让它每天汇总某个公开源,并打开连续性,观察它是否真的能去重、保留决策理由和稳定输出。确认这一层之后,再决定是否把经验提炼成 Skill,或把权限扩大到写文件、发消息和调用外部系统。

热榜给的是一次曝光,不是对长期可靠性的认证。Hermes Agent 值得关注的地方,在于它把“记住”和“照着经验继续做”分别落到了 memory、Skill 与 cron 的不同位置。把这些位置的权限、审查和可撤销性做好,自动化才有机会从一次演示变成长期工具。


相关文章

最近一封 · Sample

OpenRig 冲上 Trending:把 Claude Code 和 Codex 编成一支队伍

“OpenRig 在 GitHub Trending Today 获得 622 个 stars 的窗口信号。它用可恢复的队列、席位与权限记录,把 Claude Code 和 Codex 放进同一套多 Agent 工程流程。”

—— william

Letters

来信

里面装的是

  • 新文章 — 写完一篇就寄一封,不攒货
  • 这周读到的、看到的、好用的工具
  • 正在折腾的实验,附带翻车记录

约莫 1–2 周一封 · 随时退订

合作伙伴

CompeteMap — 英国及爱尔兰学生竞赛一站式搜索

数学、编程、科学、写作等各类竞赛信息汇总,支持按年龄和科目筛选,再也不错过报名截止日。

准备开始了吗?

先简单说明目标,我会给出最合适的沟通方式。