标签

会自我进化的AI助手:Hermes Agent实战教程,开源界首款成长型智能体

发布时间:2026-09-04 07:46阅读:2

Nous Research 团队开源 · 采用 MIT 许可证 · 闭环学习机制 + 多层记忆架构 · 当前版本 v0.21 Bot 模式

市面上的智能体用完即弃,这款开源产品偏偏要越用越强

AI 助手在同一个地方反复栽跟头,是不少人的切身体会。头一回让它帮忙整理周报,光格式和内容就调了大半天;过了一周同样的需求再来一遍,它丝毫记不起上回的做法,完全推倒重来。

绝大多数智能体缺乏记忆机制,每次会话都是孤立的,成功与失败的经验都来不及积累。

本文要介绍的 Hermes Agent,是 Nous Research 于 2026 年 2 月开源的一款具备自我进化能力的 AI Agent 框架。MIT 协议,GitHub 收获近六万星,项目理念浓缩为一句话:The agent that grows with you,与你并肩成长的智能体。

它要破解的核心痛点

以把项目部署到 Vercel 为例。头一次跑,环境变量搞错、Node 版本不对、生产参数漏配,足足折腾了二十分钟才搞定。这个场景的代表性在于:配置项繁琐、步骤间有依赖关系、不同环境的差异容易被忽视。

一周后重新部署一个新项目,输入「帮我部署到 Vercel」,普通 Agent 会重新踩一遍相同的坑,因为上次的经验早就消失殆尽。

而 Hermes 会在第一次部署顺利完成后,自动把整个流程沉淀为一份技能档案:触发场景、操作步骤、常见雷区、验证手段。第二次部署时优先加载这份技能,一气呵成。万一 Vercel CLI 升级改变了命令格式,它还会顺手更新技能里过时的命令。

底层逻辑:学习闭环

Hermes 最精髓的设计叫做闭环学习(Closed Learning Loop)。每轮任务结束后,系统会自动评估本次执行过程里是否藏有值得提炼的经验,若有,便生成一份可复用的技能文档,下次碰到同类任务直接调用。

该学习闭环由五个环节串起:触发(消息可来自终端、Telegram、Discord 或定时任务,统一汇入同步执行引擎)、检索(SQLite 全文检索,毫秒级从历史对话和技能库里定位相关内容)、推理执行(模型进行规划、调用工具并流式返回结果)、评估(内置的复盘信号,用于判断有无沉淀价值)、持久化(新生成的技能、记忆更新、用户模型变动全部落地到本地磁盘)。

第四步是评估环节,系统会给 Agent 一个内部的'反思信号',引导它判断本次会话是否包含值得记录的内容。第五步是持久化,新技能、记忆更新和用户模型的变动统一写入本地磁盘。

独立基准测试显示,装载超过 20 个自创技能的 Agent,在完成同类后续任务时,速度较全新实例快约四成。这种增益仅在同领域内生效,总结 GitHub PR 的经验并不能直接复用到数据库迁移,但同一领域的反复使用,所产生的复利效应是单纯依靠提示词工程难以匹敌的。

四层记忆体系:关键不在'记得住',而在'记得准'

学习闭环得以运转,前提是 Agent 具备记忆能力。Hermes 的记忆体系划分四层,每一层都对应不同的需求。

最底层是会话级记忆,相当于常规的上下文窗口,负责当前会话。第二层是持久记忆,借助本地 SQLite 结合全文检索实现,跨会话留存。检索时延约十毫秒,可承载上万份文档,足以应对个人及小型团队的需求。若未来数据规模突破十万级,官方推荐迁移至专业的向量数据库。

第三层是技能库,即学习闭环的产出。全部技能以 Markdown 文件形式存储,遵循 agentskills.io 开放规范,可读性强、可分享、可在不同 Hermes 实例间迁移。系统提示中默认仅录入技能名称和简要描述,完整内容按需加载。如此一来,技能库从 40 个扩张到 200 个,上下文开销也不会显著攀升。

第四层是 Honcho 用户建模,属于可选模块。它依托多轮对话持续勾勒深度用户画像:技术栈偏好、沟通风格、惯用工具、行业知识。这并非一成不变的用户档案,而是随着交互频次增加而不断细化的模型。

技能体系:Agent 的'经验沉淀库'

如果说记忆是土壤,技能便是 Hermes 孕育的果实。一项技能本质上是一份条理化的操作指南:触发时机、执行步骤、所需工具、常见陷阱。

Hermes 的技能分两类。内置技能随框架一同发布,开箱即用。用户技能由 Agent 在攻克复杂任务后自动生成,也支持手动引导创建。技能文件存放于用户目录,支持版本控制与社区共享。

更关键的是,技能并非一成不变。每次调用技能时,Agent 会留意执行结果,一旦发现步骤过时、命令有误、遗漏陷阱,便会立即打补丁更新该技能。系统提示中白纸黑字写着:发现技能存在瑕疵,应在当前任务结束前修缮完毕,过时的技能比缺位的技能危害更大。

这套机制背后构筑了完善的工程化保障。技能创建需历经七重安全校验:名称校验、分类校验、内容尺寸限制、冲突排查、原子写入、安全扫描。新技能注册后先在隔离沙箱中完成回归测试、边界测试与冲突测试,全部通过后方可投入生产环境。

最新版本 v0.21:从'独行侠'迈向'AI 协作团队'

近期,Hermes 推出了 v0.21.0 版本,代号 Pantheon Release,即'万神殿'。该版本最显著的变化是允许多个 Agent 以 Bot 形态组建一支可视化的协作团队。

以往的多 Agent 多为后台静默调度,用户感知有限。如今 Bot 模式被内置到桌面端,每个 Bot 拥有专属的名称、头像、身份描述、记忆与技能。可以创建调研 Bot、写作 Bot、审校 Bot,开设群聊房间,直接 @ 对应的 Bot 派发任务,它们会在群组中接力协作。

hermes peer 功能使 Bot 之间能够直接私信交接任务,无需人工中转。调研 Bot 完成报告后,自动转交开发 Bot 继续处理,开发 Bot 完工后推送至测试 Bot,整条流水线全自动运转。

定时任务 Cron 迎来重大升级。早前的 Cron 每轮执行后即遗忘,不清楚上轮做了什么。如今 Cron Agent 自带持久记忆,continuity 参数将上一轮输出传递至下一轮,仅汇报新增与变动内容。Monitor 模式下,被监控对象无变化时直接跳过,不调用大模型,节省 Token。

快速上手:三步启动

Hermes 兼容 Linux、macOS、Windows 和 Android。绝大多数开发者建议选用 Linux 或 macOS 环境,安装最省心。Windows 用户亦可直接运行,原生 PowerShell 一键脚本即可,无需 WSL2。

打开终端,执行一条命令:curl 脚本地址 | bash,安装程序将自动搞定 Python、Node.js、ripgrep、ffmpeg 等全部依赖,安装完毕后重新载入 shell 配置,输入 hermes 即可进入交互界面。

首次启动运行 hermes setup,按向导选择模型提供商并配置 API 密钥。若想省去繁琐步骤,可直接使用 hermes setup --portal,借助 Nous Portal 一键授权,覆盖三百多个模型、搜索、图像生成、语音合成等能力,但该项为付费订阅服务。

模型支持热切换,输入 /model 即可在 OpenRouter、OpenAI、Anthropic、DeepSeek 等不同提供商间切换,无需修改代码。工具集按需启用,hermes tools 命令可管理四十多种内置工具。

与 Claude Code、OpenClaw 的定位差异

这三款产品常被相提并论,但定位截然不同。Claude Code 是终端中的编程结对伙伴,优势在于代码质量与工程规范,适合深度编码场景。OpenClaw 是多渠道消息网关,核心能力是把 Agent 接入 Telegram、Discord、Slack 等十余个平台,适合跨平台代为跑腿的场景。

Hermes Agent 的差异化定位在于长期驻留加自我进化。部署到一台机器上后,它持续运行,越用越贴合用户。内置的 cron 调度器支持用自然语言描述定时任务,消息网关让远程交互像聊天般自然,技能体系让它从每次执行中沉淀经验。

若需求是一次性问答或短平快的小脚本,任意聊天机器人都能胜任。若需要长期在线、从每次执行中学习、将重复流程固化为可复用能力的数字同事,Hermes 是开源生态中较早走通这条路线的项目之一。

使用须知:并非毫无代价

Windows 用户安装时需留意,杀毒软件可能将 Hermes 捆绑的 uv 包管理器误判为恶意程序。解决办法是将 Hermes 目录加入杀毒软件白名单,而非关闭杀毒软件。

Bot 模式群聊功能直观易用,但六个 Bot 同时运行高推理模型,单轮长对话的 Token 消耗远高于单人对话。建议为不同类型的 Bot 配置不同性价比的模型,避免全部选用最贵的。

版本迭代节奏快,v0.16 到 v0.21 跨度极大,Bot 模式从独立插件升级为内置默认。升级前务必备份 ~/.hermes 目录,尤其是 skills 和 memory 子目录,随后执行 hermes doctor 检查关键路径兼容性。

相关链接

GitHub 仓库

https://github.com/NousResearch/hermes-agent

官方文档

https://hermes-agent.nousresearch.com/docs/

技能中心

https://agentskills.io

社区 Discord

https://discord.gg/NousResearch

#HermesAgent·#自进化AI#Agent框架#MIT开源#NousResearch#技能闭环#持久记忆#本地部署#AI超视距