惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
Schneier on Security
GbyAI
GbyAI
H
Help Net Security
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
T
The Blog of Author Tim Ferriss
Vercel News
Vercel News
Microsoft Azure Blog
Microsoft Azure Blog
Google DeepMind News
Google DeepMind News
Stack Overflow Blog
Stack Overflow Blog
AWS News Blog
AWS News Blog
Spread Privacy
Spread Privacy
Apple Machine Learning Research
Apple Machine Learning Research
L
LINUX DO - 最新话题
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
P
Privacy International News Feed
C
CERT Recently Published Vulnerability Notes
C
Cybersecurity and Infrastructure Security Agency CISA
I
Intezer
Hugging Face - Blog
Hugging Face - Blog
H
Heimdal Security Blog
N
News and Events Feed by Topic
C
Cyber Attacks, Cyber Crime and Cyber Security
T
Troy Hunt's Blog
大猫的无限游戏
大猫的无限游戏
SecWiki News
SecWiki News
Martin Fowler
Martin Fowler
人人都是产品经理
人人都是产品经理
Recent Commits to openclaw:main
Recent Commits to openclaw:main
Application and Cybersecurity Blog
Application and Cybersecurity Blog
F
Fortinet All Blogs
Hacker News: Ask HN
Hacker News: Ask HN
Know Your Adversary
Know Your Adversary
Hacker News - Newest:
Hacker News - Newest: "LLM"
博客园 - 聂微东
S
Secure Thoughts
云风的 BLOG
云风的 BLOG
O
OpenAI News
The Cloudflare Blog
Jina AI
Jina AI
U
Unit 42
L
Lohrmann on Cybersecurity
Attack and Defense Labs
Attack and Defense Labs
The Register - Security
The Register - Security
G
Google Developers Blog
量子位
Simon Willison's Weblog
Simon Willison's Weblog
V
Visual Studio Blog
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
G
GRAHAM CLULEY
TaoSecurity Blog
TaoSecurity Blog

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解 【002】HTTPS 粗解:证书、TLS 握手与对后端配置的影响 Hermes Agent 一周暴涨五万 Star,但我劝你别急着追 明明连接的是Redis的DB0,为什么能查到DB3的数据? 【从0到1构建一个ClaudeAgent】协作-Agent团队 熟悉电子元器件之后,电子小白下一步该怎么走? MAF快速入门(23)通过C#类定义Skills .NET 高级开发 | 手写一个对象映射框架 FastAPI数据库ORM怎么选?我肝了三个Demo后,终于不再纠结了 mysqldump 参数拾遗:在遗忘与铭记之间 C# .NET 周刊|2026年3月5期 Claude code入门 - 陈彦斌 一文学习入门 ThingsBoard 开源物联网平台 GitHub 热门项目 | 2026年04月16日 如何为GIT设置全局勾子,为每次提交追加信息 Number.isFinite和isFinite与isNaN()和Number.isNaN的区别 PortSwigger SQL注入LAB2 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 筑基期:掌握Odoo基础核心知识点02(Odoo XML 开发方式详解) GLM模型这么火,咱们用vllm也咧一个呗! 深入理解 AbortController:从底层原理到跨语言设计哲学 字符串学习笔记 多租户系统框架的基础模块设计和分析设计 Apache SeaTunnel Zeta 为什么能做到“又快又稳”? AI开发-python-LangGraph框架(3-26-LangGraph基本概念及第一个简单样例) Vue 3 组件通信,别只会用 Props 和 Emits 了,这几个狠活儿你得看看 ElasticSearch7.X版本配置密码 用Manim实现动态交点计算--从一个动点问题说起 团结引擎+Addressable+Instant Game打包抖音小游戏 function call 实战:让 LLM 自动判断 pod 异常、调用日志工具并完成故障分析 bubseek —— 让 Agent 的足迹,变成团队的洞察 通过 C# 读取并导出 PDF 书签 如何用 GitHub Actions 实现 Steam 自动化发布 【从0到1构建一个ClaudeAgent】并发-后台任务 .NET 高级开发 | 定制 ASP.NET Core 框架 电子小白:什么是运算放大器(运放) zero2Agent:面向大厂面试的 Agent 工程教程,从概念到生产的完整学习路线 堆上的ORW HC32F460 USB CDC通信异常:非对齐访问异常排查 20260413-Hyperbridge 攻击事件:发生在默克尔山上的验证绕过 那些喊着AI 要淘汰你的人,正在靠你的焦虑赚大钱! 深度学习进阶(八)Swin Transformer 最小二乘问题详解19:带先验约束的增量式SFM优化与实现 SnapTranslate 3.0 正式发布:全局划词翻译 + 完整英语学习闭环,一站式搞定查词、记词、复习 工作的意义、工作的困难认知再思考 .NET + AI 进阶实战:基于类的技能开发 - 打造可治理的 Agent 能力模块 【从0到1构建一个ClaudeAgent】规划与协调-技能 上周热点回顾(4.6-4.12) 电子小白的工具三件套:面包板、杜邦线、万能板 单表五亿数据的查询优化 | Mysql、StarRocks 2. WorkBuddy:从“我是谁”到“帮我干活” C# 如何减少代码运行时间:7 个实战技巧 基于HelixToolkit.SharpDX 渲染3D模型 - 笺上知微 从零开始的双臂具身VLA起源及现阶段发展综述 - SkyXZ 记对 xonsh shell 的使用, 脚本编写, 迁移及调优 - pluvium27 受够了Vibe Coding的失控?换个起点,让AI事半功倍 从开始配置漏洞环境到漏洞复现流程 - 難しい 关于10年工作经验的程序员对OpenClaw的实战经验分享以及看法 - 虚无境 Any metadata 的内存布局 C# .NET 周刊|2026年3月2期 - InCerry 我帮你测过了,测试圈排名第二的 Skill 依然很牛逼 Skill Discovery | 无监督技能发现的经典工作总结 - MoonOut 上下文工程是什么?过时了么?一文讲明白! - 一枫说码 开了 TUN 模式还是直连?90% 的人都踩过这个坑 AScript扩展多种脚本语言 - rockey627 AI 学习笔记:Agent 的记忆机制 你能被装进一个文件里吗?——7 万人把同事"蒸馏"成了 AI - 我没有三颗心脏 Claude Code 通关手册(七):给 AI 装上技能包——Skills 完全指南 - 暮色之狐 在浏览器中快速编辑代码:VSCode Web 集成实践 - Newbe36524 蒸馏自己 skill?基于 Deepseek 的蒸馏器,丐版蒸馏方式,简单便捷 - To_Carpe_Diem Spring AI Aliababa和AgentScope,哪个更好? - 苏三说技术
AI 学习笔记:关于 Hermes Agent 的补充
凌杰 · 2026-05-13 · via 博客园_首页

[!NOTE] 笔记说明

本文是 Agent 系列笔记的后续补充,主要用于补充介绍 Hermes Agent 的使用方法以及相关的个人体验。同样的,这些内容也将成为我 AI 系列笔记的一部分,被存储在本人 Github 上的计算机学习笔记库中,并予以长期维护。

Hermes Agent 于 2026 年 2 月由一家名为 Nous Research 公司发布在 Github 上,首月即斩获 2.2 万个 stars,截至 2026 年 4 月中旬,其周均新增 stars 数达 9500 个,增速达同期主流智能代理产品的三倍以上,连续两周登顶 GitHub 全球趋势榜首位。Hermes Agent 的核心竞争力源于其独特的技术架构设计,构建了”记忆-技能-训练数据”的三层闭环体系,这让它具备了如下主要特性:

分层设计的记忆系统

Hermes Agent 打破了传统的全量存储模式,它借鉴 CPU 缓存的设计思想打造出了一个分层记忆系统,这一解决方案在一定程度上缓解了由 OpenClaw 在跨会话记忆方面的缺陷所带来的一系列问题,为 Agent 应用的持久记忆机制提供了一种更稳定的工程实现。具体来说,这个记忆机制主要有如图 1 所示的四个分层结构组成。

img

图 1:Hermes Agent 的记忆系统

  • L1 核心记忆:相关记忆数据存储于MEMORY.md文件,该文件可以被视为 Agent 的记事本,它的容量被严格限制在 800 tokens 以内。Hermes Agent 会在每次启动一个会话时将其冻结为快照,并注入系统提示词,确保关键上下文不丢失。例如在代码调试场景中,这样做能精准保留错误堆栈、变量状态等核心信息。

  • L2 用户画像:相关记忆数据存储于USER.md文件,容量约 500 tokens,主要用于通过分析历史对话自动记录用户的技术栈偏好(如 Python/JavaScript/C++ 倾向)、喜欢的沟通风格(简洁/详细)等维度标签,以便实现与用户的个性化交互。

  • L3 会话记忆:相关记忆数据会被全量存储在 SQLite 数据库中,并利用 FTS5 全文索引支持毫秒级检索。对于这部分记忆数据,Hermes Agent 并不会主动加载,而是会在需要时通过 session_search 工具进行针对性的查询。

  • L4 技能系统:相关记忆数据存储于~/.hermes/skills目录下,Hermes Agent 能将复杂任务的解决路径自动提炼为各种可复用的SKILL.md文件,并能根据后续相似任务的执行情况对这些 Skills 进行持续迭代。

总而言之,与 OpenClaw 相比,Hermes Agent 拥有更接近人类对信息进行分层管理的方式,这使它能根据信息的价值和新鲜度进行分层、压缩与主动遗忘,实现跨会话的可复用技能。而 OpenClaw 的持久记忆功能则相对更基础一些,如果我们想要让它具备这种内化的、分层管理的能力,就得借助 memory-lancedb-promemory-powermem 这样的第三方插件来实现,但这些第三方插件又正是 OpenClaw 每次版本更新会引发兼容性问题的根源。有时候,计算机世界就是这样,牺牲自由度就会换来便利性,反之亦然。

可扩展的 Skills 框架

Hermes Agent 提供了标准化的、可自我迭代的 Skills 框架,这一框架具有如下几个核心特性:

  1. 持续优化机制:不同于传统的硬编码工具,Hermes Agent 会将任务的执行经验自动提取为可复用的 Skills,并能根据后续相似任务的执行情况保持自我更新。这是因为,它可以利用 DSPy 和 GEPA(遗传帕累托提示进化)算法,基于用户反馈自动优化自身的 Skills 库。

  2. 标准化格式:Hermes Agent 中的所有 Skill 都遵循 agentskills.io 定义的规范,被存放在~/.hermes/skills/目录下。具体来说就是:

    • 每个 Skill 都需由一个名为SKILL.md的 Markdown 文件来定义;
    • 定义的内容通常包含:元数据、名称、版本、作者、功能描述、输入/输出规范、任务执行策略(Thought Process)、以及要执行的动作(Actions)等。
  3. 内置的 Skills 库及其扩展生态:Hermes Agent 框架自带了 70+ 个,覆盖 15+ 类别的内置 Skills。应用场景包括 Apple Notes/Reminders、iMessage、Claude Code、OpenCode 等。除此之外,用户还可以通过 Skills Hub 安装其他第三方 Skills,或在~/.hermes/skills/目录下创建自定的 Skills。

  4. 安全性机制:在 1Panel 等环境中提供技能管理界面,支持安全审批 /approve session。

正是以上特性赋予了 Hermes Agent 强大的、可自我提升的能力,其中的核心能力包括:

  • 持久化记忆:跨会话持久存储用户偏好和高频操作。
  • 反馈式学习:实时根据用户的“好/坏”评价调整策略。
  • 智能化执行:能够执行复杂任务,如写 Proposal、调用外部接口。
  • 自动化沉淀: 将临时任务转化为可复用的标准化技能。
  • 定时/触发任务:支持基于 Cron 表达式或事件的自动化工作流。

这让同为可部署为系统服务的 Agent,Hermes Agent 相对于 OpenClaw,具备了如表 1 所示的明显优势。

维度 Hermes Agent OpenClaw
技能定义 由 Agent 自动生成并优化 需人工编写指令规则与相关脚本
记忆机制 持久化分层存储 原生记忆能力较弱,需借助外部扩展
安全机制 内置安全审批与隔离机制 需在后期进行人工维护
角色定位 面向长期能力沉淀的系统 偏向用于工具编排的框架

表 1:Hermes Agent 相对于 OpenClaw 的优势

简单易用的部署方案

Hermes Agent 支持 Linux/macOS/Windows/Android Termux 环境,用户通常只需根据自己所在的操作系统平台执行一条命令即可完成服务的部署(包括安装相关的依赖)。

# 在 Linux / MacOS / WSL 环境下执行如下命令
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

# 在 Windows 原生环境下执行如下命令
irm https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.ps1 | iex

在上述命令启动之后,我们会先下载到 Hermes Agent 的安装脚本,然后该脚本会自动检测其所在的计算机系统环境,并安装部署环境所依赖的 Node.js、Python、Git 等基础设施,如图 2 所示。

img

图 2:Hermes Agent 的安装过程

接下来,安装脚本就会启动 Hermes Agent 核心组件的安装与配置向导。和 OpenClaw 一样,Hermes Agent 在网关服务启动前,也会要求用户指定要连接的 LLM 提供商(包括 API Key),由于操作方式大同小异,这里就不再赘述了,如果读者真有需要,可参考我在“参考资料”一节中提供的视频资料:《Hermes Agent 安装与配置演示》。

如果安装过程一切顺利,用户就只需要继续在命令行终端中执行hermes命令,Hermes Agent 就会启动一个如图 3 所示的 TUI 对话窗口,它的作用和我们之前在[[Agent 的基础应用]]这篇笔记中介绍过的 OpenClaw TUI 是一样的,只不过它的界面更美观一些。

img

图 3:Hermes Agent TUI 的对话窗口

标准化的通信平台接入

内置统一消息网关,通过适配器模式支持包括微信、飞书在内的 15+ 个主流通讯平台。记忆与技能数据在各平台间完全互通,解决传统智能代理”平台孤岛”问题。用户通过执行hermes gateway setup命令即可完成通信平台的接入配置,如图 4 所示:

img

图 4:Hermes 的通讯平台接入配置

例如,如果我们在上述界面中选择飞书(Feishu / lark),就会看到如图 5 所示的接入方式界面。然后,我们在这里既可以选择第一项,然后用手机端的飞书通过扫二维码方式自动在飞书开放平台中创建机器人(它会按照指定的智能体模版配置好机器人被赋予的执行权限);也可以和之前在 OpenClaw 种所做的一样,先去飞书开放平台手动创建机器人,并为它配置好你想赋予的权限,然后再回到这里选择第二项,将该机器人的 App ID 和 App Secret 填入。前者比较方便,后者则比较自由,我们可以根据自己的需求来做出选择。

img

图 5:Hermes Agent 的飞书接入方式

如果一切顺利,我们就可以利用配置的飞书机器人与 Hermes Agent 进行对话了,如图 6 所示:

img

图 6:Hermes Agent 与飞书的对话窗口

除了飞书之外,我们从图 4 中还可以看到,Hermes Agent 还支持微信、钉钉、企业微信、Slack、Discord、Telegram、WhatsApp、iMessage 等主流通讯平台,而且这些平台都可以通过类似的方式接入,因此,Hermes Agent 的多平台接入能力相对于 OpenClaw 来说,无疑要简单且规范化得多,而这通常也意味着更稳定。

精简实用的常用命令集

由于 Hermes Agent 归根结底还是和 OpenClaw 一样,同属于运行在服务器环境中的 Agent,主要使用方式依然是基于命令行界面的,毕竟目前还没有什么图形化界面的程序在远程登录到服务器上并执行运维相关工作时,能获得好于命令行界面程序的用户体验。但相对于 OpenClaw 来说,Hermes Agent 的常用命令集要精简许多,而且这些命令的命名也相对规范,用户可以很容易地通过hermes --help命令查看到所有可用的命令,如图 7 所示。

img

图 7:Hermes Agent 的可用命令

其中较为常用的命令包括:

  • hermes命令:用于启动 TUI 对话窗口。
  • hermes model命令:用于配置要使用的 LLM 提供商和具体要接入的模型。
  • hermes tools命令:用于配置 Hermes Agent 可使用的工具集。
  • hermes setup命令:用于执行完整的配置向导,包括 LLM 配置、工具配置、消息网关配置等。
  • hermes doctor命令:用于诊断并修复 Hermes Agent 中的各种配置问题。
  • hermes update命令:用于更新至最新版本。
  • hermes gateway命令:用于启动、停止或重启消息网关服务。
  • hermes --continue命令:用于回到上次会话,其中--continue也可以简写为-c

例如,如果我们想要看看当前运行的 Hermes Agent 服务是否正常,就可以执行hermes doctor命令,如图 8 所示:

img

图 8:Hermes Agent 的诊断结果

如果在上述命令中检测出了什么错误,Hermes Agent 就会在输出中给出相应的修复建议,并提示用户执行hermes doctor --fix命令来修复这些错误。

结束语:一些个人观点

总而言之,Hermes Agent 的配置和使用逻辑与 OpenClaw 几乎是完全一致的。这意味着,人们只要学会了如何使用 OpenClaw。基本上就可以举一反三了。只不过,Hermes Agent 的配置方式相对来说会比 OpenClaw 黑盒化一点,说白了就是用牺牲自由度来换取版本更新的稳定性与扩展应用的安全性。

在目前这个阶段,我对这类部署在服务端 Agent 的基本观点是:如果最近这段时间真有老板听信了资本炒作或自媒体唬烂,认为 OpenClaw 或 Hermes Agent 能代替人类工作,而做大量裁员或者搞一人公司,十八个月之后,他们有非常高的概率会惨不忍睹。当然了,学会使用 Agent 和清醒地认识它之间并不存在矛盾,事实上恰恰相反,越懂它,我们恐怕就越不信这种炒作。因为这会让人面对一个主要的哲学问题:我们要如何只用概率解释世界,这是唯心论还是唯物论? 建议读者可以想想,想得越清楚,就越不容易被忽悠。

当然了,虽然我本人对当前这波 AI 热潮有诸多基于神经网络这项技术本源的质疑,但我还是建议,只要条件允许,我们还是应该要多花点时间折腾 OpenClaw、Hermes Agent 这类工具,毕竟它们依然能有很大的概率会是未来 Agent 应用的发展方向,保持对这种前沿技术的敏感度,是非常必要的投资。

参考资料