· 深度 · 10 分钟阅读

Hermes Agent的进化秘密:不动权重,只动笔记

Hermes Agent每15次调用触发一次“学习检查点”,在不更新模型权重的前提下,通过生成和管理外部Markdown技能文件实现能力累积。这种“外挂记忆”机制让Agent拥有了类似操作系统管理虚拟内存的底层架构,成为当前增长最快的开源Agent之一。

过去两年,开源社区最热闹的讨论不再是“谁家的基座模型更强”,而是“Agent到底能不能干活”。很多框架号称能让AI变得聪明,但落地时,用户往往发现Agent就像金鱼,会话一结束,所有经验清零。你教它怎么调用某个API,下次它又忘了;你纠正它的一个错误,下次它可能变本加厉。这种“一次性对话”的局限,是制约AI应用从玩具走向生产力的最大拦路虎。

Hermes Agent的出现,试图解决这个问题。截至2026年9月,它的GitHub Stars数量已达14.8万,是近期增长最快的开源AI Agent项目之一。真正让它脱颖而出的,并非某个惊艳的演示视频,而是其背后一套朴素却极其硬核的工程架构:它不碰模型权重,而是构建并维护外部的提示词、技能文档和记忆文件。换句话说,它不给“大脑”做手术,而是给大脑配了一个会自动整理、甚至会自动写笔记的“记事本”和“工具箱”。

## 像管理硬盘一样管理技能

理解Hermes Agent的学习原理,得先看清它的数据结构。核心代码集中在一个名为AIAgent的类里,规模约为13,700行。在这个类中,设计者没有引入复杂的外部数据库,而是选择了一种看似最原始、实则最优雅的文件格式——Markdown。

为什么是Markdown?因为在2026年的AI工程界,Markdown依然拥有无可替代的地位:它既对人类友好,方便审查和修改;又对机器友好,通过YAML frontmatter可以结构化地存储元数据(如tagsrelated_skills)。更重要的是,它天然支持Git版本控制。这意味着Agent的“成长轨迹”是可以被审计、回滚和审查的。对于企业级应用来说,这种透明性是任何黑盒微调方案都无法比拟的。

Hermes Agent将技能(Skill)定义为一个独立的Markdown文件。为了防止上下文爆炸,它设计了一套三层渐进式加载策略,这套逻辑,如果你做过底层系统开发,会觉得非常眼熟——它简直就是在上下文窗口(Context Window)里做“虚拟内存”管理。

L0层是索引。无论用户拥有多少个技能,Agent启动时只加载这些技能的名称、简短描述和标签。官方数据显示,即便拥有100个技能,这一层的Token开销也仅在3K左右。这就像电脑启动时只加载进程列表,而不加载所有程序的具体代码。L1层则按需加载全文,当Agent判断当前任务与某个技能相关时,它才会去读取该Markdown文件的完整内容。至于L2层附属文件,包含引用的外部代码片段、模板或参考文档,这些内容只有在真正执行复杂操作时才会被读取。

这种设计巧妙地解决了“知识越多,推理越慢”的悖论。它让Agent可以理论上无限扩展技能库,而不会在初始阶段拖垮推理效率。

每15次调用一次的“自我进化”

有了存储结构,接下来就是Hermes Agent最核心的机制:学习循环。这个过程被拆解为Observe(观察)、Distill(蒸馏)、Reuse(复用)和Refine(精炼)四个阶段。触发这个循环的开关是一个简单的计数器:每15次tool call(工具调用)后,系统会强制触发一次“学习检查点”。

Observe阶段,Agent回顾最近的一系列交互。比如,用户刚才让Agent去爬取某个网站的数据,Agent尝试了三种方法,前两种失败,第三种成功了,且用户特别强调了要忽略广告区域。进入Distill阶段,Agent开始“蒸馏”这些经验。它不会把原始的对话记录塞进记忆,而是提炼出结构化的知识:“抓取该类网站时,应使用selector = div.content而非body,并需注意排除.ad-banner类元素。”

如果判断这是一个新技能,Agent会调用skill_manage工具创建一个全新的Markdown文件;如果是对现有技能的修正,它则执行patch操作,修改文件中的特定段落。新的或更新后的技能随后被写入磁盘,并更新L0索引,进入Reuse阶段。若后续调用中发现该技能效果不佳,Agent会再次触发Refine阶段进行修正,不断迭代。

这里最关键的技术点在于skill_manage工具。在传统Agent框架中,工具调用通常只是“执行动作”,比如“点击按钮”、“搜索网络”。但在Hermes中,工具调用变成了“改变自身定义”。Agent在运行时,主动创建、修补或删除自己的技能文件。这在软件工程中意味着Agent拥有了“自编程”的初级能力。它不再是一个固定的程序,而是一个可以自我优化的系统。

这种设计带来了一个巨大的工程优势:跨会话的能力累积。上个月Agent学会怎么处理PDF发票,这个月用户再扔一张发票过去,Agent不需要重新教,它直接从技能库里调出上个月生成的pdf_invoice_handler.md,按图索骥即可。这种“长时记忆”的稳定性,远超基于向量数据库(Vector DB)的语义检索方案。向量库容易“串味”,把不相关的记忆混进来;而文件系统的技能库是精确匹配的,逻辑更清晰,可控性更强。

当Agent开始修改自己的“灵魂”

虽然这套架构在工程上显得非常成熟,但我们必须在技术上冷静地看待其中的风险。Hermes Agent的做法,本质上是把“对齐”(Alignment)的问题,从模型参数层转移到了符号层(Symbol Layer)。

传统的RLHF(基于人类反馈的强化学习)是在训练阶段通过海量数据来约束模型行为。Hermes则是在推理阶段,通过允许Agent修改外部文本来影响行为。这听起来很灵活,但也很危险。

假设Agent在Distill阶段发生了一次“幻觉”,它错误地总结了一条规则:“处理财务数据时,默认忽略小数点后两位。”这条规则被写入技能文件。在下一次任务中,Agent加载了这个技能,于是它真的截断了小数。用户发现后,需要手动去修改那个Markdown文件。如果用户没有发现,这条错误的“经验”就会在后续任务中被反复复用,甚至可能被其他技能引用,导致错误指数级放大。

目前,Hermes通过YAML frontmatter中的元数据(如tagsrelated_skills)和严格的patch操作来约束这种风险。但本质上,这是用更多的规则去约束一个可能突破规则的主体。这就好比给一个正在自我进化的智能体,发了一本越写越厚的“员工手册”。

从安全性的角度讲,这种架构对审计能力的要求极高。开发团队必须建立一套机制,不仅要看Agent的最终输出,还要审查Agent生成的每一个技能文件的diff(差异)。对于普通用户而言,如果无法理解这些Markdown文件的具体逻辑,他们实际上是在盲信任一个会自己“写代码”的助手。

此外,三层加载策略也带来了新的攻击面。如果恶意用户构造了一个看似正常的技能文件,其中L2层嵌入了恶意的代码片段或提示注入(Prompt Injection),当Agent在处理高价值任务时加载该文件,是否会导致上下文被污染?虽然Hermes做了隔离,但在2026年这个时间点,LLM的鲁棒性依然无法百分之百保证针对所有复杂指令注入的免疫性。

## 行业视角的冷思考

Hermes Agent的爆火,反映了一个正在发生的范式转移:AI竞争的重心,正在从“模型能力”转向“知识框架与成长生态”。

过去,大家比拼的是谁家的模型参数更大、上下文更长。现在,随着基座模型能力的趋同,差异化的关键变成了:谁能构建更优雅、更可扩展的技能系统?谁能吸引开发者贡献更多高质量的技能文件,形成护城河?

这就解释了为什么Hermes选择开源,且强调Markdown的可读性。它希望构建一个类似“技能App Store”的生态。想象一下,未来IDE(集成开发环境)或办公软件内置的不再是固定的功能菜单,而是允许AI根据你的工作习惯自动生成并维护的“个人工作流脚本”。你今天教AI怎么整理周报,明天AI就自动保存为一个weekly_report_skill.md,并随着你风格的改变而自我迭代。

在这个过程中,“赋予工具学习能力”将成为下一阶段AI应用的关键指标。但这也要求开发者从“提示词工程师”转型为“技能架构师”。你不再只需要写好Prompt,你需要设计好文件结构、定义好元数据标签、规划好加载策略,甚至要建立技能版本的回归测试机制。

Hermes Agent目前每15次tool call触发一次检查点,这个数字是静态的。对于高频交互场景,这可能太慢,导致经验固化滞后;对于低频复杂任务,这可能又太快,产生大量噪声。未来的迭代方向,可能会引入动态触发机制——不是按次数,而是按“置信度”或“错误率”来触发学习。比如,只有当Agent对某个任务的完成置信度低于70%,或者用户给出了明确的负面反馈时,才触发Distill过程。

另外,13,700行的核心代码规模,对于维护一个复杂的Agent框架来说,依然是一个巨大的挑战。随着技能数量的增加,skill_manage工具的调用逻辑可能会成为性能瓶颈。如何在不增加L0索引开销的前提下,更高效地定位相关技能?是否需要引入向量索引作为L0的补充?这些都是后续版本需要解决的工程难题。

对于正在构建Agent系统的团队来说,Hermes Agent提供了一个极具参考价值的“非微调”路径。它证明了,通过精心设计的文件系统操作和渐进式加载策略,可以在不触碰模型权重的情况下,实现相当程度的智能体自我进化。这种方法虽然存在可控性上的固有矛盾,但其透明性和可审计性,使得它在企业级落地中具有独特的优势。

AI的成长,不应该是一个黑盒。Hermes Agent把成长的痕迹,一行行地写在了Markdown文件里。这种做法,或许不够“性感”,但足够扎实。在技术狂奔的2026年,这种扎实,恰恰是最稀缺的特质。

✉️ 免费订阅

每天接收最值得关注的 AI 信号

加入 1000+ 创始人、投资人和技术从业者。每天早上直达邮箱:精选 AI 动态、深度分析、值得关注的二阶变量。

无垃圾邮件,随时退订。