增长案例库 Maxed 归档 AI自动化AI搜索优化

用大白话解释 15 个 Hermes Agent 概念

15 Hermes Agent Concepts Explained In Plain English

中文译文 · 12k 字

一句话摘要

标题主题:用通俗语言解释 15 个 Hermes Agent 概念

15个 Hermes Agent 概念用大白话解释 2026年8月24日 · 11分钟阅读 · 查看原文 ↗ Hermes Youtube MCP SEO 读完这篇文章,你会知道一套 Hermes 配置的每个部分都做什么,以及这些部件是如何拼在一起的。本文会按顺序带你过一遍每一个概念。 本文基于我发布的一个 YouTube 视频,那个视频用大白话讲解了每一个关键的 Hermes Agent 概念。你可以在这里观看:https://youtu.be/lGtBPrSrnjY 下面是你将学到的东西 harness(外壳)和 model(模型)如何作为两个独立层工作,这样你就能在不重建任何东西的情况下更换模型 如何把不同的任务发给不同的模型,而不是到处都为一个模型付费 如何根据你想在哪里工作,在终端、桌面应用、Telegram 和语音之间做选择 SOUL.md、AGENTS.md、CONTEXT.md、VOICE.md 和纠错文件如何决定你的 agent 的行为方式 如何用压缩和交接文档防止一个长会话变得陈旧,让你的 agent 保住它的工作上下文,而不是从头再来 1. harness 和 model 是两个独立的层 把 Hermes 想成一辆车。模型是发动机。 让车跑起来的其他一切——轮子、车架、刹车、电子设备——那就是 harness。模型决定说什么、做什么。harness 把你的请求送进去,加载工具和规则,再把成果带出来。 因为这两个层是分开的,所以你可以在不换机器的情况下换大脑。我可以从一个模型切换到另一个模型,而不需要重建我的配置。 工具、记忆、规则和会话,全都原封不动地待在原地。 这一点很重要,因为 Hermes 是开源的、免费的,所以你可以把 harness 定制成符合你自己的使用场景。我移除了一堆我永远用不到的预装工具。 你可以添加自己的规则、添加 hooks,把它塑造成围绕你实际在做的事情。 而一旦 harness 和 model 在你的脑子里分开了,你就可以开始把不同的任务路由到不同的模型。 2. 你可以把不同的任务路由到不同的模型 Hermes 让你把模型选择当成一个"按任务决定"的事,而不是一个"订阅决定"的事。 当我创作内容时,我用通过 OpenRouter 的 GPT 5.6 来做规划。然后我用 Kimi K3 来写。 我在我的 agent 文件里设置好这些,让它自动发生——规划模型搭建结构,写作模型处理文案。 3. 你可以从五个不同的地方跟同一个 agent 对话 终端是经典方式。你输入提示词,答案返回来。 但如果你在终端里不自在,桌面应用给你的是同一个 agent、换了一张不同的脸。它可以实时预览你构建的东西,比如一个落地页或一份演示文稿,就在窗口里。 我也在 Telegram 上有 Hermes,这样我出门时能从手机上给它发消息。桌面应用有一个语音模式,我可以跟它说话,它也会回话。 而且我上周帮一个客户设置了 Discord 语音,所以 agent 坐在一个语音频道里,你可以像跟电话里的人说话一样跟它聊。 界面只是提示词进去、答案回来的那个地方。底下每次都是同一套配置。 但它仍然需要知道你想让它怎么表现。这就是那些文件存在的意义。 4. 告诉它"你是谁、该怎么工作"的文件 没有上下文,你的 agent 就是个聊天机器人。它每次都从零开始。 你给它的文件,才是把它变成有用之物的东西。 提示词是你此刻发出的一次性请求。我用 Wispr Flow 口述我的提示词,解释项目,并指向我电脑上已有的文件。 SOUL.md 保存工作风格和语气。它告诉 Hermes 要扮演什么角色、要有多直接、以及如何做决策。 AGENTS.md 保存某个特定文件夹的项目规则。CONTEXT.md 和 VOICE.md 保存工作空间的细节,比如在这个特定项目里我希望文案怎么写。 如果 Hermes 老是犯同一个错误,你就把那个纠正存下来。我把我的放在一个 corrections.md 文件里。 不管怎样,错误被写下来,就不会再犯。 5. 上下文窗口会满,所以你要压缩或交接 每个模型都有 token 上限。Claude Code 通常给你一百万 token。 GPT 5.6 在 Codex 里有 272,000 token 的上下文窗口,对我来说满得很快。 终端会显示一个实时条,告诉你窗口有多满。当它到50%或60%的时候,我就停下来,写一份交接文档。 然后我清空会话,开一个新的,加载那份交接文档,这样我们就能继续。如果我用的是 Anthropic 的模型,我会更早做这件事,大概40%左右。 Hermes 也可以自动压缩。当你撞到上限时,它会总结对话、记下重要部分的笔记,然后把它插进一个新会话里。 你可以设置触发这个动作的上限位置。 6. agent 循环:提示词、工具、答案 你输入提示词。Hermes 把它加进上下文窗口,然后决定接下来需要发生什么。 它可能会跑一次网络搜索、检查你文件夹里的文件、或者调用一个 MCP。它执行这些动作,然后给你回应。 当我构建东西时,这个循环有更多的结构。规划阶段涉及搜索文件、做研究、拿出一个方案。 然后构建阶段开始,Hermes 会问问题来敲定那个方案。 一旦你开始构建,Hermes 可以跑一个自主循环,不断对照目标检查工作,直到完成。你不必一直提示它。 7. 工具、MCP 服务器和插件 工具给 Hermes 一个在模型之外可以执行的动作,比如搜索网络、运行命令、或者调用一个服务。 我在 Hermes 里写我的 newsletter。它有工具去搜索网络、从我的 YouTube 频道和 Instagram 拉取帖子,然后把完成的草稿推送到 Beehiiv。 我不做任何复制粘贴。有一个针对 Beehiiv 的 MCP,把每个 API 端点都变成 Hermes 可以调用的工具。 这就是 MCP 服务器做的事。它包住一个 API,把每个端点变成一个可调用的工具。 把它想成一个工具箱。你根据活儿来挑选扳手或螺丝刀。 插件把技能、MCP、hooks 和斜杠命令打包进一次安装里。我装了 Superpowers 插件,一次点击就给了我11个不同的技能。 每个技能有特定的角色,它们互相配合。 8. 记忆存"要记住什么",技能存"怎么做" 记忆回答的是 Hermes 该记住什么的问题,包括你的偏好、之前的决策、以及关于你生意的信息。 当你开始一个会话时,它检查你的记忆文件,并把它连同你的提示词一起带进上下文窗口。 技能回答的是另一个问题:Hermes 该怎么做一个特定的活儿。它是一种可重复的方法——当那类工作出现时,该用的步骤、规则和资源。 你不必每个技能都自己写。你可以安装别人分享的技能,也可以通过输入 /learn 来创建自己的技能,它会把你刚刚走过的流程变成一个技能。 两者都不会改变模型。Hermes 在需要的时候,把相关的记忆或技能加载进工作上下文。 9. Hooks 在有事发生时自动触发动作 当一个命名的事件触发时,一个 hook 就会运行。那可能是在使用一个工具之前、在一个活儿完成之后、在一个新会话开始时、或者当你往系统里写入一个文件时。 hook 用代码检查你的规则,然后要么阻止这个动作,要么放行。它不占用上下文。 它发生在一个 shell 里,而不是作为一段注入对话的提示词。 我设置了一个 hook,让我的 agent 不读我的 .env 文件。它们可以在需要的时候运行终端命令去拿 API 密钥,但这些密钥永远不会出现在聊天里。 那条规则自己触发,不需要我批准任何东西。 Hooks 覆盖的是一套配置内部的那些时刻。Profiles 让你一开始就能运行不止一套配置。 10. Profiles 是持久的 agent,subagents 是临时的帮手 一个 profile 是一套完整的 Hermes 配置,为某个特定角色或某类工作而建。它有自己独立的 SOUL.md、AGENTS.md、记忆、技能、模型和对话历史。 我有一个 SEO 写手 profile、一个 SEO 编辑和一个 SEO 策略师。每一个表现都不一样,因为每一个都有自己的指令和上下文。 一个 subagent 不一样。它是在一个会话内部创建、为一个活儿服务的临时帮手。 我可以让 Hermes 读十篇博客文章并做摘要。它会启动十个 subagent,每个读一篇,然后把发现送回主会话。 然后这些 subagent 就消失了。 Profiles 分离角色和上下文。Subagents 在一个会话内部处理突发性的工作。 一旦你有了那些专家 profile,你就需要给它们一个安身之处,以及一个触达它们的途径。 11. Gateways 和 Hermes 在哪里运行 消息网关把同一个 agent 放进 Slack、Discord 和 Telegram。 我把我的放在 Telegram 里,通过一台 VPS 连接,那台 VPS 再连接到我的电脑。它运行定时任务,每天拉取研究资料,给我提供发帖的灵感。 你可以在笔记本上本地运行 Hermes。你可以把它跑在一台 VPS 上,让它全天候工作,即使你合上笔记本也一样。 或者你可以把它跑在一个共享的云端配置里,让一个团队都访问同一套工具、上下文和 API 密钥。 它在哪里运行,取决于谁需要用。如果只有你一个人,本地或一台 VPS 就够了。 如果你有一个团队,你可能希望它跑在云端,这样每个人共享同一套配置。 不管它在哪里运行,自动化、编排和安全决定了有多少工作是在没有你的情况下完成的,以及有多安全。 12. 自动化、编排和安全 定时任务让 Hermes 在特定时间开始工作,无需你发消息。 我有一个每天早上9:02运行的任务。它抓取我前一天的 X 帖子,在 YouTube 上搜索同一主题的相关播客和访谈,拉取片段,然后把它们通过 Telegram 发给我。 这个提示词不是我写的。我在一个会话里走完这个工作流,然后让 Hermes 把它排进日程。 Webhooks 走的是另一条路。一个外部工具 ping Hermes 来触发一个任务。 有人点开一个感谢页,一个 webhook 触发,Hermes 就给 Slack 或 WhatsApp 发一条通知。 Subagents 在一个会话内扇形展开。Kanban 不一样。 它像一个 Trello 看板,任务在阶段之间流转,每个阶段指派了不同的 agent。我的 SEO 流水线有一个写手、一个编辑和一个编排者。 它们在后台互相传递任务。我只碰审批环节。 安全叠了四层。用户授权控制谁能发请求。工具权限控制 agent 能请求哪些动作。 审批会在一个有风险的动作之前暂停,等你来允许或拒绝。Hooks 自动应用规则,可以无需询问就直接拦截。 最安全的设置是给每个 profile 特定的权限和特定的工具,把其他一切都挡在够不着的地方。 这些部件如何拼在一起 全部15个概念是一个系统。模型在最底层,harness 包在它外面,而界面、文件、工具、记忆、技能、hooks、profiles、网关和安全层都叠在它上面。 每一个部件单独都很小。合在一起,它们把"一个模型"变成一套能为你生意实际干活的工作配置。 一旦你知道 Hermes 能看到什么、能记住什么、以及你允许它做什么,你就能把真正的活儿交给它,而不用再猜它会碰什么。 源视频在屏幕上覆盖了本文的每一个概念,每个概念都配有图表和实时演示。你可以在这里观看:https://youtu.be/lGtBPrSrnjY 如果你想找出你生意里最高 ROI 的那一个自动化机会,并让我为你搭建 Hermes Agent,预约你免费的30分钟 AI 审计电话。 https://theaiarchitects.com/x/every-hermes-agent 标签:# X # Hermes # Youtube # MCP # SEO # AI # Claude # Automation # Slack # Guide 相关文章 17 Skills I Would Install on a Fresh Hermes Setup (10x Powerful Hack) Find the slowest page, improve one thing, measure again. Keep the change only if it helps. Stop when targets are met or gains die. Hermes Youtube AI MCP

原文参考:https://maxed.wiki/posts/15-hermes-agent-concepts-explained-in-plain-english/ (Maxed.wiki,本页为站内中文整理)