Hermes Agent 架构总览:从 Agent Loop 到智能体平台

Hermes Agent 架构总览:从 Agent Loop 到智能体平台

💡 原文中文,约8300字,阅读约需20分钟。
📝

内容提要

本文介绍Hermes Agent的架构,定位为多入口、单核心、多协议、可插拔能力的智能体运行平台。核心是AIAgent和对话循环,统一处理CLI、桌面、消息平台等入口,支持模型适配、工具扩展、记忆、压缩和安全机制。文章强调能力归属会话而非进程,并指出其复杂性和设计权衡。

🔎

延伸解读

架构定位:窄腰型平台

文章将 Hermes Agent 定位为“多入口、单核心、多协议、可插拔能力”的智能体运行平台。核心是 AIAgent 与对话循环,所有入口(CLI、桌面、消息平台等)都复用同一套运行时语义,避免为每个入口重复实现模型循环。这种“窄腰”设计让系统在增加交互方式或扩展能力时,只需遵循中间层契约,降低了耦合度。

协议区分:ACP、MCP 与 Provider Transport

文中明确区分了三种易混淆的协议:ACP 用于 Host 与 Agent 之间的驱动,MCP 用于 Agent 连接外部工具,Provider Transport 用于 Agent 与模型 API 的通信。它们可能都基于 JSON-RPC,但消息方法、生命周期和连接对象不同。典型编辑器会话可同时叠加三层协议,而非三选一。

能力归属:会话而非进程

文章强调“能力属于 Session,不属于 Process”。权限、工具可用性等必须根据当前会话来源解析,而非进程级全局配置。这体现在 Profile 作用域进入注册中心,一个进程可服务多个隔离的配置与扩展。这种设计支持多租户和安全性,但也增加了动态注册带来的静态分析难度。

持续执行梯度:生命周期优先

Hermes Agent 提供从 /loop、Heartbeat、Goal、Delegation、Cron 到 Kanban 的持续执行梯度,每种机制对应不同生命周期需求。架构上先问生命周期,再选机制,而非笼统支持“Autonomous Agent”。这种分层设计让系统能适应从短时重复到长期计划的各种场景。

Q&A

Hermes Agent 的架构定位是什么?

Hermes Agent 被定位为一个多入口、单核心、多协议、可插拔能力、统一状态层的智能体运行平台。它通过中间的 AIAgent 和 Conversation Loop 作为“窄腰”,统一处理 CLI、桌面、消息平台等入口,并支持模型适配、工具扩展、记忆、压缩和安全机制。

Hermes Agent 支持哪些入口?它们如何共享同一个核心?

Hermes Agent 支持 CLI、TUI、桌面(Electron)、消息平台(如 Telegram、Discord)、API Server、ACP(编辑器协议)、Cron 和批处理等入口。这些入口都通过统一的 AIAgent 和 Conversation Loop 核心,接收输入、解析身份与会话、调用 AIAgent,并将结果转换为界面可展示的形式。

ACP、TUI Gateway 和 MCP 有什么区别?

ACP(Agent Client Protocol)是面向编辑器或 Host 如何驱动完整 Agent 的协议;TUI Gateway JSON-RPC 是 Hermes 自己为 TUI、Desktop 等富客户端提供的控制协议;MCP(Model Context Protocol)则位于 Agent 的另一侧,用于连接外部 Tool、Resource 和 Prompt。它们都可能使用 JSON-RPC,但消息方法、生命周期和连接对象不同。

Hermes Agent 的运行时由哪些主要组件组成?

主要组件包括:入口适配器(如 CLI、Gateway)、AIAgent(保存会话状态)、Agent Init(解析配置并装配对象图)、Conversation Loop(组织模型调用和工具结果)、Prompt System(构建提示)、Provider Runtime(模型适配)、Tool Registry(工具注册)、Tool Executor(工具执行)、Skill System、Plugin Manager、MCP Client、Memory/Context Engine 和 SessionDB(持久化)。

Hermes Agent 如何处理长会话和上下文?

Hermes Agent 通过 Prompt Cache、sidecar、Context Engine 和 lease 机制保护长会话的连续性。它将历史、记忆和上下文选择分开处理,并支持上下文压缩。SessionDB 用于持久化消息和状态,确保会话可以恢复。

Hermes Agent 的扩展体系包括哪些方式?

Hermes Agent 的扩展体系包括 Skill、Plugin、MCP、Provider、Memory Provider 和 Context Engine。这些扩展通过 Tool Registry 的窄腰设计集成,不直接侵入每个入口,保持了核心的稳定性。

Hermes Agent 在安全方面有哪些机制?

Hermes Agent 的安全机制包括危险命令审批、文件检查点与回滚、Worktree、Sandbox、Secrets、Managed Scope 和 Egress Proxy。这些机制通过审批管线、shadow Git snapshot、Environment Backend、Secret Source 和出站凭据注入实现。

Hermes Agent 的持续执行梯度是什么?

持续执行梯度是指从 /loop(会话内重复)、Heartbeat(空闲重入)、Goal(跨 Turn 完成条件)、Delegation(并行临时任务)、Cron(定时 Job)到 Kanban(依赖、认领、Review 和崩溃恢复)的机制。架构上先问生命周期,再选机制,而不是笼统支持 Autonomous Agent。

Hermes Agent 的架构有哪些设计权衡或代价?

代价包括:核心文件较大,历史兼容逻辑阅读成本高;动态注册导致静态分析困难;Prompt Cache 不变量限制了会话中途修改系统提示和工具集;多进程一致性(Agent Cache、SQLite、路由状态、压缩锁和 turn lease)本身是子系统;Hook 和 Provider 开放带来长期兼容与安全治理成本。

Hermes Agent 的架构亮点有哪些?

亮点包括:多入口复用完整 Agent 语义;供应商差异被限制在协议边界;扩展方式有重量级(Skill、Plugin、MCP 等);长会话不是事后补丁;Profile 作用域进入注册中心,支持隔离配置与扩展。

🏷️

标签

➡️

继续阅读