Hermes Agent

♨7,878 热度

Hermes Agent 不是只会聊天的 ChatGPT——它是一套由 Nous Research 打造、运行在你终端、IDE 与微信/飞书/Telegram 等渠道、能通过工具调用真正干活的开源智能体。它把解决过的问题沉淀为技能(Skills)、把关于你的信息存成跨会话记忆,越用越懂你(The agent that grows with you)。本文结合官方文档与 GitHub,拆解它的定位、架构、模型支持、多渠道网关、安全控制与安装使用。

直达网站
Hermes Agent 工具界面或产品展示图
工具介绍

一、Hermes Agent 是什么?Nous Research 的开源智能体框架

Hermes Agent 是 AI 研究机构 Nous Research 推出的开源 AI 智能体框架,2026 年以来以极快速度在 GitHub 上走红(23.5 万星标 / 4.7 万 fork)。它可以在你的终端、聊天平台与 IDE 里运行,并连接任意大模型。它的官方定位是「The agent that grows with you」——一个会随你一起成长、越用越懂你的智能体,而不是固定不变的聊天玩具。

它和 Claude Code(Anthropic)、Codex(OpenAI)、OpenClaw 同属「自主编程 / 任务执行智能体」品类:都依靠工具调用与你的系统真实交互,而不是只输出一段文字。三者各有侧重——Claude Code 重在代码、Codex 重在编程、OpenClaw 重在泛用自动化;Hermes Agent 的独特之处在于「成长性 + 多渠道接入 + 模型自由」。

Hermes Agent 官方品牌横幅
图:Hermes Agent 官方品牌横幅

二、和 ChatGPT 聊天助手有什么不同:工具调用 vs 纯对话

  • ChatGPT / 豆包 / 元宝:你在网页或 App 的对话框里提问,它生成文本答复——对话是终点。

  • Hermes Agent:它是一套运行在你机器上、能调用工具的智能体——能读写文件、执行 shell 命令、搜索网页、操作浏览器、处理图片、调度子代理、跑定时任务。对话只是入口,把事办成才算完成。

因此它更接近「一名 24 小时在线、有电脑操作权限的同事/员工」,而不只是「一个更聪明的搜索框」。

三、核心亮点:让智能体「越用越懂你」的 6 个能力

  1. 自进化技能(Skills):解决过一个复杂问题、发现一套工作流、或被你纠正后,可把经验存成技能文档,未来会话自动加载,越积越懂你的环境。

  2. 跨会话持久记忆:记住你是谁、你的偏好、环境细节、踩过的坑;记忆后端可插拔(内置、Honcho、Mem0 等)。

  3. 多渠道网关:同一个智能体接入 Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、Home Assistant、API、Webhooks 等 15+ 渠道,均有完整工具权限。

  4. 模型无关(Provider-agnostic):任意大模型都能接——OpenRouter、Anthropic、OpenAI、DeepSeek、本地 Ollama、小米 MiMo、MiniMax、GLM、Kimi、Qwen、xAI、Gemini 等 20+ 家,任务中途可随意切换;凭据池在多把 API Key 间自动轮换。

  5. 多实例隔离(Profiles):可同时运行多个相互独立实例,各自拥有独立配置、会话、技能与记忆。

  6. 高度可扩展:插件、MCP 服务器、自定义工具、Webhook 触发、Cron 定时调度与完整 Python 生态。

四、技术架构:核心循环 × 工具 × 技能 × 记忆 × 网关

Hermes Agent 的整体架构是「一个智能体核心循环 + 四类能力层 + 一个多渠道网关」:

  • 智能体核心循环:系统提示 → 调用大模型 → 工具分派 → 执行 → 结果回馈 → 上下文压缩 → 记忆沉淀。

  • 工具集(Toolsets):web / browser / terminal / file / code_execution / vision / image_gen / tts / memory / delegation / cronjob / session_search / todo / clarify 等,可按平台开关。

  • 技能(Skills,自进化):沉淀可复用流程,未来自动加载。

  • 记忆(Memory,跨会话):持久化你是谁、偏好与教训,后端可替换。

  • 可扩展性:插件、MCP、自定义工具、Webhook、Cron、Python 生态。

  • 多渠道网关(Gateway):把以上能力同时接到几乎所有你常用的聊天与开发平台。

Hermes Agent 技术架构:核心循环经过工具集、技能、记忆、可扩展能力层,接入多渠道网关
图:Hermes Agent 技术架构(核心循环 × 工具 × 技能 × 记忆 × 网关)

五、支持哪些模型与运行环境

  • 运行环境:Linux、macOS、WSL(Windows Subsystem for Linux),源码在 github.com/NousResearch/hermes-agent。

  • 模型支持(20+ 家):OpenRouter、Anthropic(Claude)、OpenAI、DeepSeek、本地 Ollama、Google Gemini、xAI / Grok、Hugging Face、Z.AI / GLM、MiniMax、Kimi / Moonshot、阿里 DashScope(Qwen)、小米 MiMo、Kilo Code、Vercel AI Gateway、OpenCode Zen / Go、GitHub Copilot,以及任意自定义 OpenAI 兼容端点。

  • 凭据池:同一家提供方可配多把 Key 自动轮换,避免限流与单一 Key 超支。

六、多渠道接入:一套智能体走遍聊天软件

Hermes Agent 最直观的体验,就是你不用再为每个平台配一个机器人。终端、IDE、Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、API / Webhooks……无论你在哪个渠道跟他说话,背后都是同一个智能体、同一套工具、同一份记忆与技能,切换渠道不丢失上下文。

Hermes Agent 多渠道网关:一套智能体接入终端、Telegram、Discord、Slack、微信、飞书、钉钉等渠道
图:Hermes Agent 多渠道网关(一套智能体接入所有常用渠道)

七、怎么安装与使用?

  • 一行命令安装:curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash(自动装好依赖);也支持 npm 安装。

  • 常用命令:hermes 交互聊天;hermes chat -q "…" 单次提问;hermes setup 引导式设置;hermes model 切换模型/提供方;hermes doctor 健康检查。

  • 会话内斜杠命令:/new 新会话、/model 改模型、/skill <名称> 加载技能、/cron 定时任务、/tools 管理工具、/yolo 跳过危险命令审批、/voice 语音模式。

  • 常用管理命令:hermes tools(开关工具集)、hermes skills install ID(安装技能)、hermes mcp add NAME(接 MCP 服务器)、hermes gateway status(看各渠道连接)、hermes sessions rename ID T(会话重命名)、hermes profile create NAME(建独立实例)、hermes claw migrate(从 OpenClaw 迁移)。

八、安全与隐私控制(命令审批与脱敏)

因为 Hermes Agent 有真实系统操作权限,官方提供了多层安全开关:

  • 命令审批:默认在遇到危险命令(如 rm -rf、git reset --hard)前会向你确认。可设 manual(总是询问,默认)、smart(低风险自动放行、高风险询问,推荐)、off(全部跳过,不推荐)。

  • 密钥脱敏:security.redact_secrets true 可让工具输出中的类密钥/令牌在进入上下文与日志前被自动打码。

  • PII 脱敏:网关层可对用户 ID 做哈希、对手机号等敏感信息做清洗。

  • 技能白名单与最小权限:安装第三方技能时留意来源,做好权限隔离。

九、适合谁与典型场景

  • 开发者 / 效率型用户:写代码、跑测试、接 CI、查日志、做代码审查,通过终端或 IDE 直接驱动。

  • 运营与内容工作者:安排定时任务(cron)、抓取网页、整理文档、生成配图、语音转写/合成。

  • 科研与数据分析:接 Python 生态做数据处理、跑实验、沉淀可复用工作流。

  • 数字助手发烧友:把它接上微信/飞书/Telegram,随时随地在现有聊天里指挥它干活。

  • 从 OpenClaw 迁移的用户:提供 hermes claw migrate 一键迁移入口。

十、优势与不足

优势:

  • 开源(MIT)、免费,模型完全自由,不锁定特定厂商。

  • 技能自进化 + 跨会话记忆,是「越用越懂你」的成长型智能体。

  • 多渠道网关 + 完整工具权限,一套智能体走遍聊天与开发平台。

  • 凭据池轮换、多实例 Profile、MCP / 插件 / Webhook / Cron 全都要。

  • 官方文档完善(hermes-agent.nousresearch.com/docs)。

不足与风险:

  • 有真实系统访问权限,必须做好命令审批与技能来源审查,否则存在安全风险。

  • 需要一定上手成本:配置模型 Key、连聊天平台、理解「工具集 / 技能 / 记忆 / Profile」体系;对只想「聊聊天」的用户,直接用豆包/元宝等 App 更省事。

  • 高度可定制也意味着较陡的配置学习曲线;同品类里 Claude Code 在纯代码、OpenClaw 在泛用自动化上各有专长。

十一、Hermes Agent 常见问题(FAQ)

Q1:Hermes Agent 和 ChatGPT 聊天助手有什么区别?

ChatGPT 是在网页对话框里问答、返回文字;Hermes Agent 是一套运行在你机器上、能调用工具真实执行任务的智能体——读写文件、跑命令、搜网页、调度子代理、定时任务,聊完还得把事办成,且能通过技能与记忆越用越懂你。

Q2:Hermes Agent 是免费的吗?

开源免费(MIT 协议)。你只需为它连接的模型 API 付费;用本地 Ollama 或自带订阅可进一步省成本。凭据池还可多 Key 轮换。

Q3:Hermes Agent 支持哪些模型?

20+ 家:OpenRouter、Anthropic、OpenAI、DeepSeek、本地 Ollama、Gemini、xAI/Grok、GLM、MiniMax、Kimi、阿里 DashScope、小米 MiMo、GitHub Copilot、Vercel AI Gateway 及任意自定义端点,可中途自由切换。

Q4:Hermes Agent 能接到哪些渠道?

终端 / IDE(ACP)、Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、Home Assistant、API / Webhooks 等 15+ 渠道,且都具备完整工具权限。

Q5:用 Hermes Agent 安全吗?

可以做到安全,但因为它有真实系统权限,务必开启命令审批(smart 模式)、审查第三方技能来源、按需开启密钥/隐私脱敏;不要盲目 --yolo 跳过所有确认。

十二、结语:Hermes Agent 的定位与价值

Hermes Agent 的价值,在于把 AI 从「你问我答的对话」升级为「一个会成长、懂你环境、能在你已有渠道里替你干活的开源智能体」。它用技能自进化 + 跨会话记忆解决「AI 用完就忘」的痛点,用多渠道网关解决「每个平台都要配一个机器人」的碎片化,用模型无关给你不被锁定的自由。它不是没有门槛——需要配置、需要安全意识、需要一点学习成本;但对想把 AI 真正用成生产力工具的开发者与效率型用户来说,2026 年的 Hermes Agent 是最值得关注的开源智能体框架之一。