一、Hermes Agent 是什么?Nous Research 的开源智能体框架
Hermes Agent 是 AI 研究机构 Nous Research 推出的开源 AI 智能体框架,2026 年以来以极快速度在 GitHub 上走红(23.5 万星标 / 4.7 万 fork)。它可以在你的终端、聊天平台与 IDE 里运行,并连接任意大模型。它的官方定位是「The agent that grows with you」——一个会随你一起成长、越用越懂你的智能体,而不是固定不变的聊天玩具。
它和 Claude Code(Anthropic)、Codex(OpenAI)、OpenClaw 同属「自主编程 / 任务执行智能体」品类:都依靠工具调用与你的系统真实交互,而不是只输出一段文字。三者各有侧重——Claude Code 重在代码、Codex 重在编程、OpenClaw 重在泛用自动化;Hermes Agent 的独特之处在于「成长性 + 多渠道接入 + 模型自由」。

二、和 ChatGPT 聊天助手有什么不同:工具调用 vs 纯对话
ChatGPT / 豆包 / 元宝:你在网页或 App 的对话框里提问,它生成文本答复——对话是终点。
Hermes Agent:它是一套运行在你机器上、能调用工具的智能体——能读写文件、执行 shell 命令、搜索网页、操作浏览器、处理图片、调度子代理、跑定时任务。对话只是入口,把事办成才算完成。
因此它更接近「一名 24 小时在线、有电脑操作权限的同事/员工」,而不只是「一个更聪明的搜索框」。
三、核心亮点:让智能体「越用越懂你」的 6 个能力
自进化技能(Skills):解决过一个复杂问题、发现一套工作流、或被你纠正后,可把经验存成技能文档,未来会话自动加载,越积越懂你的环境。
跨会话持久记忆:记住你是谁、你的偏好、环境细节、踩过的坑;记忆后端可插拔(内置、Honcho、Mem0 等)。
多渠道网关:同一个智能体接入 Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、Home Assistant、API、Webhooks 等 15+ 渠道,均有完整工具权限。
模型无关(Provider-agnostic):任意大模型都能接——OpenRouter、Anthropic、OpenAI、DeepSeek、本地 Ollama、小米 MiMo、MiniMax、GLM、Kimi、Qwen、xAI、Gemini 等 20+ 家,任务中途可随意切换;凭据池在多把 API Key 间自动轮换。
多实例隔离(Profiles):可同时运行多个相互独立实例,各自拥有独立配置、会话、技能与记忆。
高度可扩展:插件、MCP 服务器、自定义工具、Webhook 触发、Cron 定时调度与完整 Python 生态。
四、技术架构:核心循环 × 工具 × 技能 × 记忆 × 网关
Hermes Agent 的整体架构是「一个智能体核心循环 + 四类能力层 + 一个多渠道网关」:
智能体核心循环:系统提示 → 调用大模型 → 工具分派 → 执行 → 结果回馈 → 上下文压缩 → 记忆沉淀。
工具集(Toolsets):web / browser / terminal / file / code_execution / vision / image_gen / tts / memory / delegation / cronjob / session_search / todo / clarify 等,可按平台开关。
技能(Skills,自进化):沉淀可复用流程,未来自动加载。
记忆(Memory,跨会话):持久化你是谁、偏好与教训,后端可替换。
可扩展性:插件、MCP、自定义工具、Webhook、Cron、Python 生态。
多渠道网关(Gateway):把以上能力同时接到几乎所有你常用的聊天与开发平台。

五、支持哪些模型与运行环境
运行环境:Linux、macOS、WSL(Windows Subsystem for Linux),源码在 github.com/NousResearch/hermes-agent。
模型支持(20+ 家):OpenRouter、Anthropic(Claude)、OpenAI、DeepSeek、本地 Ollama、Google Gemini、xAI / Grok、Hugging Face、Z.AI / GLM、MiniMax、Kimi / Moonshot、阿里 DashScope(Qwen)、小米 MiMo、Kilo Code、Vercel AI Gateway、OpenCode Zen / Go、GitHub Copilot,以及任意自定义 OpenAI 兼容端点。
凭据池:同一家提供方可配多把 Key 自动轮换,避免限流与单一 Key 超支。
六、多渠道接入:一套智能体走遍聊天软件
Hermes Agent 最直观的体验,就是你不用再为每个平台配一个机器人。终端、IDE、Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、API / Webhooks……无论你在哪个渠道跟他说话,背后都是同一个智能体、同一套工具、同一份记忆与技能,切换渠道不丢失上下文。

七、怎么安装与使用?
一行命令安装:
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash(自动装好依赖);也支持 npm 安装。常用命令:
hermes交互聊天;hermes chat -q "…"单次提问;hermes setup引导式设置;hermes model切换模型/提供方;hermes doctor健康检查。会话内斜杠命令:
/new新会话、/model改模型、/skill <名称>加载技能、/cron定时任务、/tools管理工具、/yolo跳过危险命令审批、/voice语音模式。常用管理命令:
hermes tools(开关工具集)、hermes skills install ID(安装技能)、hermes mcp add NAME(接 MCP 服务器)、hermes gateway status(看各渠道连接)、hermes sessions rename ID T(会话重命名)、hermes profile create NAME(建独立实例)、hermes claw migrate(从 OpenClaw 迁移)。
八、安全与隐私控制(命令审批与脱敏)
因为 Hermes Agent 有真实系统操作权限,官方提供了多层安全开关:
命令审批:默认在遇到危险命令(如
rm -rf、git reset --hard)前会向你确认。可设manual(总是询问,默认)、smart(低风险自动放行、高风险询问,推荐)、off(全部跳过,不推荐)。密钥脱敏:
security.redact_secrets true可让工具输出中的类密钥/令牌在进入上下文与日志前被自动打码。PII 脱敏:网关层可对用户 ID 做哈希、对手机号等敏感信息做清洗。
技能白名单与最小权限:安装第三方技能时留意来源,做好权限隔离。
九、适合谁与典型场景
开发者 / 效率型用户:写代码、跑测试、接 CI、查日志、做代码审查,通过终端或 IDE 直接驱动。
运营与内容工作者:安排定时任务(cron)、抓取网页、整理文档、生成配图、语音转写/合成。
科研与数据分析:接 Python 生态做数据处理、跑实验、沉淀可复用工作流。
数字助手发烧友:把它接上微信/飞书/Telegram,随时随地在现有聊天里指挥它干活。
从 OpenClaw 迁移的用户:提供
hermes claw migrate一键迁移入口。
十、优势与不足
优势:
开源(MIT)、免费,模型完全自由,不锁定特定厂商。
技能自进化 + 跨会话记忆,是「越用越懂你」的成长型智能体。
多渠道网关 + 完整工具权限,一套智能体走遍聊天与开发平台。
凭据池轮换、多实例 Profile、MCP / 插件 / Webhook / Cron 全都要。
官方文档完善(hermes-agent.nousresearch.com/docs)。
不足与风险:
有真实系统访问权限,必须做好命令审批与技能来源审查,否则存在安全风险。
需要一定上手成本:配置模型 Key、连聊天平台、理解「工具集 / 技能 / 记忆 / Profile」体系;对只想「聊聊天」的用户,直接用豆包/元宝等 App 更省事。
高度可定制也意味着较陡的配置学习曲线;同品类里 Claude Code 在纯代码、OpenClaw 在泛用自动化上各有专长。
十一、Hermes Agent 常见问题(FAQ)
Q1:Hermes Agent 和 ChatGPT 聊天助手有什么区别?
ChatGPT 是在网页对话框里问答、返回文字;Hermes Agent 是一套运行在你机器上、能调用工具真实执行任务的智能体——读写文件、跑命令、搜网页、调度子代理、定时任务,聊完还得把事办成,且能通过技能与记忆越用越懂你。
Q2:Hermes Agent 是免费的吗?
开源免费(MIT 协议)。你只需为它连接的模型 API 付费;用本地 Ollama 或自带订阅可进一步省成本。凭据池还可多 Key 轮换。
Q3:Hermes Agent 支持哪些模型?
20+ 家:OpenRouter、Anthropic、OpenAI、DeepSeek、本地 Ollama、Gemini、xAI/Grok、GLM、MiniMax、Kimi、阿里 DashScope、小米 MiMo、GitHub Copilot、Vercel AI Gateway 及任意自定义端点,可中途自由切换。
Q4:Hermes Agent 能接到哪些渠道?
终端 / IDE(ACP)、Telegram、Discord、Slack、WhatsApp、Signal、Email、飞书、企业微信、微信、钉钉、Matrix、Mattermost、Home Assistant、API / Webhooks 等 15+ 渠道,且都具备完整工具权限。
Q5:用 Hermes Agent 安全吗?
可以做到安全,但因为它有真实系统权限,务必开启命令审批(smart 模式)、审查第三方技能来源、按需开启密钥/隐私脱敏;不要盲目 --yolo 跳过所有确认。
十二、结语:Hermes Agent 的定位与价值
Hermes Agent 的价值,在于把 AI 从「你问我答的对话」升级为「一个会成长、懂你环境、能在你已有渠道里替你干活的开源智能体」。它用技能自进化 + 跨会话记忆解决「AI 用完就忘」的痛点,用多渠道网关解决「每个平台都要配一个机器人」的碎片化,用模型无关给你不被锁定的自由。它不是没有门槛——需要配置、需要安全意识、需要一点学习成本;但对想把 AI 真正用成生产力工具的开发者与效率型用户来说,2026 年的 Hermes Agent 是最值得关注的开源智能体框架之一。



