从零掌握
Hermes Agent
一款开源、支持工具调用的 AI Agent 框架。它能读文件、跑命令、上网搜索、控制浏览器、连接微信/Telegram——本手册带你从安装到精通,一步步建立自己的智能助理。
🧬Agent 正在思考... 而不仅仅是聊天
普通 AI 聊天机器人 只能说话。Hermes 是一个 能动手的智能体——它会自己调用终端、读写文件、打开浏览器,直到任务完成。
⚔️ Hermes vs 普通 AI 聊天机器人
同样问一句话,Hermes 能做到的,普通聊天机器人做不到。逐项对比——
| 能力维度 | 💬 普通 Chatbot | ⚡ Hermes Agent |
|---|---|---|
| 自然语言对话 | ✓ | ✓ |
| 执行 Shell 命令 | ✗ | ✓ |
| 读写本地文件 | ✗ | ✓ |
| 上网搜索 & 抓取 | ✗ | ✓ |
| 控制浏览器(点按钮、填表单) | ✗ | ✓ |
| 跨会话记住你 | ✗ | ✓ |
| 切换任何大模型 | ✗ | ✓ |
| 接入微信 / TG / Discord | ✗ | ✓ |
| 运行 Python 代码 | ✗ | ✓ |
| 数据 100% 本地掌控 | ✗ | ✓ |
💰 一次对话花多少钱?
Hermes 本身免费开源。你只需付模型 API 费用——而且比你想象的便宜得多。
以下价格均为每百万 token(约 75 万汉字),一次日常对话通常只需几千 token。
🚀快速开始
Hermes 是 Nous Research 开发的 AI Agent 框架,核心理念:让 AI 真正"动手"做事,而不只是聊天。它通过工具(Tools)连接你的终端、文件系统、浏览器和消息平台。
安装 Hermes
pip install hermes-agent推荐 · 最简curl -fsSL hermes-agent.nousresearch.com/install.sh | bash官方脚本验证安装:运行 hermes version 看版本号,hermes doctor 检查环境。
首次启动流程
配置你的第一个 API Key
Hermes 支持多家模型供应商。三种方式任选其一:
hermes setup交互向导 · 新手首选export DEEPSEEK_API_KEY="sk-xxx"环境变量echo 'DEEPSEEK_API_KEY=sk-xxx' >> ~/.hermes/.env写入配置文件支持供应商:DeepSeek、OpenAI、Anthropic (Claude)、Google Gemini、xAI Grok、Kimi、GLM、OpenRouter。运行 hermes login 登录 OAuth 供应商。
🧩核心概念
理解这 5 个核心概念,你就掌握了 Hermes 的运作方式。
💬第一次对话
启动交互式对话
hermes chat最常用 · 进入交互hermes chat -m deepseek-v4-pro指定模型hermes -z "帮我看看当前目录"单次任务 · 不交互hermes chat --resume恢复上次会话对话中能做什么
🗣️ 你说:"帮我分析一下这个项目的代码结构"
🤖 Hermes 会:调用 terminal 跑 ls/find → 用 read_file 读关键文件 → 调用 execute_code 统计 → 输出分析报告
🗣️ 你说:"查一下今天 Apple 的股价"
🤖 Hermes 会:调用 web_search 搜索 → 用 browser 抓取数据 → 整理成表格回复你
对话中的快捷命令
| 命令 | 作用 |
|---|---|
/reset | 重置会话(清空上下文,重读 SOUL.md 和记忆) |
/clear | 清空当前对话历史 |
/model | 切换当前会话的模型 |
/tools | 查看当前可用的工具 |
/skills | 查看已加载的技能 |
/exit 或 Ctrl+D | 退出对话 |
新手建议:第一次先试试简单任务——"列出当前目录"、"读一下 README.md"、"帮我写个 Hello World"。熟悉后再挑战复杂任务。
⚙️配置文件详解
Hermes 的所有配置都集中在 ~/.hermes/config.yaml。理解这个文件,你就能完全掌控你的 Agent。
目录结构
关键配置项
config.yaml# 默认模型
model:
default: deepseek-v4-pro
provider: deepseek
# 启用的工具集
toolsets:
- hermes-cli
- terminal
- file
# Agent 行为
agent:
max_turns: 150 # 单次任务最大轮次
reasoning_effort: medium # 推理强度
# 记忆系统
memory:
memory_enabled: true
user_profile_enabled: true
memory_char_limit: 2200 # 记忆最大字符数
不要手动改 config.yaml,用 hermes config 命令交互式修改更安全。改完后运行 hermes chat 时新配置自动生效。
🧠模型与供应商
Hermes 不绑定单一模型,你可以自由切换。不同任务适合不同模型。
切换模型
hermes model交互式选择hermes chat -m gpt-5直接指定hermes fallback add deepseek-v4-pro配置备用模型主流模型推荐
点击标签切换模型,查看能力雷达:能力 / 性价比 / 速度 / 中文 / 上下文。
DeepSeek V4 Pro · 性价比之王
适合:日常任务、写代码、中文场景。¥1/百万 token,便宜量又足。
GPT-5 · 综合能力旗舰
适合:复杂推理、重要决策。价格高但最稳。
Claude Opus 4 · 编码与长文本
适合:写代码、长文档分析、深度推理。
Gemini 2.5 · 多模态免费额度
适合:图像理解、超长文档。1M 上下文 + 免费额度。
Grok-4 · 实时信息
适合:新闻、社交、实时信息查询。
配置备用模型(Fallback)
当主模型不可用时,Hermes 会自动按顺序尝试备用模型,保证任务不中断。用 hermes fallback list 查看当前链路。
🛠️工具系统
工具是 Hermes 最强大的能力来源。你可以按需启用或禁用工具集。
查看与管理工具
在 config.yaml 的 toolsets 里按需启用工具集,hermes tools 交互式查看。
hermes tools交互式管理(需在终端运行)核心工具矩阵
安全提示:terminal 和 file 工具有完整系统权限。生产环境建议开启 write_approval: true,让危险操作需人工确认。
能力雷达 · 工具 vs 纯聊天
纯聊天的 AI 只能说话;装上工具的 Hermes 能动手干活。六轴能力对比:
滚动到此区域,雷达图会从中心动态展开。
📚技能系统 Skills
技能是打包好的"专家知识"。安装一个技能,Agent 在相关领域立刻变专业。
安装与管理技能
hermes skills browse浏览技能市场hermes skills search docker搜索技能hermes skills install git安装技能hermes skills list查看已安装技能如何工作
创建自己的技能:完成一个复杂任务后,告诉 Hermes"把这个流程保存成技能",下次类似任务就能复用。
💾记忆系统
记忆让 Hermes 跨会话"记住"你。这是它越用越好用的关键。
两类记忆文件
📘 MEMORY.md — Agent 的笔记本
记录 Agent 自己学到的东西:你的项目结构、工具的怪癖、踩过的坑。用 § 符号分隔条目。
📗 USER.md — 对你的了解
记录关于你的信息:你的偏好、工作习惯、沟通风格。让回复更个性化。
记忆如何运作
管理记忆
hermes memory status查看记忆状态在对话中,Agent 会自动调用 memory 工具——add 添加 / replace 替换 / remove 删除。你也可以直接用自然语言:
“记住我喜欢简洁的回复”自然语言记忆“忘掉关于 XX 的记忆”自然语言删除隐私:记忆文件只存在本地 ~/.hermes/memories/。你可以随时手动编辑或删除。Hermes 还支持外部记忆供应商(mem0、honcho 等)。
🎭多身份 Profile 系统
Profile 让你拥有多个完全独立的 Hermes 实例——不同的灵魂、不同的记忆、不同的技能、甚至不同的模型。
典型场景
default 你的通用助理——日常问答、写代码
finance 财务专家——拼多多数据分析、报表
biz-analyst 商业分析师——市场研究、竞品分析
ceo-aide CEO 助理——日程、邮件、决策支持
Profile 管理
hermes profile list列出所有身份hermes profile create my-assistant创建新身份hermes profile use finance切换默认身份hermes --profile finance chat单次使用某身份每个 Profile 独立拥有
最佳实践:为每个不同用途创建独立 Profile。比如工作用一个、生活用一个、特定项目用一个。互不干扰,各自进化。
🕯️灵魂档案 SOUL.md
SOUL.md 是 Hermes 的"灵魂"——它定义了 Agent 的人格、说话风格、专业领域、行为边界。这是让通用 AI 变成"你的专属助理"的关键。
SOUL.md 的结构
如何编辑
nano ~/.hermes/SOUL.md编辑默认身份nano ~/.hermes/profiles/finance/SOUL.md编辑 finance 身份创意玩法:你可以把 SOUL.md 写成"资深股票顾问"、"冷酷的代码审查员"、"温暖的心理倾听者"——同一个 Hermes,千变万化的人格。
🌐网关与消息平台
网关让 Hermes 变成一个 7×24 在线的消息助理——你在微信、Telegram、Discord 上发消息,它就响应。
启动网关
hermes gateway start后台启动hermes gateway status查看状态hermes gateway run前台运行 · 看实时日志hermes gateway stop停止支持的平台
| 平台 | 配置命令 | 说明 |
|---|---|---|
| 微信 | hermes weixin | 通过 iLink 接入 |
| Telegram | 配置 Bot Token | 最稳定 |
| Discord | 配置 Bot Token | 支持频道/私聊 |
| Slack | hermes slack | 工作场景 |
hermes whatsapp | 需扫码 |
微信接入示例
在 ~/.hermes/.env 中配置以下变量:
WEIXIN_ACCOUNT_ID · WEIXIN_TOKEN · WEIXIN_BASE_URL三项核心配置pairing(需配对才能私聊)或 open(所有人可用)。常见问题:网关启动失败提示 "token already in use"?说明有僵尸进程。用 hermes gateway stop 停掉旧的,或 kill -9 <PID> 强制清理后再启动。
🚀进阶能力:定时·安全·调度
掌握以下三个功能,Hermes 从「工具」升级为自动化平台。
⏰ Cron 定时任务
让 Hermes 每天自动执行任务——比如早上 8 点下载报表、每 3 天分析一次数据、每周一生成周报。
hermes cron list列出所有定时任务hermes cron add --cron "0 8 * * *" --prompt "下载昨日数据"添加每日 8:00 任务🔒 Write Approval 安全审批
启动 Hermes 后,任何写入/删除操作都会先弹窗让你确认。生产环境必开。
hermes config set write_approval true开启写入审批write_file / terminal rm 都会先问你,杜绝误删。配合 AgentGuard 扫描第三方代码,双重保险。🔗 Delegation 子 Agent 调度
让 Hermes 把子任务派发给专业 Agent——写代码交给 Codex,审查代码交给 Claude Code,分析数据自己来。一个 Master Agent 调多个专业子 Agent。
hermes config set delegation.enabled true开启子 Agent 调度📋命令速查表
核心命令
hermes chat交互式对话hermes -z "任务"单次任务hermes status查看状态hermes doctor诊断环境hermes setup配置向导hermes version版本信息模型与配置
hermes model切换模型hermes config编辑配置hermes login登录供应商hermes fallback备用模型hermes tools管理工具hermes memory记忆管理身份与技能
hermes profile list列出身份hermes profile use <n>切换身份hermes profile create创建身份hermes skills list已装技能hermes skills install安装技能hermes skills search搜索技能网关与会话
hermes gateway start启动网关hermes gateway status网关状态hermes gateway stop停止网关hermes sessions list历史会话hermes cron list定时任务hermes logs查看日志对话内快捷命令
| 命令 | 作用 |
|---|---|
/reset | 重置会话,重读 SOUL.md 和记忆 |
/clear | 清空对话历史 |
/model <名> | 切换模型 |
/tools | 查看工具 |
/skills | 查看技能 |
/help | 查看所有命令 |
Ctrl+C | 中断当前任务 |
Ctrl+D | 退出对话 |
🔧故障排查
常见问题与解决方案
❌ 网关启动失败:"token already in use"
原因:有僵尸网关进程占用资源。解决:依次执行——
hermes gateway stop停掉旧网关kill -9 $(pgrep -f "gateway run")强制清理僵尸进程rm ~/.hermes/gateway.*清理状态文件hermes gateway start重新启动❌ 模型调用失败:401 / API Key 错误
解决:
hermes status | grep -i key检查 key 是否配置hermes login重新设置❌ Agent 不调用工具,只会聊天
原因:工具集未启用,或模型不支持工具调用。
解决:检查 config.yaml 的 toolsets 是否包含需要的工具集,确保用的是支持 function calling 的模型。
❌ 记忆没生效
原因:记忆在会话中是冻结的,需要新会话才注入。
解决:在对话中输入 /reset,或重启 hermes chat。
诊断工具
hermes doctor全面诊断环境hermes status查看完整状态hermes prompt-size提示词大小拆解hermes logs查看日志hermes debug导出诊断信息(求助用)🎯实战案例
Hermes 在这些场景里能真正帮你省时间。点击 智能终端 试试同类任务。
💬真实对话实录
这是 Hermes 代替你操作拼多多后台的真实对话。你只问了一句话,它完成了登录、下载、解析、写报告四步——全自动。
✓ browser_click 进入「发货管理 → 订单查询」
✓ browser_click 「批量导出」→「对账报表」✅ 下载成功
✓ write_file 已保存至 ~/pdd/reports/report_0612.json
• GMV:¥48,320(环比 ↑3.2%)
• 退款率:3.5%(高于基线 2.8%,⚠️ 中等异常)
• 异常关联 SKU:A-233(近 7 天退款集中)
🟡 建议关注 SKU A-233 的质量问题。已生成完整分析报告在 ~/pdd/reports/。
⏱️时间就是金钱:Hermes 能省多少?
同样的任务,手工操作 vs Hermes 自动化。滚动到此区域,柱状图动态展开。
👥谁来用?怎么用?
不同的角色用 Hermes 解决不同的问题。找找你的场景——
⚖️Hermes vs OpenClaw vs Codex
三个主流 AI Agent 框架,底层理念完全不同。选对工具,事半功倍。
| 能力维度 | ⚡ Hermes | 🔷 OpenClaw | 🟣 Codex |
|---|---|---|---|
| 开源 & 费用 | 免费开源 | 免费开源 | 付费订阅 |
| 模型自由 | 任意厂商切换 | 任意厂商切换 | 仅 OpenAI |
| 本地执行 | ✓ 本地/容器 | ✓ 本地 | 云沙箱为主 |
| 数据隐私 | 100% 本地 | 100% 本地 | 上传 OpenAI |
| 人格定制 | SOUL.md 任意角色 | 有限 | 有限 |
| 多身份管理 | Profile 系统 | ✗ | ✗ |
| 跨会话记忆 | MEMORY/USER.md | 有限 | ✗ |
| 消息平台接入 | 微信/TG/Discord/Slack... | 有限 | ✗ |
| 技能市场 | 100+ 可安装 | ClawHub 生态 | 有限 |
| 子 Agent 调度 | 可调度 Codex/Claude | 可调度 | 原生 |
| 桌面控制 | macOS 原生 | 有限 | ✗ |
| 安装复杂度 | pip 一条命令 | 中等 | 需注册 OpenAI |
| 推荐场景 | 全场景·个人到企业 | 社区·多技能联动 | 纯代码·OpenAI 用户 |
实际使用体验对比
📊降本增效:企业 & 个人的真实回报
不说虚的,用数字说话。以下数据基于日均使用 1-2 小时的保守估算。
🏢 企业级降本
典型企业场景量化
| 岗位 | 每日重复任务 | 手工耗时 | Hermes 耗时 | 年省时 |
|---|---|---|---|---|
| 运营专员 | 数据报表下载 + 分析 | 45 分钟 | 3 分钟 | 175 小时 |
| 初级开发 | 代码审查 + 文档生成 | 2 小时 | 20 分钟 | 400 小时 |
| 数据分析师 | 数据清洗 + 报表产出 | 3 小时 | 25 分钟 | 620 小时 |
| 产品经理 | 竞品调研 + 需求文档 | 1.5 小时 | 15 分钟 | 300 小时 |
| 客服组长 | 工单分类 + 话术建议 | 1 小时 | 10 分钟 | 200 小时 |
| 5 人团队合计 | 8 小时/天 | 1.2 小时/天 | 1,695 小时/年 | |
👤 个人用户降本
🤝 Hermes 能为团队带来什么?
- 知识留存:老员工的经验写进 SOUL.md 和 skills,新人用 Hermes 直接上手,告别"只有他才知道怎么弄"
- 流程标准化:把"每次手动操作"变成"一键让 Agent 执行",出错率从 5% 降到接近 0
- 多角色并行:一个 Terminal 开 3 个 Profile——一个写代码、一个分析报表、一个整理文档——互不干扰
- 零供应商锁定:模型可随时切换,不依赖任何一家 AI 公司。DeepSeek 涨价?切 GPT。GPT 不可用?切 Gemini
❓常见问题 FAQ
点击问题展开查看答案。
write_approval 后,危险操作需人工确认。computer_use(桌面控制)目前仅限 macOS。Windows 下 terminal 走 bash(git-bash)。replace 合并或 remove 删除旧条目。外部供应商(mem0/honcho)提供更大容量。SOUL.md 定义人格;② 多用 memory 让它记住偏好;③ 安装相关 skills 注入领域知识。越用越懂你。✅上手检查清单
勾选你已完成的项目,进度条实时更新。全选你就是合格的 Hermes 玩家了!
🗺️推荐学习路线
这是一条经过实践验证的学习路径。点击每个任务,直接跳转到对应章节。
恭喜你读完手册!现在你已经掌握了 Hermes 的全貌。最好的学习方式是动手实践——打开终端,输入 hermes chat,开始你的 AI 助理之旅。每个任务都能点击跳转,随时回查。
📖术语表
| 术语 | 解释 |
|---|---|
| Agent | 智能体,能自主调用工具完成任务的 AI |
| Tool / 工具 | Agent 可以调用的能力,如终端、文件、浏览器 |
| Toolset / 工具集 | 一组相关工具的集合 |
| Skill / 技能 | 预写的领域专家知识包 |
| Memory / 记忆 | 跨会话持久化的信息 |
| Profile / 身份 | 独立的 Hermes 实例配置 |
| SOUL.md | 定义 Agent 人格的灵魂档案 |
| Gateway / 网关 | 连接消息平台的服务 |
| Provider / 供应商 | 提供 AI 模型的服务商 |
| Session / 会话 | 一次对话的完整上下文 |
| System Prompt | 系统提示词,定义 Agent 行为 |
| Function Calling | 模型调用工具的能力 |
| HERMES_HOME | Hermes 家目录的环境变量 |
| Prefix Cache | 提示词前缀缓存,加速响应 |