Hermes Agent完整搭建指南:零代码部署你的私人AI员工

Hermes Agent是一款可自主运行、持续记忆并学习技能的开源AI智能体,部署成本低至每月6美元起。
Hermes Agent是Naus Research开源的AI智能体框架,与普通聊天工具的核心区别在于三点:持续运行于云端、跨会话持久记忆、自主编写可复用技能。教程完整演示了从Hostinger云服务器一键部署、接入OpenRouter模型(实测400万token仅花费0.13美元)、配置Telegram机器人,到设置定时任务的全流程。凭借提示缓存机制,日常使用成本极低,5美元可支撑数周使用。进阶功能包括子Agent并行处理、多平台通信渠道和桌面客户端悬浮输入条。整体方案的核心价值在于:用户只需描述想要的结果,Agent自行构建实现机制并长期自主运转。
什么是Hermes Agent:与普通聊天机器人的本质区别
Hermes Agent是Naus Research开源的AI智能体框架,采用MIT许可证,代码完全公开可审查。它和ChatGPT这类对话工具之间存在三个本质差异:持续运行、跨会话记忆、自主学习技能。
普通聊天窗口只在你打开时工作,关掉就停。Hermes部署在云端服务器上,可以在凌晨四点自动执行任务、主动向你的手机推送消息。它的记忆不会随会话结束而消失——你今天告诉它的写作偏好,下周新开对话依然有效。更关键的是,当它摸索出一套解决复杂任务的流程后,会把步骤写成可复用的"技能",供以后直接调用。
费用结构也与订阅制SaaS截然不同:软件本身免费,你只需为AI模型的token消耗和一台约6美元/月的云服务器付费。

搭建环境:云服务器一键部署
选择服务器与模板
教程选用Hostinger的KVM1方案,原因是它提供了Hermes的一键Docker模板,跳过了手动配置终端命令的步骤。KVM1是最小规格,单个Agent日常对话完全够用;如果后续需要大量网页浏览任务,可随时升级,无需重装。
付费时注意取消勾选预选的"Ready-to-use AI"附加项——那是另一套AI服务的充值,与我们的方案重叠。选择12个月及以上套餐才能激活优惠码。
安全隔离:为什么选择云端部署
这里有一个值得重视的安全考量:Hermes拥有写文件、执行代码、浏览网页的能力,而网页内容可能含有针对AI的"提示注入"攻击——恶意指令伪装成普通内容,试图劫持Agent的行为。
将Agent跑在一台专用云服务器上,意味着即使遭到攻击,受影响的范围也仅限于那台空白机器,而非你的本地文档和文件。这是选择云端部署而非本机运行的核心理由之一。
配置大脑:连接OpenRouter模型
为什么选择OpenRouter
OpenRouter是一个模型聚合平台,一个账号可以访问数百个来自不同厂商的AI模型,按实际token用量计费。推荐的起始模型是DeepSeek V4 Flash:价格低、响应快、工具调用能力强——而"使用工具"正是Agent的核心工作模式。
实测数据很有说服力:制作整期教程视频期间,105次请求、近400万token的总消耗,费用仅为0.13美元。低成本的关键在于缓存机制——每次请求中不变的部分(系统提示、工具列表、记忆)会被服务商识别并以极低价格复读,约75%的token走的是缓存通道。5美元的初始充值,按此速率可支撑数千条消息,足够跑几周。
设置API Key与消费限额
在OpenRouter后台创建API Key后,建议立即设置消费上限(例如每周$10),防止意外超支。将Key保存到密码管理器,随后在Hermes控制台的Keys页面填入,再到Models页面切换为目标模型即可。
打通通信:Telegram Bot三分钟接入
快速完成手机接入
Hermes支持20余个通信平台,Telegram因其内置QR码快速授权流程而成为入门首选。整个配置步骤如下:
- 打开Hermes控制台的Chat页面
- 点击"Create with QR"
- 手机扫码并命名Bot
- 桌面端点击"Save and Restart"
重启完成后,Telegram侧会显示"Connected",手机端发送任意消息即可与Agent对话。首次收到"无Home Channel"提示时,点击/set home链接——这是Agent主动推送消息的默认目标频道。
扫码授权的账号会自动加入白名单,其他人找到这个Bot后发消息不会得到任何回应,保护了私密性。多台设备上的Telegram客户端无需额外配置,共享同一个Agent和同一份记忆。

安装桌面应用:一个Agent多个入口
Hermes提供Mac/Windows桌面客户端。安装后不要让它在本地启动新Agent,而是在设置页面选择"Remote Gateway",粘贴服务器地址并用之前的账号密码登录——这样桌面App和手机Telegram连接的是同一个Agent、同一份记忆。
桌面端有一个实用功能:按下Command+Shift+H(Mac)可将界面收起为悬浮输入条,叠加在任何当前窗口上方,问完问题后自动淡出,不打断工作流。支持语音输入、语音朗读回复,甚至可以设置唤醒词,彻底解放双手。

记忆与技能:让Agent真正记住你
跨会话持久记忆
这是区分Agent与普通聊天窗口的关键特性。测试方法很直观:在一个会话里告诉Agent"我的文章风格偏好短句,最多三段,不要标题和列表",它会即时将这条偏好写入记忆。关闭窗口,重新开一个全新会话,让它写一篇完全不同主题的文章——它依然遵循那条偏好。
因为记忆是跨会话持久化的,不是上下文临时存储。记忆文件、技能文件和描述Agent身份的sold-out.md文件都存储在你自己的服务器上,不在第三方账号里。
自主编写可复用技能
Skills页面展示了Agent已掌握或自学的所有技能。每个技能都是可读的纯文本流程,可以点开查看内部逻辑。Skills Hub提供社区共享技能库,支持按类别搜索,例如Google Workspace集成已内置,无需另行安装。
定时任务:让Agent主动替你工作
定时任务(Cron)是最能体现Agent价值的功能。只需用自然语言描述一次需求,Agent会自动完成所有配置。例如发送这样一条消息:
监控YouTube上的AI生产力趋势,自己设计一个检查方案,记录已推送过的内容,每隔几小时运行一次,只在发现新内容时通知我。
Agent会自行安装依赖、搜索视频、编写技能脚本、创建定时任务,并在首次运行后发来报告。在Schedule Jobs页面可以看到任务的运行频率、下次执行时间和使用的prompt,支持手动触发或暂停。
这个闭环的意义在于:你描述了一个结果,Agent自己构建了实现这个结果的机制,之后不再需要你介入。

进阶能力:子Agent并行与多平台扩展
对于复杂任务,Hermes支持拆分为多个子Agent并行执行。例如规划一次旅行时,可以同时启动四个子Agent分别研究住宿、餐厅、周边游和交通,主Agent汇总后返回一份完整行程,耗时远短于串行处理。
通信渠道方面,Desktop App的Messaging或Web控制台的Channels页面支持添加Discord、Slack、WhatsApp、Email等平台,所有渠道共享同一Agent和记忆。桌面App还支持多配置文件,可以将工作Agent和个人Agent完全隔离。
从OpenClaw迁移的用户可以直接向Agent说"我想导入我的OpenClaw配置",它会引导完成整个迁移流程。
成本与模型切换策略
模型并非固定不变。日常任务继续用DeepSeek V4 Flash保持低成本,遇到需要更强推理能力的任务时,可以在模型选择器里临时切换到Claude或GPT系列。在Telegram中通过/model命令即可完成切换。
服务器费用(约$6/月)是固定开销,模型费用才是需要关注的变量。OpenRouter的Activity页面可以清晰查看每次请求的token消耗和花费,配合API Key的消费上限,预算完全可控。
Naus Research也提供名为Nowse Portal的订阅方案,约$20/月,无需管理API Key,适合不想处理账单细节的用户。
相关推荐

Treebar:Mac菜单栏管理Git工作树,一眼掌控所有AI编程Agent
Treebar是一款macOS菜单栏应用,专为AI编程多工作树场景设计。它将所有Git Worktree状态统一展示在MacBook刘海区域,让开发者实时监控Codex等AI Agent的工作进度,无需切换终端即可掌握全局。即将开源核心代码。

苹果确认Hide My Email域名永久保留,用户隐私获长期保障
苹果公司公开承诺iCloud+ Hide My Email功能使用的@icloud.com域名将永久保留,不会弃用或迁移。本文解析域名稳定性对邮箱转发隐私工具的关键意义,以及对用户账户安全的底层保障。

终端正在拖慢你:多任务时代的效率反思
终端是程序员的信仰工具,但在多任务并行的现代开发场景中,它的线性设计正在成为效率瓶颈。本文分析终端的心智负担模型为何在第六个任务时崩溃,以及开发者该如何重新评估工具选择。