Hermes Agent 研报总结
核心定位与价值
Hermes Agent 是 Nous Research 开源的可执行型 AI Agent 框架,核心价值在于将大模型的语言理解能力扩展为真实世界中的任务执行能力。它代表了 AI 从“问答”走向“行动”的关键范式,推动 AI 产品形态进入第三次跃迁:从 Chatbot 到 Copilot,再到 Agent。Hermes Agent 能够自主拆解任务、调用工具、执行验证并交付结果,例如分析仓库结构、修改代码、跑测试、整理文档并提交 PR。
核心差异化能力
- Skill 系统:解决过的问题沉淀为可复用技能,越用越聪明。社区已建立 awesome-hermes-agent 仓库聚合共享技能,上线 2 周即破 1.2K Stars。
- 持久记忆:跨会话记住用户身份、偏好、环境信息,MEMORY.md 可直接编辑/删除记忆条目。
- 多平台网关:同一套 Agent 跑在 Telegram、Discord、Slack、飞书、微信等 10+ 平台。
- 模型无关:兼容 200+ 模型(OpenAI/Anthropic/Gemini/MiniMax/月之暗面 Kimi/智谱 GLM 等),随时切换,无需改代码,无云端锁定。
- Profile 隔离:多实例隔离,不同工作场景用不同的 profile。
自学习循环
Hermes Agent 具备独特的自学习循环能力,包含四步闭环:
- 感知任务:解析用户指令,决定调用哪些工具。
- 执行行动:调用 40+ 工具完成任务,记录上下文。
- 沉淀技能:把成功路径固化为可复用技能。
- 更新记忆:FTS5 写入 MEMORY.md,下次直接调取。
解数咨询× D17 品牌研究报告的核心判断:传统 Agent 框架(LangChain 手工编排、AutoGPT 向量记忆)都是“一次性执行”,Hermes 的差异化是“自学习循环”,让 Agent 越用越聪明。
安装与配置
提供 pip 安装、官方一键脚本、Docker 部署等多种安装方式,并支持健康检查、故障修复和关键路径速查。
推荐的 Skills
Hermes 目前有 107+ 个技能、40+ 内置工具,涵盖开发效率、内容创作、研究与信息收集、自动化与运维、媒体与生活等多个类别。
Context Files 上下文文件
支持多种文件类型,并提供 AGENTS.md 和 SOUL.md 最佳实践,用于定义项目约定、审查重点、沟通风格、决策偏好和底线原则。支持在对话中使用 @ 引用文件、文件夹、git diff 和 URL。
日常使用最佳实践
包括启动与对话模式、工具集管理、多模型切换策略等。
Memory(记忆)系统
采用三层记忆架构:
- 会话记忆(短期):当前对话上下文,滚动窗口管理。
- 持久记忆(长期):跨会话用户画像,偏好、习惯、环境,MEMORY.md 持久化。
- Skill 记忆(程序性):自动提炼反复做的事,生成可复用 Skill。
提供记忆管理命令和最佳用法建议。
Session(会话)管理
支持会话列表、浏览、导出、重命名、删除和搜索等功能。
上下文压缩机制
采用压缩不截断、渐进式披露、预算作为一等概念、保留叙事连续性等策略,并支持 Prompt Caching 和手动压缩配置。
Cron 定时任务
支持创建、管理、运行和删除定时任务,并提供实用场景和高级用法(YAML 配置)。
Profile(配置文件)系统
同一台机器上运行多个完全独立的 Hermes 实例,每个有自己配置、技能、记忆、会话、API 密钥。
使用场景包括隔离不同工作场景、多租户、测试环境等。
提供操作命令和最佳实践建议。
Gateway(消息平台网关)
支持 Telegram、Discord、Slack、飞书、微信等 10+ 平台,并提供启动网关、网关最佳实践和配置建议。
Security(安全)最佳实践
包括命令审批机制、密钥泄露保护、网站屏蔽、工具级隔离等。
Kanban 多 Agent 协作看板
基于 SQLite 的持久化任务看板,支持创建任务卡片、分配 Profile、设置任务依赖关系、跟踪状态、多个 Agent 并行工作、完整审计日志。
使用场景包括需要多个 specialist 工作、跨重启存活、用户可能中途介入、多个子任务可以并行执行、需要审查/迭代循环、审计追踪很重要的情况。
提供 Orchestrator(编排者)和 Worker(执行者)工作模式、Dashboard 看面板、常用命令和常见模式。
高级技巧与隐藏用法
包括子代理(Delegate Task)、生成多个独立 Agent、MCP(Model Context Protocol)集成、Webhook 事件驱动、上下文压缩、实用技巧等。
生产环境部署(VPS / Docker)
提供 Docker 容器部署(推荐)和 systemd 服务方案,并支持 Redis 调优、外部监控和防火墙配置。
推荐配置清单
提供 ~/.hermes/config.yaml 推荐配置示例。
常见问题与避坑指南
提供 10 个常见问题和解决方案。
工作流示例
提供 4 个工作流示例:用 Hermes 写技术文章、用 Hermes 做代码审查、定时日报自动化、多 Agent 协作完成复杂项目。
总结与行动建议
核心结论:“技能自动沉淀+持久化记忆+可审计性的组合在 2026 年仍是 Hermes 的独有能⼒,构成 1-2 年的窗口期优势。”
五条实在建议:
- 用 Profile 把工作场景隔开——内容创作、开发、研究各搞一个。
- 解决过一次的问题,保存为 Skill——越早养成越省事。
- 记忆系统开着就好—— Agent 会自己学习,但记得定期审查。
- Cron 定时任务值得认真搞—— 7×24 小时在线是核心优势。
- 安全配置别跳过—— approvals.mode: smart + redact_secrets 够用。
三个立即执行的动作:
- 48 小时内体验自学习循环:单行 curl 安装,3 分钟搞定,验证“自我进化”是否真实存在。
- 本周内对比 Agent 迁移成本:你的 Agent 锁定在哪个模型?哪个云平台?Hermes 模型无关,无云端锁定。
- 30 天内关注 Skill Marketplace:早期贡献者更容易建立影响力,垂直行业 Agent 现在布局更有价值。
版本:v2.1+ |适⽤对象:开发者、AI⼯程师、DevOps运维、技术管理者核⼼定位:会⾃我进化的开源AI Agent框架——从"会说"⾛向"会做"⼀句话判断:Hermes代表AI从"问答"⾛向"⾏动"的关键范式。
⼀、Hermes Agent是什么
1.1定义与核⼼定位
Hermes Agent是Nous Research开源的AI Agent框架。它不是⼀个聊天机器⼈——它是⼀个能在你的终端、消息平台(Telegram、Discord、Slack、⻜书、微信等10+平台)和IDE⾥⾃主运⾏的执⾏代理。
根据清华⼤学清新研究团队2026年4⽉发布的《Hermes Agent深度研究报告》的核⼼判断:
Hermes Agent是"可执⾏型AI Agent"的代表形态。其核⼼价值在于把⼤模型的语⾔理解能⼒扩展为真实世界中的任务执⾏能⼒。未来AI产品的关键分野,不是"谁更会回答",⽽是"谁更能完成任务"。
AI产品的形态正在经历第三次跃迁:
第⼀次:Chatbot ——回答问题、⽣成内容,⽌步于⽂本第⼆次:Copilot ——嵌⼊单⼀⼯作流,局部建议,不承担完整任务链第三次:Agent ——接收⽬标,⾃主拆解任务,调⽤⼯具,执⾏验证,交付结果
Hermes站的就是第三阶段。它能分析整个仓库结构、读懂代码逻辑、修改多个⽂件、跑测试、整理⽂档,最后给你⼀个可以直接合并的PR。
1.2核⼼差异化能⼒
核⼼差异化五要素:
1.Skill(技能)系统——解决过的问题沉淀为可复⽤技能,越⽤越聪明。社区已建⽴awesome-hermes-agent仓库聚合共享技能,上线2周即破1.2K Stars。
2.持久记忆——跨会话记住你是谁、你的偏好、环境信息。MEMORY.md直接可读,⽤⼾可编辑/删除记忆条⽬。
3.多平台⽹关——同⼀套Agent跑在Telegram、Discord、Slack、⻜书、微信等10+平台上。
4.模型⽆关——兼容200+模型(OpenAI/Anthropic/Gemini/MiniMax/⽉之暗⾯Kimi/智谱GLM等),随时切换,⽆需改代码,⽆云端锁定。
5.Profile隔离——多实例隔离,不同⼯作场景⽤不同的profile。
1.3⾃学习循环:四步闭环
这是Hermes 2026年唯⼀具备的能⼒,也是其护城河所在:
STEP 1:感知任务——解析⽤⼾指令,决定调⽤哪些⼯具STEP 2:执⾏⾏动——调⽤40+⼯具完成任务,记录上下⽂STEP 3:沉淀技能——把成功路径固化为可复⽤技能STEP 4:更新记忆—— FTS5写⼊MEMORY.md,下次直接调取
解数咨询× D17品牌研究报告的核⼼判断:传统Agent框架(LangChain⼿⼯编排、AutoGPT向量记忆)都是"⼀次性执⾏",Hermes的差异化是"⾃学习循环"——感知任务→执⾏⾏动→沉淀技能→更新记忆,四步循环让Agent越⽤越聪明。
⼆、安装与初始配置
2.2快速安装(三种⽅式)
⽅式⼀:pip安装(快速体验)
pip install hermes-agenthermes setup
⽅式⼆:官⽅⼀键脚本(推荐)
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bashhermes setup
docker pull nousresearch/hermes-agentdocker run -d --name hermes -v ~/.hermes:/root/.hermes -v /opt/data:/opt/data -eDASHSCOPE_API_KEY=your_key -e ANTHROPIC_API_KEY=your_key nousresearch/hermes-agent
⽅式四:从源码构建(深度定制)
gitclone https://github.com/NousResearch/hermes-agent.gitcdhermes-agentpip install -e .
2.3健康检查与故障修复
hermes doctor --fix
2.4关键路径速查
三、推荐的Skills(技能)
Hermes⽬前有107+个技能、40+内置⼯具。
3.1开发效率类
3.2内容创作类
3.3研究与信息收集类
3.4⾃动化与运维类
3.5媒体与⽣活类
四、Context Files上下⽂⽂件
4.1⽀持的⽂件
4.2 AGENTS.md最佳实践
#项目约定
##技术栈
-测试框架:pytest,不用unittest-代码风格:4空格缩进,行宽88-API版本:当前使用v2,路径/api/v2/-数据库:PostgreSQL 15+-包管理:uv,不用pip-提交信息:Conventional Commits格式
##架构约束
-所有API路由必须带版本前缀-数据库迁移使用Alembic-异步任务使用Celery + Redis
##审查重点
-安全检查:SQL注入、XSS、CSRF-性能检查:N+1查询、内存泄漏-忽略:格式问题(Black自动处理)
4.3 SOUL.md最佳实践
# SOUL
##沟通风格
-直接,不绕弯子,用中文-技术讨论用英文术语,解释用中文
##决策偏好
-遇到不确定的事情:先问我,不要自己猜-技术选型:优先成熟方案,不追新-代码审查:重点看安全和性能,格式问题忽略
##底线原则
-如果要求不合理,直接拒绝并说明原因-不执行删除生产数据的命令,除非双重确认-涉及密钥的操作必须脱敏处理
4.4 Context References
在对话中⽤@引⽤⽂件、⽂件夹、git diff和URL:
@AGENTS.md帮我看看这个架构设计是否符合项⽬约定@src/auth/审查认证模块的代码@git diff看看这次变更的影响范围
4.5⽂件⼤⼩限制
五、⽇常使⽤最佳实践
5.1启动与对话模式
#交互式对话(默认模式)hermes#单次查询hermes chat -q"帮我分析这段代码的问题"#指定模型hermes chat -m anthropic/claude-sonnet-4#切换到国产模型
hermes model use kimi-k2#预加载特定技能hermes -s systematic-debugging -s writing-plans#恢复最近会话hermes --continue#恢复指定会话hermes --resume 20260526_143052_abc123
5.3⼯具集管理
#交互式管理hermes tools
#启用/禁用工具集hermes toolsenable webhermes toolsdisable browser
40+内置⼯具能⼒图谱:
5.4多模型切换策略
#交互式选择hermes model
#命令行直接设置hermes configset model.default anthropic/claude-sonnet-4
#对话内临时切换/model anthropic/claude-sonnet-4
六、Memory(记忆)系统
6.1三层记忆架构
第⼀层:会话记忆(短期)——当前对话上下⽂,滚动窗⼝管理,关了对话就没了第⼆层:持久记忆(⻓期)——跨会话⽤⼾画像,偏好、习惯、环境,MEMORY.md持久化第三层:Skill记忆(程序性)——⾃动提炼反复做的事,⽣成可复⽤SkillHoncho⽤⼾建模——动态画像,每次交互都在更新"你是谁"
与全量加载记忆⽅案的对⽐:
6.2⾃动记忆的内容
⽤⼾画像:名字、⻆⾊、偏好、沟通⻛格环境信息:操作系统、已安装⼯具、项⽬结构⼯具特性:某个⼯具的坑、特殊⽤法
约定和规范:项⽬约定、API quirks、⼯作流偏好
6.3记忆管理命令
hermes memory statushermes configset memory.memory_enabled false
6.4记忆的最佳⽤法
1.主动纠正——当Agent犯错时,直接说「记住,以后别这样」2.环境发现—— Agent⾃动记录项⽬约定、⽬录结构3.偏好沉淀——沟通⻛格、代码⻛格、⼯具偏好⾃动学习4.别存临时信息——任务进度、PR号、session状态不要存
七、Session(会话)管理
hermes sessions listhermes sessions browsehermes sessionsexport~/my-sessions.jsonlhermes sessions rename "我的项目名称"hermes sessions prune --older-than 30
会话搜索:
session_search(query="auth refactor", limit=3)session_search(session_id="20260526_143052_abc123", around_message_id=42)
⼋、上下⽂压缩机制
8.2压缩策略
压缩,不截断——理解对话结构,保留语义连贯性渐进式披露—— Skills、⼯具、上下⽂⽂件都有元数据层,按需加载预算作为⼀等概念——迭代次数、token数、时间管理保留叙事连续性——压缩后仍然保持故事线完整
8.3 Prompt Caching
利⽤Anthropic prompt caching:
1.保留最近的真实⽤⼾消息2.压缩中间的⼯具调⽤历史3.重新注⼊初始上下⽂
8.4⼿动压缩与配置
/compresshermes configset compression.enabled truehermes configset compression.threshold 0.50hermes configset compression.target_ratio 0.20
九、Cron定时任务
9.1创建定时任务
hermes cron create"30m"hermes cron create"0 9 * * *"hermes cron create"every monday 9am"
9.2管理任务
hermes cron listhermes cron edit hermes cron pause hermes cron resume hermes cron run hermes cron remove
9.3实⽤场景
cron触发→ browser抓取→ vision校验→ memory对比→ Slack推送每天9:0010个关键词截图防反爬昨日数据diff异常告警
⾸次执⾏后Hermes会沉淀skill:seo_daily_check,后续直接命中。
9.4⾼级⽤法(YAML配置)
name:"每日SEO监控"schedule:"0 9 * * *"model:"anthropic/claude-sonnet-4"skills:["tavily-search","tech-article-writing"]enabled_toolsets:["web","browser","memory"]script:"scripts/seo_check.py"workdir:"/path/to/project"no_agent:false
⼗、Profile(配置⽂件)系统
10.1什么是Profile
同⼀台机器上运⾏多个完全独⽴的Hermes实例,每个有⾃⼰的配置、技能、记忆、会话、API密钥。
10.2使⽤场景
10.3操作命令
hermes profi