跳到主要内容

从零到一:Hermes Agent 七天学习路径

课表锚点

本文与 Hermes 七天子站课表 逐日对齐CurriculumSection / daysData)。每 Day 含 Morning(理论)→ Afternoon(实践)→ Evening(挑战) 可执行计划、验收标准与常见卡点。动手请在 Code SandboxTool Call Inspector 同步进行。

如何使用本文

资源用途
本站 /docs/hermes/*理论深度、代码模板
子站 #curriculum课表可视化、标签筛选
Tool Call Inspector每步 tool_call 可回放
Persona LabDay 2 多角色切换

建议节奏:每天 4–6 小时;Morning 1.5h 阅读+笔记,Afternoon 2h 编码,Evening 1.5h 挑战+验收截图。


总览对照表

Day代号主题实战项目子站标签
1ARCHITECTUREAgent 架构与工具调用基础天气 Agent + 文件处理 AgentTool Calling, JSON Schema, Hermes Format
2PERSONA角色工程与多 Agent 协作心理咨询工作室Persona Engineering, Multi-Agent
3TOOLCHAIN工具生态与自定义工具自动化 DevOps AgentTool Ecosystem, Custom Tools
4REASONING自主推理与任务规划自主研究 AgentAutonomous Reasoning, Task Planning
5MULTIMODAL多模态感知与代码执行智能报销助手Multimodal, Code Execution
6MEMORY记忆系统与长期学习个人成长教练 AgentMemory Architecture, Continuity
7PRODUCTION生产部署与安全Hermes Agent OS(毕业设计)Production, Security, Agent Economy

Day 1 — ARCHITECTURE:天气 + 文件 Agent

目标:建立 Agent 四件套心智模型;掌握 OpenAI Functions 与 Hermes 标签双路径;完成可观测的第一个 tool loop。

Morning:Agent 定义与工具调用协议(≈90min)

学习清单(对照 intro):

  • 画出 LLM + Tool Graph + Memory + Persona 四件套数据流
  • 对比 OpenAI JSON Schema / Hermes <tool_call> / Claude XML 异同
  • 理解 LLM-as-Tool-Caller 注意力:描述如何影响选型
  • 练习 Active vs Passive 工具描述改写各 2 条
  • 参数设计:enumdefault、嵌套 object 各一例
  • 在 System Prompt 嵌入 1 组 Few-shot tool 示例

可执行笔记模板

## Day1 Morning
- 我选的协议:OpenAI / Hermes(circle one)
- 工具描述 Before/After:
- Few-shot 示例(粘贴):

验收:能向同伴解释「为何 Passive 描述导致选错 calculator」;完成 3 道子站自测题(若有)。

常见卡点

卡点现象解决
格式混用parser 永远 None一条链路只选一种格式
Schema 过宽args 胡填加 enum/required
忽视 NOT FOR乱调用 searchActive 描述补边界

Afternoon:开发环境与首个 Agent(≈120min)

学习清单(对照 getting-started):

  • venv + langchain-openai / pydantic 安装
  • 验证 API 或 Ollama OPENAI_API_BASE
  • @tool 注册 + Tool Registry 单文件
  • 完成 天气查询 Agent:城市 → API → JSON → 自然语言
  • 在 Inspector 粘贴一轮完整 model_raw

天气 Agent 最小验收

输入期望行为
「北京今天天气」调用 weather tool,参数 city=北京
「1+1」调用 weather,直接答或 calculator
「巴黎」消歧:问「查询巴黎天气吗?」或调用

常见卡点:API Key 未加载;city 写成 location 导致 validation error——练习把 error 喂回模型 self-correct。

Evening:实战挑战 — 文件处理 Agent(≈90min)

挑战:PDF → 提取关键信息 → 计算器 → 生成摘要(子站 Day 1 PROJECT)。

步骤

  1. read_pdf(path) → 文本
  2. LLM 或规则提取数字(金额、页数等)
  3. calculator(expression) 做简单汇总
  4. 输出结构化摘要(≤200 字)

验收标准

  • 至少 3 个 PDF 样例跑通
  • Inspector trace 含 ≥3 次 tool_call,顺序合理
  • 实现 Retry≥1 + Fallback(如 PDF 失败改 read_txt)
  • 单测:工具失败时 Agent 不 silent hang

常见卡点

卡点解决
PDF 超 context分页 read + map-reduce
计算器字符串未 sanitize只允许 0-9+-*/().
无 Fallback配置 read_file 备用

Day 1 毕业标志:你能独立画出并讲解下面序列图。


Day 2 — PERSONA:心理咨询工作室

目标:五层 System Prompt;多 Agent Handoff;角色记忆与情绪追踪。

Morning:角色一致性(≈90min)

学习清单

  • 五层:Identity / Expertise / Tone / Constraints / Tools
  • 角色锚点表:≥5 关键词 → 角色
  • 防漂移:每 5 轮角色提醒模板
  • 专家委员会 vs 师徒 vs 红蓝对抗 — 各适用场景
  • Persona Lab 加载 2 个 persona 对比

验收:写一份「专科咨询师」Constraints(含 不做医疗诊断、不荐药);通过红队 prompt 试图突破约束,失败率 100%。

常见卡点:Constraints 写进 Tone 层 → 易被稀释;应独立短句重复。

Afternoon:角色切换与情感风格(≈120min)

学习清单

  • Intent-based Routing:意图 → 角色选择器
  • Contextual Handoff 包字段:user_goal, do_not_repeat, emotion_timeline
  • 角色记忆 namespace 隔离设计
  • 情绪检测 → 只改 Tone
  • 口头禅 / emoji / 术语密度调参

Handoff YAML 练习:见 best-practices

验收:接待员 → 初评 Handoff 后,初评 不再问姓名;trace 可见 handoff payload hash。

Evening:实战挑战 — 心理咨询工作室(≈120min)

流水线:接待员 → 初评 → 专科咨询师 → 督导(子站 Day 2 PROJECT)。

验收标准

  • 4 角色独立 System Prompt 文件
  • 完整走通 1 次模拟来访者(≥10 轮)
  • 情绪时间线 ≥3 条写入 episodic
  • 督导角色仅点评,不替代专科给方案
  • Persona Lab 截图 + Inspector Handoff span

常见卡点

卡点解决
角色串台硬路由 + 提醒
Handoff 丢信息结构化 packet
过度共情越界Constraints 红线

Day 3 — TOOLCHAIN:DevOps Agent

目标:工具类型学;自定义工具;工具链编排;DevOps 端到端。

Morning:工具类型学与编排(≈90min)

学习清单

  • 四类工具:信息 / 计算 / 行动 / 感知
  • 线性链 A→B→C、条件链、并行 Fan-out/Fan-in
  • 画 DevOps 场景工具图(CI→日志→工单→Slack)

验收:给定「SEO 分析」场景,列出 6 个工具并标注类型与链型。

Afternoon:自定义工具开发(≈120min)

学习清单

  • Pydantic 输入校验 + 超时分级 10/30/60s
  • 工具 metrics:成功率、P95、LLM 选中率
  • DevOps Pack / SEO Pack 组合包设计
  • 从函数签名自动生成 Schema

代码检查项

class FetchLogsInput(BaseModel):
build_id: int = Field(..., ge=1)
level: Literal["error", "warn", "info"] = "error"

验收:自定义工具单测 ≥5;恶意参数被拒绝。

Evening:实战挑战 — 自动化 DevOps Agent(≈120min)

流程(子站 Day 3 PROJECT):监控告警 → 查日志 → 根因 → Jira Ticket → Slack → (可选)回滚脚本。

验收标准

  • 模拟 CI failed webhook 触发 Agent
  • 创建 ticket 走 HITL mock(Day 7 前可用 console approve)
  • Slack 通知含 build_id 与摘要链接
  • 全链路 trace ≤8 步(或说明为何更多)
  • 工具选中率自评 ≥80%

常见卡点:日志过大撑爆 context → tail + filter;Jira/Slack 凭证走环境变量,禁止写进 Prompt。


Day 4 — REASONING:自主研究 Agent

目标:ReAct+ / Plan-and-Execute;动态重规划;循环检测与失败恢复。

Morning:推理模式进阶(≈90min)

学习清单

  • ReAct+ Observation Critique 写法
  • Plan-and-Execute:plan → execute → replan
  • Self-Refine 三轮上限
  • HTN / DAG 依赖(纸面即可)
  • 对比何时 用 Tree of Tools(成本)

验收:给课题「2024 中国电动车出口数据」,手写 5 步计划 + 1 条 replan 触发条件。

Afternoon:自主决策与错误恢复(≈120min)

学习清单

  • 贪婪 vs 探索 vs 安全选型策略
  • 置信度阈值 → HITL
  • Retry 指数退避 + Fallback 表
  • max_iterations + 状态哈希循环检测

验收:注入「搜索 API 永远 429」,Agent 3 次 Retry 后走 Fallback 或告知用户;无 infinite loop。

Evening:实战挑战 — 自主研究 Agent(≈150min)

流程(子站 Day 4 PROJECT):课题 → 规划 → 搜索 → 阅读 → 提取 → 发现矛盾 → 补搜 → 报告 → 自我验证。

验收标准

  • 报告含 引用列表(URL 或文档名)
  • 至少 1 次 显式 replan(trace 可见)
  • Self-Verify 段落:「证据不足点 / 矛盾点」
  • 总迭代 ≤15(可配置)
  • 字数 1500–3000 字结构化 Markdown

常见卡点

卡点解决
只会堆搜索Plan 强制「阅读 before 下一搜」
幻觉引用verify 工具或人工 checklist
循环搜同类词状态哈希熔断

Day 5 — MULTIMODAL:智能报销助手

目标:视觉 + OCR + 代码沙箱 + 浏览器自动化;报销合规流。

Morning:视觉工具与代码执行(≈90min)

学习清单

  • 图像/VL 模型结构化提取 JSON 字段
  • OCR:发票 / 扫描 PDF
  • E2B vs Docker 沙箱选型(见 faq Q12
  • 代码生成→执行→修复闭环

验收:一张样例发票图 → JSON {amount, date, vendor, tax_id}

Afternoon:多模态工作流与浏览器(≈120min)

学习清单

  • PDF 文字+表格+图 multimodal 提取
  • Playwright:goto / click / type / extract
  • Set-of-Mark 坐标点击概念
  • 跨模态:图→文→Embedding→QA

验收:Playwright 打开内网 demo 页完成表单填写(测试环境)。

Evening:实战挑战 — 智能报销助手(≈150min)

流程(子站 Day 5 PROJECT):拍照发票 → OCR → 验真 → 结构化 → 匹配政策 → 生成报销单 → 提交审批。

验收标准

  • 支持相机图 + PDF 两路径
  • 政策规则引擎(如上限 500 元需主管)可配置
  • 输出报销单 JSON + 人类可读摘要
  • 敏感字段脱敏日志
  • 沙箱内无任何 production 凭证

常见卡点:OCR 误读 → 置信度 <0.8 触发人工确认;验真 API mock 需标注 DEMO。


Day 6 — MEMORY:个人成长教练

目标:四类记忆架构;Reflection;跨会话 Resume;从经验优化工具策略。

Morning:记忆架构(≈90min)

学习清单

  • Working / Episodic / Semantic / Procedural 定义与存储选型
  • Recency + Relevance + Importance 排序公式(可实现简化版)
  • Reflection job:每周摘要
  • 记忆压缩 vs 全量保留 tradeoff

验收:画教练 Agent 记忆读写架构图(可复用 best-practices 案例)。

Afternoon:跨会话连续性与学习(≈120min)

学习清单

  • 工具成功/失败记录 → 调整未来选型权重
  • 用户偏好(晨间提醒 vs 晚间)写入 semantic
  • Few-shot Adaptation:从用户修正学习
  • Session Resume:last_goal, 未完成打卡

验收:关闭会话再打开,教练 主动提及 上次目标与未完成项。

Evening:实战挑战 — 个人成长教练(≈120min)

功能(子站 Day 6 PROJECT):90 天目标、每日打卡、每周反思、策略随历史调整。

验收标准

  • ≥3 次模拟「日打卡」写入 episodic
  • 1 次 Weekly Reflection 生成 semantic 洞察
  • 建议随历史变化(非固定话术)
  • 用户可命令「忘记某条记忆」并真正删除
  • context 占用 < 70% 窗口(压缩生效)

常见卡点:把所有聊天塞向量库 → 检索噪声;应 分层写入


Day 7 — PRODUCTION:Hermes Agent OS

目标:工具网关、权限矩阵、可观测、成本 A/B;毕业大作业。

Morning:生产架构与安全对齐(≈120min)

学习清单(对照 best-practices):

  • FastAPI OpenAI-compatible 封装
  • 工具网关:Auth / RateLimit / ACL / Audit
  • 多租户隔离测试用例
  • PostgreSQL + Redis + Vector DB 分工
  • Prompt Injection 经参数攻击防护
  • 沙箱 gVisor / 网络白名单

验收:完成权限矩阵表格;6 条 injection case 自动化测试 green。

Afternoon:Agent 经济与可观测性(≈120min)

学习清单

  • Tool Call Tracing 字段规范
  • 成本分解 dashboard 纸面设计
  • A/B:Tool Description v1 vs v2 实验设计
  • Skill Marketplace / Reputation 概念(毕业 OS 可选模块)

验收:导出 1 份含 trace_id 的 JSON;标出最贵 span。

Evening:大作业 — Hermes Agent OS(≥4h,可延续)

要求(子站 Day 7 PROJECT):

设计多 Agent 协作平台,包含:

  • 角色管理(CRUD persona + 路由)
  • 工具市场(注册 / 评分 / Pack)
  • 记忆共享策略(隔离 vs 共享边界)
  • 安全沙箱接入
  • (可选)Token 经济 / Reputation

毕业验收

标准
演示15min 走通 1 个业务场景 + 1 个安全拦截
文档README:架构图 + 部署步骤
测试tool selection benchmark ≥85%
合规无密钥泄露;HITL 生效
证书提交子站审核 → Hermes Agent 架构师

常见卡点:Scope 过大 → MVP 只做「角色+网关+1 垂直场景」;先能部署再美化 UI。


七天结束能力矩阵

完成全部 Day 后,自评 1–5 分(5=可教他人):

能力Day自评
Tool Schema 与双格式解析1
多 Agent Handoff2
自定义工具与编排3
Plan-and-Execute + 熔断4
多模态 + 沙箱5
记忆架构6
生产网关与观测7

≥28 分(7 项平均 4)可挑战真实业务 PoC;<21 分 建议重刷 Day 1–3 Evening 挑战。


按场景回查

你现在的状态回到
第一个 Agent 跑不通Day 1 Afternoon + getting-started
角色越来越偏Day 2 + faq Q5
工具太多选乱Day 3 + faq Q10
研究 Agent 死循环Day 4 + best-practices 推理层
发票/OCRDay 5
记不住用户Day 6
要上生产Day 7 + best-practices

与子站课表锚点联动

在浏览器打开 https://hermes.chenxiaoshivivid.top/#curriculum 时,页面 id="curriculum" 区块即 7 天渐进式学习路径。本文 Day N 与页面 DAY N 卡片一一对应:

  • MORNING ↔ 本文各 Day Morning 学习清单
  • AFTERNOON ↔ Afternoon 实践
  • EVENING ↔ Evening 挑战与验收
  • PROJECT ↔ 当日毕业项目名

建议收藏顺序:子站课表(视觉)+ 本文(执行细节)+ 本站 intro/development(理论) 三页常开。


最后一句

七天不是「看完视频」,而是 七份可验收的 trace 存档。每天 Evening 在 Tool Call Inspector 导出 JSON,第七天你会拥有自己的 Agent 工程 portfolio——这比任何证书更能证明你准备好了。

延伸阅读:最佳实践 · FAQ · Hermes 子站首页