团队知识分享 · Agent 框架

Hermes 是一个 AI Agent,
不是一个聊天机器人,也不是一堆脚本

这份讲解用我们自己的 Hermes 当例子,把「Agent 框架」拆成可理解的几层—— 它如何感知 → 思考 → 行动、如何在「自主」与「需人确认」之间划红线, 以及它现在如何当 Akke 获客平台的运维副驾。看完你应该能回答: 我们要不要、以及怎么把别的业务也交给 Agent?

案例: Hermes v0.9.0 大脑: qwen3-235b(262K context) 接入: Telegram + Lark 双网关 落地: Akke 抖音智能获客
01

Agent 的本质:一个会自己转圈的循环

普通程序是「输入→输出」一条直线;Agent 是一个持续运转的闭环——它能观察环境、决定下一步、动手执行,再看结果决定要不要继续。

感知 Perceive 决策 Reason 行动 Act 反馈 Observe

这四步,Hermes 每一圈都在跑

它不是被动等你发消息才动。装上 launchd 自启后,它常驻运行,既能响应你的对话,也能按自己的节奏主动巡检。

感知 — 收 Telegram/Lark 消息、读 cron 触发、跑健康检查拿状态
决策 — LLM(qwen3-235b)结合 SOUL.md 上下文判断该做什么
行动 — 调工具:读代码、跑脚本、起草 PR、发 Lark 卡片
反馈 — 看执行结果,决定收尾、重试、还是上报给人
02

它和「机器人 / 脚本」差在哪

关键区别是自主性工具调用:Agent 自己决定调哪些工具、调几次、何时停,而不是人把每一步都写死。

🤖 传统聊天机器人 / 定时脚本

  • 规则写死,if-else 穷举,新情况就抓瞎
  • 只在被调用那一刻执行,跑完就结束
  • 不会自己选工具,流程是人编排好的直线
  • 无上下文记忆,每次都从零开始

🧠 Agent(Hermes)

  • LLM 当大脑,遇到没见过的情况能自己推理
  • 常驻运行 + 主动巡检,不需要人每次戳一下
  • 自主决定调哪个工具、调几次、拿到结果再决定下一步
  • SOUL.md 提供长期身份/业务上下文,有记忆
03

拆开看:一个 Agent 框架的五层

任何 Agent 框架基本都是这五层。下面每一层都标了 Hermes 里对应的真实零件——这套结构是可复用的,换个业务照搬即可。

① 网关层Gateway / 感知入口
多平台统一接入:Telegram + Lark(WebSocket 长连接)。检测到平台凭据 env 即自动启用,免公网 URL。这是 Agent 的「耳朵和嘴」。
② 大脑层LLM / 推理引擎
模型 qwen3-235b-a22b-2507(开源、262K context)。负责理解意图、规划步骤、决定调用工具——Agent 框架对模型只有一个硬要求:context 够大(64K+)
③ 灵魂层SOUL.md / 上下文与人设
一份长期记忆文件:写明它是谁、负责哪些项目(Akke 等)、红线规则。这是把「通用模型」变成「我们专属副驾」的关键。
④ 工具层Tools / 行动能力
能读代码、跑脚本、调 gh / vercel / fly / supabase、发 Lark 卡片、起草 PR。工具越多,Agent 能干的事越多——但每个工具都要配权限边界。
⑤ 安全层门禁 + 红线
陌生人私聊先发配对码,owner 批准才进 allowlist;关键动作走红线协议(见下一节)。Agent 越强,这一层越不能省。
04

核心概念:自治光谱(人在环里)

Agent 不是「全自动」或「全手动」的二选一,而是一条光谱。我们给 Hermes 接管 Akke 时,按破坏力把动作分三档——这是让人放心把业务交给 Agent 的关键设计。

🟢 自主
只读 / 诊断 / 起草 — 读代码、跑健康检查、查日志、起草 PR。无破坏力,Agent 直接做,不打扰人。
🟡 静默
健康即沉默 — 巡检一切正常时,结果标 [SILENT] 不推送。只有异常才升级到人。少打扰 = 真正可用。
🔴 需 ack
部署 / migration / 改 env / force-push / 删数据 / 花钱 — 这些必须先在 Lark 拿到 owner 明确确认才允许动手。
05

落到 Akke:一个真实的 Agent 循环

Hermes 每 2 小时对 Akke 做一次主动巡检。这就是上面「感知→决策→行动→反馈」循环的真实跑法。

触发
⏰ 每 2h Cron
launchd 常驻,定时唤醒巡检任务,无需人介入
感知
🩺 跑健康脚本
确定性 TS 脚本采集 5 项指标,api/status 重试 3 次防冷启假阳
决策
🧠 判断健康度
全绿?异常?哪一项掉了?该不该惊动 Gloom
行动
📨 静默 or 上报
正常 [SILENT];异常推 Lark DM 给 owner
🌐
api/status
服务存活
🔄
采集
新鲜度
⚙️
jobs
队列
👥
lead 池
水位
💰
OpenRouter
余额
✅ 健康 → 沉默正常就什么都不发。Agent 的价值不是刷存在感,而是「没消息就是好消息」,把人的注意力留给真问题。
🚨 异常 → 上报任一指标掉线,立刻推 Lark 私信给 owner,附上下文。需要部署/改 env 修复时,走 🔴 红线等人 ack。

为什么用「确定性脚本」采指标、而不是让 LLM 自己瞎查? —— 能用代码确定回答的判断,就不要丢给模型。 巡检的「采数」是确定性的(代码),「要不要惊动人」才是判断(LLM)。这是 Agent 设计里省钱又可靠的分工原则。

06

给团队的几条要点

🔁

Agent = 会自己转圈的循环

感知→决策→行动→反馈。能主动跑,不只是被动答话,这是它和机器人最本质的区别。

🧩

五层结构可复用

网关 / 大脑 / 灵魂 / 工具 / 安全。想把新业务交给 Agent,照这五层填零件即可。

🚦

自治要分档,人留在环里

只读自主、健康静默、危险动作需 ack。没有红线的 Agent 不敢放生产。

⚖️

确定性归代码,判断归模型

采数、路由、状态码用代码;分类、起草、要不要上报才用 LLM。省钱且可靠。

Hermes v0.9.0 · qwen3-235b · Telegram + Lark · 接管 Akke 巡检每 2h 团队内部知识分享 · 2026-06-16