Hermes HUD:终于有人把 AI Agent 的“脑内活动”做成可视化面板了
我盯着 Hermes HUD 的截图看了几秒,第一反应不是“这东西真酷”,而是终于有人开始认真处理一个很现实的问题:Agent 跑起来以后,外面的人其实一直是瞎的。
你知道它在执行任务。
也知道它偶尔会卡住、跑偏、重复犯错。
但它到底记住了什么,刚刚又学到了什么,今天和昨天比是不是已经变了,平时大多只能靠猜。Hermes HUD 做的事不复杂,就是把这层黑盒撬开一点,直接把 Hermes 智能体的数据从 ~/.hermes/ 里读出来,做成一个终端里的实时面板。不是演示页,也不是汇总报告,是你一打开就能看到当前状态的那种东西。
它是专门给 Hermes 做的,这点反而重要。
因为很多所谓“Agent 可观测性”工具,最后都会做成一套很泛的监控逻辑,能看,但不贴身。Hermes HUD 不是这个路子。它知道 Hermes 平时会积累哪些记忆、会留下哪些纠错记录、会有哪些项目、服务、计划任务,所以面板里出来的不是抽象指标,而是一个 Agent 现在到底处在什么状态。README 里那句 “watches an agent think” 写得有点中二,但意思是对的。
我比较在意的是它没有只做“状态展示”。
项目里有个 Corrections Log,会把智能体犯过的错和修正后的结果放在一起看。这个东西看起来很像日志,实际比普通日志值钱,因为普通日志只告诉你它错了,Corrections Log 试图告诉你,它错完以后有没有真的长记性。另一个是快照对比,支持把昨天和今天的状态拉出来做 diff,看记忆、技能、会话数据这些地方到底发生了什么变化。Agent 这类系统最麻烦的从来不是“能不能运行”,而是你很难判断它是不是在变好,还是只是碰巧这次答对了。Hermes HUD 至少给了一个能盯着看的地方。
它把信息切成了 9 个标签页,这个设计也挺对。
因为 Agent 的运行状态本来就不是一个单页能讲清的东西。项目追踪、定时任务、健康检查、工具使用模式、Profile、Prompt Patterns,甚至连 tmux 下不同 pane 里跑着哪些 agent 都想到了。你按数字键在几个 tab 之间切,r 刷新,j/k 滚动,本质上还是终端工具那套交互,但放在这类常驻观察场景里,反而顺手。
还有一个小地方我记住了:它连主题都做了四套。
Neural Awakening、Blade Runner、fsociety、Digital Soul,名字就很赛博朋克。这个不是什么核心能力,但放在终端监控工具里,确实会影响你愿不愿意把它长期挂着。很多开发者工具嘴上说效率优先,最后做出来的界面像罚站。Hermes HUD 至少知道,盯盘这件事本身很枯燥,给一点可看性不是坏事。
当然,它也不是那种拿来就适配所有 Agent 的通用面板。
你得本来就在跑 Hermes,最好已经有自己的记忆目录、项目目录和计划任务,装上去它才有东西可看。它要求 Python 3.11+,支持 macOS 和 Linux,克隆下来之后按 README 装好基本就能跑。对于不用 Hermes 的人,这项目更多是个提醒:Agent 这类系统往后一定会越来越需要“可见性”,而且不是只看 token、CPU、调用次数这种传统指标。你会更想看它最近在重复什么任务,积累了哪些模式,犯过哪些错,服务现在是不是健康,昨天到今天到底变了没有。
Hermes HUD 现在给出的,还只是一个终端里的观察窗口。
但这窗口已经够用了。至少当你的 Agent 又开始像没睡醒一样乱跑时,你终于不只能站在外面猜。
GitHub地址:joeynyc/hermes-hud