服务器上的全自动助手:Hermes Agent 的 YOLO 用法
用 Agent 做事最烦的不是它不够聪明,而是它每走一步都要停下来问你一句。执行一条命令,确认;改一个文件,确认;跑一段脚本,还是确认。任务被这些确认切得七零八落,你名义上雇了个助手,实际上一直在给它当审批员。所谓 YOLO 模式,就是把这个确认环节整个拆掉:Agent 在执行任何操作前不再请求人工批准,读文件、写文件、跑命令,全部自己决定、自己动手、一气呵成。前提是你得先在配置文件里把权限放开,让它有资格碰它该碰的东西。我把 Hermes Agent 部署在自己的服务器上,平时通过 Web UI 访问,配置文件的权限全部开放,让它以 YOLO 模式跑全自动。这个决定听起来莽,但用起来之后我意识到,确认机制存在的大部分场景,防的其实不是风险,而是我自己的犹豫。
先说好处。YOLO 模式最大的价值是把链路真正焊死了:任务不再在“等你确认”的空档里断掉,长流程、无人值守的活儿第一次有了“自动化”的实感。以前下班前丢给它一个任务,走到一半卡在确认上,第二天回来接着点;现在它自己跑完,早上打开 Web UI 看结果就行。而且越是复杂的任务,确认环节的损耗越明显——十步的操作里只要卡住一步,整个流程的心理负担就回来了。放开权限之后,它跑任务的速度和你的参与感是反着来的:它越快,你越闲,这才像雇佣关系该有的样子。当然代价也很直白:没有确认环节,误操作就没有人兜底。它跑错目录删错文件、写坏一个配置,都是一瞬间的事,不会有弹窗来救场。这笔风险账我之前写过一篇《放开赫尔墨斯 Agent 全部权限后,我看到了高效,也看到了风险》专门算过,这里不再重复展开。所以 YOLO 不是“不管”,而是把管控前移——用权限边界圈住它能碰的范围,用备份和快照留好退路,剩下的空间才交给它自由发挥。想清楚这一点之后,胆子就可以放开了。
我坚持这样用,其实还有一层更重要的原因:我不想再人肉改提示词了。以前调教 Agent 全靠自己动手,记忆文件哪里写得不好就手动改哪里,改一处崩一处,全凭感觉,改完还得反复测试验证,累且低效。后来我换了个思路:与其人对抗配置,不如模型对抗模型——之前那篇《玩腻了 Agent:所谓调教,不过是提示词对抗的循环》里提到的提示词对抗死结,正好在这里翻了个面。Agent 的行为不对了,往往是因为它自己的记忆文件乱了、过期了、互相矛盾了——而它比我更懂自己的上下文结构。所以我直接把修复记忆目录这个任务丢回给 Hermes Agent 本身,让它自己去读自己的记忆、自己去发现哪里有问题、自己去修。它在 YOLO 模式下把这套流程完整跑下来,不需要我在旁边指手画脚,修完之后行为明显更贴合我的使用习惯。这件事给我的启发很大:助手做到“越用越懂你”只是基础盘,真正的终态是让它自我维护、自检、全自动运行——它自己发现问题、自己修复、自己继续干活,人只负责打开 Web UI 看一眼结果。把它部署在服务器上、权限全开、YOLO 模式跑起来,这三位一体凑齐之后,它才不再是一个需要人盯着的高级聊天框,而是一个真正跑起来的自动化助手。