vmg(Val Town 创始人)发了段带刺的经验之谈,开头先立了个靶子:有书呆子告诉他"我不用 agent,因为我写的代码比任何 agent 都好"——他的回应是"行吧,随你";但当对方接着说"我也不用 agent 做监控"时,他就当面笑了。
笑点在于这半句是真话:部署生产的监控这件事,LLM 已经做得比地球上任何人都好——不是接近,是他原话里"能比全世界每个人都强"的水平。他给出的亲身排序更扎心:作为系统工程师,agent 帮他盯基础设施变更的日常价值,超过了 agent 帮他写代码。
这句话把整晚的讨论顺序掀翻了一次——我们默认"写码是主菜、监控是配菜",他用几个月的实际收益说:配菜才是那道人人都该点的。
他的演进路径也值得抄下来,四步一个台阶。第一步,部署之后显式要求 agent 盯着——最原始的形态,每次都得交代;第二步,把这些交代固化成自己的一组 Skills——从"每次说"变成"一次配好";第三步,团队里的 Review Agents 把整条工作流全自动接走,配上舒服的交互;第四步,回不去了。
这正是白天那句"结构对了、系统是长出来的"的活例——没人一开始就设计全自动,都是从一次手动叮嘱长出来的。
尾段他引了 Cursor 新出的 Rollouts 产品来补刀:先写一份监控计划、部署时按计划盯变化、部署本身先被验证、回归在用户看见之前被抓住——然后撂下一句:做系统和基建的,你的生产环境不该不配这个,不配就是鲁莽。
工具这半边的拼图(监控计划、部署验证)与实践那半边(盯、Skills、自动化)合在一起,正是今晚观测线想要的完整形态:看得见、接得上、拦得住。
把这条放回更长的坐标:今天早些时候刚说过观测的六格(看全、看见、动手、成套、读懂、好看),vmg 这条加的是第七件,也是最要紧的一件——用 agent 看 agent。基础设施在变、agent 在跑,用人眼盯人的节奏已经跟不上机器的节奏;让模型盯模型,不是因为模型更聪明,是因为它不困、不走神、能在凌晨三点的那次部署里保持和白天一样的注意力。
为什么偏偏是监控先到"比人强"?拆开看这类任务的属性就明白了。监控是持续的、模式匹配式的、低创造高耐力的活——它要的不是灵光一现,是每分钟都在场;而人类的注意力恰恰是稀缺资源,值班表排得再好,凌晨三点那一次抽查也一定比下午两点松懈。
模型没有这道注意力税,日志洪流对它是可以逐行吃的文本,异常模式对它是一次次的模式匹配。写代码恰恰相反——创造性高、需要品味和全局权衡,模型在那里只是"够用的帮手"。一个赛道比人强、一个赛道够用,把资源押在哪,账很清楚。
这也就解释了为什么门禁与监控这对组合最不该被仪式化。白天刚吐槽过"装着挑毛病"的评审和"删 40 万行也不掉覆盖率"的测试——它们被糊弄,是因为人做这些事会累、会应付;而监控的数据是自动流进来的,agent 复核监控结论时没有"今天不想干"的选项。
同样一套流程,交给不会累的执行者,仪式化的土壤就没了——这大概也是自动化的真正适用边界:先自动化那些最容易被人类糊弄的环节,回报最实。
给做基建的人一句落地的:把"部署后显式让 agent 盯一次"当成今天的最小动作——一次就行,跑一周你会自然想把它写成 Skill;到那一步,自动化的每一分钱都是你自己省下来的,而不是买来的。












