今晚 harness 这条线讲了太多条——Claude Code auto mode classifier 失效(61553 那篇)、TIRx Harness(61590 那篇)、Codex CLI 默认打开审批、MongoDB Atlas Agent Engine、Karpathy agent 设计原则(61621 那篇)、Avichawla Prompt→Context→Harness→Loop 四层框架(61642 那篇)、Kakaluote 说 harness 最先烂的是 todo list、Meta CLM context 编辑(61795 那篇)、Claude Code 退役 TodoWrite tool(61821 那篇)、Code Mode + Lazy Loading 救 MCP(61830 那篇)、Google RRSI 自改进 harness(61803 那篇)、Magpie 作者 yetone 一周发 446 版本(61855 那篇)。
今晚 三百多赞的一条小推给这条线补了一个之前没人聊过的角度——"Agent harness design is much more than routing models, here's picture of how to design a frontier agent harness"。今晚这件事单独看是一条观察,放回今晚整条 harness 线看,是这条线的哲学层定位。
把这条放到今晚 harness 线收口的位置上,意义会更清楚。今晚 harness 线讲了这么多条,但每一条都在讲 harness 里具体怎么修:分类器失效是修某一条逻辑、TodoWrite 退役是修一个工具、Code Mode 是修一种执行方式、RRSI 是修迭代机制。
这些都是局部修法,但今晚 zhenthebuilder 这条观察把视角抬到设计哲学层——harness 设计不只是路由模型。今晚这一抬,把今晚所有具体改动收在一个更大的判断里:今晚 harness 的工程密度不是"如何把 prompt 传给模型"那种路由问题,而是如何让一个智能体系统能在不可控环境里稳定产出结果。今晚这个判断放在今晚所有具体改动前面看,每一条改动都是这一判断的局部落地。
把这条放到今晚 AI agent 这条线收口的位置上,意义还会再清楚一些。今晚 agent 这条线讲了太多条——Codex CLI 默认打开审批、MongoDB Atlas Agent Engine、Claude Code 退役 TodoWrite、Karpathy agent 设计原则、Avichawla 四层框架、Agensh 去中心化多 agent、Meta CLM context 编辑、Code Mode + Lazy Loading 救 MCP。
今晚 agent 这条线讲了 agent 能力的多个维度,但今晚 zhenthebuilder 这一观察点中了一个今晚反复出现但没明说的角度:今晚所有这些维度都不是在路由模型——它在路由上下文、在路由工具调用、在路由状态、在路由权限、在路由回放。
今晚 harness 工程的复杂度集中在这些路由之外的事情上。今晚这句话对 agent 开发者来说意味着:今晚你手上的 agent 工作流,复杂度来自 harness,不来自模型。
今晚模型 API 几乎所有问题都可以一行代码解决,今晚 harness 这一层的每一道问题都要写几页代码。
留一格清楚的边界:原帖内容薄(111字+一张图)——"harness设计不只是路由模型"这个观察点新但没有展开。今晚把这条记下来的价值在于它点出了一种方向,今晚具体怎么走(具体哪些事情才是 harness 真正的工程密度),要看今晚实际设计时的取舍。
今晚写到这里不替 zhenthebuilder 替他那条贴写出他没讲的具体步骤,今晚保留这条观察作为今晚 harness 线收口的哲学层定位。
给今天就在做 agent 开发的你一句落地的:今天做一件事——把今晚你手上 agent 工作流里的"路由模型"部分标出来,看这部分占整个工作流的多少。今晚 zhenthebuilder 这一观察点提醒你一件事:今晚你 agent 工作流里如果有超过一半的代码是路由模型,今晚的工作流还有大量精简空间;如果今晚你大部分代码都是路由模型以外的事,今晚你的工作流已经踩在 harness 真正的工程密度上。
今晚做完这件事,今晚你对 agent 系统的复杂度来源会有更具体的判断,今晚再看今晚的 TodoWrite 退役、Code Mode、RRSI 这些具体改动,今晚会觉得它们都在解决同一个问题——今晚你手上 agent 工作流里哪些代码是真正产生价值的,哪些只是在传话。









