每次模型能力升级,我都会做一次Agent系统大扫除。这次Astra上线后又做了一…

小白爱摸鱼 @chaozuoye
每次模型能力升级,我都会做一次Agent系统大扫除。这次Astra上线后又做了一轮,把经验整理出来分享。 这段时间我在Claude、Codex和Hermes之间积累了大量项目指令、Skills、Prompt、长期记忆和自动化任务。它们解决过真实问题,也记录了旧模型犯过的错。但模型能力升级以后,旧规则的价值会发生变化:有些仍是必要边界,有些已经被模型能力覆盖,有些互相冲突,还有些只是某次失败留下的临时补丁。 我的做法是让Astra直接审查完整工作流,具体分五步: 第一步,找出跨会话反复出现的Prompt,把稳定流程沉淀成Skill。很多Prompt你每次都在复制粘贴,说明它已经是一个标准流程了,应该封装成Skill。这样不仅省时间,还能保证每次执行的一致性。 第二步,找出人工重复执行的步骤,把它们改成脚本、集成或cron job。如果你发现自己每周都在做同样的事情——比如整理周报、检查服务器状态、同步数据——那就应该自动化。人应该做创造性的工作,重复劳动交给机器。 第三步,检查项目指令和长期记忆,合并重复内容,修正冲突。用了一段时间后,指令和记忆里经常会有多条说的是同一件事,或者互相矛盾。比如一条指令说「所有文件存到A目录」,另一条说「存到B目录」,Agent每次都要猜该听谁的。清理之后,执行效率会明显提升。 第四步,回看经常中断的任务,定位卡住Agent的文件、权限、测试和上下文缺口。有些任务反复失败,不是模型不行,而是环境有问题——文件路径变了、权限不够、缺少依赖。把这些缺口补上,成功率会高很多。 第五步,用真实项目重跑回归,依据失败案例决定哪些规则继续保留。理论上的清理没用,得用实际项目验证。跑一遍完整流程,看哪些地方还卡、哪些地方已经不需要了,然后据此调整。 模型越强,Harness应该越精准。真正有价值的Agent系统,会把每一次模型升级转化成系统升级。很多人只关注新模型能做什么,却忘了回头整理一下旧系统——其实清理旧系统带来的效率提升,往往比换新模型更大。
话题来源 @JexLau 54K阅读 ❤️376 x.com/…↗ 已改写,非原文转载
24 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单