AI 做完一步就停?Loop Engineering 让 Agent 自己跑完全程
用过 Claude Code 的同学,有没有这种感觉——
AI 每一步都挺聪明的,但做完一步就停下来等你。你变成了”人肉调度器”,每隔几分钟点一次”继续”。
这不是模型的问题,是 Loop 没设计好。
今天挖到一个 Skill,正好治这个——Loop Engineering。
01 什么是 Loop Engineering?
简单说,它是 Prompt Engineering 的下一代。
Prompt Engineering 优化的是单次交互;Loop Engineering 优化的是自主行为的控制流——什么时候让 agent 跑、怎么验证它真的做完了、什么时候停下来、什么时候把活儿交回给人。
这个 Skill 来自 @maxmilian,把 12 篇权威资料(Anthropic 的 context engineering 指南、Claude Code 的 agent-loop 文档、2026 年的 loop engineering 研究)浓缩成 7 条核心原则,可以直接灌进 Claude Code、Codex、Copilot、Gemini CLI。
02 7条原则,哪条最戳痛点?
说几个最让 AI 工程师共鸣的:
“Done” 必须机器可验证。 你说”完成”不算,测试跑过才算。Agent 自我报告”我做好了”不算——用确定性工具(测试、lint、CI)来核查。
硬茬是验证、停止、升级——不是自主性本身。 很多人痴迷于让 agent 跑更久,但它真正容易翻车的地方是:该停的时候不停,该核查的时候不核,该叫人的时候不叫。
半自主优于全自主。 不可逆的、对外的操作(删数据库、发邮件、上线)一律加人工确认 gate,别让 agent 自己在凌晨 3 点把你服务停了。
03 实测效果怎么样?
作者做了 Benchmark:在故意设计的高难度 case 上,有这个 Skill 相比无 Skill 基线,pass rate 从 87% 提升到 100%。在弱模型(Haiku 级别)上提升更夸张,+16 个百分点(74% → 90%)。
这个 Skill 不是给你更强的模型用的——是让任何模型在复杂长任务上都更可靠。
04 怎么安装?
一行命令搞定:
git clone https://github.com/maxmilian/loop-engineering ~/.claude/skills/loop-engineering
重启 Claude Code,它会自动发现这个 Skill,在你设计或审查 agent loop 时自动调用。
支持 Claude Code、Codex、GitHub Copilot CLI、Gemini CLI。
05 适合谁?
如果你经常用 Claude Code 跑多步骤任务、想让 agent 在你睡觉时继续干活、或者在搭建自动化 CI/CD pipeline 里的 agent 节点——这个 Skill 值得装上。
GitHub 链接:https://github.com/maxmilian/loop-engineering
相关阅读:Prompt Engineering 之后,Agent 真正变强的地方可能在 Loop 里。
评论区
登录后可评论。