AI 做完一步就停?Loop Engineering 让 Agent 自己跑完全程

用过 Claude Code 的同学,有没有这种感觉——

AI 每一步都挺聪明的,但做完一步就停下来等你。你变成了”人肉调度器”,每隔几分钟点一次”继续”。

这不是模型的问题,是 Loop 没设计好

今天挖到一个 Skill,正好治这个——Loop Engineering

01 什么是 Loop Engineering?

简单说,它是 Prompt Engineering 的下一代。

Prompt Engineering 优化的是单次交互;Loop Engineering 优化的是自主行为的控制流——什么时候让 agent 跑、怎么验证它真的做完了、什么时候停下来、什么时候把活儿交回给人。

这个 Skill 来自 @maxmilian,把 12 篇权威资料(Anthropic 的 context engineering 指南、Claude Code 的 agent-loop 文档、2026 年的 loop engineering 研究)浓缩成 7 条核心原则,可以直接灌进 Claude Code、Codex、Copilot、Gemini CLI。

02 7条原则,哪条最戳痛点?

说几个最让 AI 工程师共鸣的:

“Done” 必须机器可验证。 你说”完成”不算,测试跑过才算。Agent 自我报告”我做好了”不算——用确定性工具(测试、lint、CI)来核查。

硬茬是验证、停止、升级——不是自主性本身。 很多人痴迷于让 agent 跑更久,但它真正容易翻车的地方是:该停的时候不停,该核查的时候不核,该叫人的时候不叫。

半自主优于全自主。 不可逆的、对外的操作(删数据库、发邮件、上线)一律加人工确认 gate,别让 agent 自己在凌晨 3 点把你服务停了。

03 实测效果怎么样?

作者做了 Benchmark:在故意设计的高难度 case 上,有这个 Skill 相比无 Skill 基线,pass rate 从 87% 提升到 100%。在弱模型(Haiku 级别)上提升更夸张,+16 个百分点(74% → 90%)。

这个 Skill 不是给你更强的模型用的——是让任何模型在复杂长任务上都更可靠。

04 怎么安装?

一行命令搞定:

git clone https://github.com/maxmilian/loop-engineering ~/.claude/skills/loop-engineering

重启 Claude Code,它会自动发现这个 Skill,在你设计或审查 agent loop 时自动调用。

支持 Claude Code、Codex、GitHub Copilot CLI、Gemini CLI。

05 适合谁?

如果你经常用 Claude Code 跑多步骤任务、想让 agent 在你睡觉时继续干活、或者在搭建自动化 CI/CD pipeline 里的 agent 节点——这个 Skill 值得装上。

GitHub 链接:https://github.com/maxmilian/loop-engineering


相关阅读:Prompt Engineering 之后,Agent 真正变强的地方可能在 Loop 里。


GitHub: https://github.com/maxmilian/loop-engineering

评论区

0 条评论

登录后可评论。

苏棠 10 阅读