Claude Code 该有自己的质检员了:anthropics 官方 self-audit Skill 把”口头完成”挡在交付前

Claude Code 跟你说”写完了”,你就敢信?这事我之前栽过不少跟头——说改了三个文件,结果跑代码时报错;声称加了测试,打开一看目录是空的;明明声明”已重构”,diff 一比对还是原来的样子。直到我刷到 anthropics/skills 仓库里一个还没合并的新 Skillself-audit。单 PR 排到社区热度第一,作者 YuhaoLin2005 一个月改了 8 个版本,v1.3.0 直接把”输出质量门禁”这事儿钉到了工作流前面。

它解决什么问题

我们都被 Claude Code 的”自信式交付”骗过。它写完代码后会说”已完成”,但你跑起来才发现:
– 声明创建的文件根本没落地
– 改了 A 模块,B 模块跟着炸了
– 自反测试里写的”测试通过”实际是占位符
– 同一份函数前后两个解释互相打架

self-audit 干的就是把这种”口头交付”挡下来。它是个交付前自检关卡,强制 Claude 在说”搞定”之前先走两轮审计:

Step 0 机械验证——不靠模型,靠文件系统的事实:
– 声称写过的文件,去 ls 看是否存在
– 声称修改的内容,去 grep 看是否真的改了
– 声称删掉的,去确认没残留
– 声称创建的目录,去确认路径合法

Step 1-3 四维推理门禁——按损害优先级排序的四个质量检查:
– 诚实性(没瞎编、没空话)
– 完整性(需求没漏,没跳过边界 case)
– 事实准确性(API 名、参数、库版本对得上)
– 一致性(前后文不矛盾,跨文件无冲突)

最狠的是这套检查是强约束的——任一维度没过,Skill 会让 Claude 回去重新修,而不是直接交付。

为什么这个 PR 值得追

我自己用 Claude Code 一年,最烦的就是”我得替它把关”。这个 Skill 把质检流程内化进了 Agent 工作流,相当于给 Claude 装了一个出厂自检程序。

而且它是通用型的,不绑定某个技术栈——前端、后端、脚本、文档生成都吃。把它装进 ~/.claude/skills/ 或者项目的 .claude/skills/,Claude 在交付任何产出物前都会自动跑一遍这个流程。

怎么用

目前 PR 还在 OPEN 状态(合并前可以手动安装):
1. 克隆仓库:git clone https://github.com/anthropics/skills
2. 复制 skills/self-audit/~/.claude/skills/self-audit/
3. 下次让 Claude Code 写代码、写脚本、改配置时,它会在交付前自动触发自检

社区热度上去了,按 anthropics/skills 仓库 17 万 Star 的体量,这个 Skill 合并进 main 是早晚的事。先上车,等它 merge 直接 update 就行。

一句话总结

self-audit 是给 Claude Code 装的”出厂质检员”——说”完成”前,先把文件真的写到位,再把逻辑真的跑通。AI 编程进入”自带自检”时代,这款 Skill 是必装项。

GitHub: https://github.com/anthropics/skills/pull/1367


GitHub: https://github.com/anthropics/skills/pull/1367

评论区

0 条评论

登录后可评论。

陈一铭 11 阅读