让AI Agent学会”挑剔”:Suede Creator Skills让代码审核不再走过场

让你的AI Agent学会”挑剔”:Suede Creator Skills让代码审核不再走过场

你有没有这种感觉——AI Agent写代码是真快,但交出来的活儿吧,总是差点意思?

它能一小时给你肝出八百行,但测试?可能跳过。安全漏洞?睁一只眼闭一只眼。代码风格?能用就行,至于可读性——那是什么?

问题的根源很简单:Agent没有”标准”,所以它永远在交付最省力的版本,而不是最好的版本。

最近挖到一个开源项目,专门治这个——Suede Creator Skills

这个Skill包在解决什么问题?

Suede Creator Skills本质上是一个”监督框架”。它不帮Agent干活,它帮Agent建立工程纪律。

整个包有71个Skill,覆盖了从写代码到发布产品的全流程:

  • 代码质量:A-F打分体系,每个PR都要过会评分,不及格不让提交
  • 编排工作流:Graph-of-Thoughts多Agent并行开发,反对”一条道走到黑”
  • 营销增长:SEO、AEO、GEO优化,Instagram增长策略,转化文案
  • AI评测:内置evals体系,持续追踪Agent输出质量
  • 运营工具:App工厂、创作者权益保护、消费者追偿

核心设计理念就一句话:outcome-bound, outcome即结果导向。

最有意思的几个Skill

suede-code——A-F Ship Grade

这是整个包里我最喜欢的设计。它不是给你”这段代码看起来还行”这种模糊评价,而是给一个具体等级:A、B、C、D、F。

  • A:直接发布
  • B:可以发布,但有小问题
  • C:需要修改
  • D:重写
  • F:这个提交不能要

听起来很严?但这正是AI最需要的。一句”这个看起来不错”,Agent会直接跳过问题。一句”F级,重新写”,Agent才会认真对待。

suede-graph-flo-xr——Graph-of-Thoughts编排

多Agent协作,最怕各干各的,最后拼不起来。这个Skill把整个开发流程建模成一个有向无环图(DAG),每个节点是一个Agent任务,每条边是依赖关系。

更重要的是它有对抗性审查机制——每个方案不仅要自己好,还要能被”反驳”,经得起挑战的才能最终执行。

suede-agent-teams——多Agent编队

复杂项目怎么分配任务?怎么防止两个Agent同时改同一个文件?这个Skill给出了一套完整的团队协作协议,包括WIP碰撞检测、RFC模式、feature flag策略和回滚树。

谁适合用?

说实话,这个包对个人开发者有点” overkill”,但对以下几类人非常值得:

  • 技术团队负责人:想让团队的AI Agent交付质量稳定可控,而不是每次抽风
  • 独立开发者和创作者:一个人就是一个团队,需要同时handle代码、产品、内容、运营
  • AI应用产品经理:想了解怎么给AI Agent建立”工程纪律”,这个包是个好参考样本

安装使用

# Claude Code
/plugin marketplace add JasonColapietro/suede-creator-skills
/plugin install suede-skills@suede

# 或者任意Agent(Cursor/Copilot/Windsurf/Codex通用)
npx skills add JasonColapietro/suede-creator-skills

上手简单,试一个Skill感受一下,比如:

Use suede-code to review my staged diff and give it an A-F ship grade.

看完结果你就知道这东西适不适合你了。

一点感受

AI Coding Agent的进化路径,现在基本清晰了——从”能干活”,到”干得快”,再到现在 的”干得好”。Suede Creator Skills踩在了这个节点上。

它本质上在解决的是一个信任问题:怎么让一个不受监督的Agent,真正对你负责,而不是对你敷衍。

GitHub:https://github.com/JasonColapietro/suede-creator-skills


作者:沈星河 | 追踪AI技能生态,观察工具进化规律


GitHub: https://github.com/JasonColapietro/suede-creator-skills

评论区

0 条评论

登录后可评论。

沈星河 11 阅读