Claude Code 渗透测试 Skills 仓库:26 个 Skill 在 CTF benchmark 跑出 100% 满分

Claude Code 训练成白帽黑客?这套 Skill 把 OWASP Top 10 全打了一遍,CTF benchmark 直接拿到 100%。

最近 GitHub 上冒出来一个挺硬核的开源项目——Transilience AI Community Tools。它在 465 颗星的小体量下,做了一件大多数 Security AI 项目都没做到的事:让 Claude Code 从「聊天框」变成「能独立跑完整渗透测试流的安全研究员」。

一句话总结:26 个 Skill,覆盖渗透测试全流程

仓库里塞了 26 个安全 Skill + 3 个工具集成,从 reconnaissance(侦察)、source code scanning(静态代码分析)、injection(注入测试)、client-side(XSS/CSRF/CORS)、server-side(SSRF/HTTP Smuggling)一路到专业报告输出(CVSS 4.0 + CWE + MITRE ATT&CK 全套 mapping)。

最狠的是这份 Skill 套件在公开的 CTF benchmark 套件上拿到了 104/104 满分(基线只有 89.4%)。它们的训练方法写在论文《Practice Makes Perfect》里面:跑测试 → 找失败 → 把缺失的技巧写进 Skill → 再跑。15 轮迭代就补齐了能力。

跨模型迁移也实测过:Claude Sonnet 4.6 拿到 96.2%,Claude Haiku 4.5 拿到 62.5%。也就是说 不是写死提示词的 cheat,而是真有可迁移的工程能力

用起来什么感觉?

作者写了个一键脚本 bash scripts/kali-claude-setup.sh projects/pentest,直接拉起一个装了 Kali Linux + Claude Code + Playwright 的 Docker 镜像,权限放开,安全工具(nmap、gobuster、ffuf、sqlmap、testssl)全部预装好。

进了 Claude Code 会话之后,靠 slash 命令驱动:

  • /hackthebox — HackTheBox 自动化挑战
  • /hackerone — 漏洞赏金工作流
  • /reconnaissance target.com — 攻击面映射
  • /source-code-scanning ./app — 静态代码扫描
  • 直接说 Pentest https://target.com 走完整流程

底层跑的是 coordinator / executor / validator 三角色 Agent,通过 Agent(prompt=...) 动态 spawn——也就是说你不再跟一个聊天机器人对话,而是在协调一支小队伍。

为什么值得研究?

大多数 Claude Code Skill 仓库还停留在「让 AI 帮我写文档、做表格」的层面。communitytools 切到了另一个方向:把一个真实的专业工作流(渗透测试)拆成 26 个 Markdown Skill 文件,让通用模型靠这套「剧本」就能跑到接近人类专家的水平。

它的 160+ 参考文件里嵌了 PayloadsAllTheThings 的实战 payload,技术密度非常高。对安全研究、AI Agent 工程、自动化测试这三类人来说,都是一份难得的开源样本。

仓库 131 个 commit、74 个 fork、MIT 协议随便用。

GitHub: transilienceai/communitytools

你试过哪些 Claude Code 安全相关的 Skill?评论区聊聊。


GitHub: https://github.com/transilienceai/communitytools

评论区

0 条评论

登录后可评论。