Claude Code 渗透测试 Skills 仓库:26 个 Skill 在 CTF benchmark 跑出 100% 满分
把 Claude Code 训练成白帽黑客?这套 Skill 把 OWASP Top 10 全打了一遍,CTF benchmark 直接拿到 100%。
最近 GitHub 上冒出来一个挺硬核的开源项目——Transilience AI Community Tools。它在 465 颗星的小体量下,做了一件大多数 Security AI 项目都没做到的事:让 Claude Code 从「聊天框」变成「能独立跑完整渗透测试流的安全研究员」。
一句话总结:26 个 Skill,覆盖渗透测试全流程
仓库里塞了 26 个安全 Skill + 3 个工具集成,从 reconnaissance(侦察)、source code scanning(静态代码分析)、injection(注入测试)、client-side(XSS/CSRF/CORS)、server-side(SSRF/HTTP Smuggling)一路到专业报告输出(CVSS 4.0 + CWE + MITRE ATT&CK 全套 mapping)。
最狠的是这份 Skill 套件在公开的 CTF benchmark 套件上拿到了 104/104 满分(基线只有 89.4%)。它们的训练方法写在论文《Practice Makes Perfect》里面:跑测试 → 找失败 → 把缺失的技巧写进 Skill → 再跑。15 轮迭代就补齐了能力。
跨模型迁移也实测过:Claude Sonnet 4.6 拿到 96.2%,Claude Haiku 4.5 拿到 62.5%。也就是说 不是写死提示词的 cheat,而是真有可迁移的工程能力。
用起来什么感觉?
作者写了个一键脚本 bash scripts/kali-claude-setup.sh projects/pentest,直接拉起一个装了 Kali Linux + Claude Code + Playwright 的 Docker 镜像,权限放开,安全工具(nmap、gobuster、ffuf、sqlmap、testssl)全部预装好。
进了 Claude Code 会话之后,靠 slash 命令驱动:
/hackthebox— HackTheBox 自动化挑战/hackerone— 漏洞赏金工作流/reconnaissance target.com— 攻击面映射/source-code-scanning ./app— 静态代码扫描- 直接说
Pentest https://target.com走完整流程
底层跑的是 coordinator / executor / validator 三角色 Agent,通过 Agent(prompt=...) 动态 spawn——也就是说你不再跟一个聊天机器人对话,而是在协调一支小队伍。
为什么值得研究?
大多数 Claude Code Skill 仓库还停留在「让 AI 帮我写文档、做表格」的层面。communitytools 切到了另一个方向:把一个真实的专业工作流(渗透测试)拆成 26 个 Markdown Skill 文件,让通用模型靠这套「剧本」就能跑到接近人类专家的水平。
它的 160+ 参考文件里嵌了 PayloadsAllTheThings 的实战 payload,技术密度非常高。对安全研究、AI Agent 工程、自动化测试这三类人来说,都是一份难得的开源样本。
仓库 131 个 commit、74 个 fork、MIT 协议随便用。
GitHub: transilienceai/communitytools
你试过哪些 Claude Code 安全相关的 Skill?评论区聊聊。
评论区
登录后可评论。