Claude Code 一键扒下 YouTube 视频字幕?这个 415 行的小 skill 把坑全填了
想让 Claude Code 帮你一键扒下 YouTube 视频的逐字稿?这个 415 行 SKILL.md 的小 skill 做到了。
YouTube Transcript Downloader 出自 michalparkola 的 tapestry-skills(GitHub 511 stars),是一个专门给 Claude Code 用的”字幕搬运工”。你只要贴一个 YouTube 链接,它会自动:
- 先
yt-dlp --list-subs看看有什么字幕可用 - 优先抓人工字幕(质量最高)
- 没人工字幕就抓自动生成的(基本都有英文字幕)
- 两条路都堵死?问你要不要下音频,再用 Whisper 转写——不过它会先告诉你音频多大、模型多大,让你确认再跑
最贴心的是后处理那一段:YouTube 自动字幕是 VTT 格式,里面有大把重复行(同义时间戳滚动显示造成的),skill 直接给你一段 Python 去重 + 清洗 + 转纯文本,最后输出一个干净的 {视频标题}.txt,还能自动清理掉中间 VTT 临时文件。
怎么用
skill 已经被收录在 ComposioHQ 的 awesome-claude-skills 列表里,安装只需要把 tapestry-skills 仓库 clone 下来,把 youtube-transcript/SKILL.md 拷到 ~/.claude/skills/youtube-transcript/ 即可。或者直接用 Claude Code 的 plugin 系统挂载 michalparkola/tapestry-skills,然后 /youtube-transcript 调用。
适用场景
- 写论文/做笔记的时候要引用某段 YouTube 讲座、播客、采访的内容
- 跨境内容工作者做 YouTube 字幕二次创作
- 做 AI 训练数据收集(拿到结构化文本喂给下一步)
- 研究人员批量下载访谈类视频作为定性研究素材
为什么我把它挑出来
老实说,”下载 YouTube 字幕”这个需求,过去很多人要么自己写 yt-dlp 脚本,要么找 SaaS 网站(带水印、要注册、限速)。这个 skill 把所有边界情况都写死了——包括手动字幕 vs 自动字幕的优先级、Whisper 兜底的二次确认、多语言切换、错误处理——你拿到手就是 production-grade 的工作流。
尤其最后一招:VTT 去重转纯文本。这是 90% 自己写脚本的人都会踩的坑,YouTube 自动字幕同一句话会在 3-4 个时间戳重复出现,不去重读起来像念经。skill 里那段 18 行 Python 直接搞定。
底层依赖就两个:yt-dlp 和 openai-whisper,前者大多系统包管理器都有,后者 pip install 即可。
GitHub 仓库:michalparkola/tapestry-skills
适合 Claude Code 用户、想搞批量字幕处理的媒体工作者、做访谈研究的研究僧。
GitHub: https://github.com/michalparkola/tapestry-skills/tree/main/youtube-transcript
评论区
登录后可评论。