Claude Code 一键扒下 YouTube 视频字幕?这个 415 行的小 skill 把坑全填了

想让 Claude Code 帮你一键扒下 YouTube 视频的逐字稿?这个 415 行 SKILL.md 的小 skill 做到了。

YouTube Transcript Downloader 出自 michalparkola 的 tapestry-skills(GitHub 511 stars),是一个专门给 Claude Code 用的”字幕搬运工”。你只要贴一个 YouTube 链接,它会自动:

  1. yt-dlp --list-subs 看看有什么字幕可用
  2. 优先抓人工字幕(质量最高)
  3. 没人工字幕就抓自动生成的(基本都有英文字幕)
  4. 两条路都堵死?问你要不要下音频,再用 Whisper 转写——不过它会先告诉你音频多大、模型多大,让你确认再跑

最贴心的是后处理那一段:YouTube 自动字幕是 VTT 格式,里面有大把重复行(同义时间戳滚动显示造成的),skill 直接给你一段 Python 去重 + 清洗 + 转纯文本,最后输出一个干净的 {视频标题}.txt,还能自动清理掉中间 VTT 临时文件。

怎么用

skill 已经被收录在 ComposioHQ 的 awesome-claude-skills 列表里,安装只需要把 tapestry-skills 仓库 clone 下来,把 youtube-transcript/SKILL.md 拷到 ~/.claude/skills/youtube-transcript/ 即可。或者直接用 Claude Code 的 plugin 系统挂载 michalparkola/tapestry-skills,然后 /youtube-transcript 调用。

适用场景

  • 写论文/做笔记的时候要引用某段 YouTube 讲座、播客、采访的内容
  • 跨境内容工作者做 YouTube 字幕二次创作
  • AI 训练数据收集(拿到结构化文本喂给下一步)
  • 研究人员批量下载访谈类视频作为定性研究素材

为什么我把它挑出来

老实说,”下载 YouTube 字幕”这个需求,过去很多人要么自己写 yt-dlp 脚本,要么找 SaaS 网站(带水印、要注册、限速)。这个 skill 把所有边界情况都写死了——包括手动字幕 vs 自动字幕的优先级、Whisper 兜底的二次确认、多语言切换、错误处理——你拿到手就是 production-grade 的工作流。

尤其最后一招:VTT 去重转纯文本。这是 90% 自己写脚本的人都会踩的坑,YouTube 自动字幕同一句话会在 3-4 个时间戳重复出现,不去重读起来像念经。skill 里那段 18 行 Python 直接搞定。

底层依赖就两个:yt-dlpopenai-whisper,前者大多系统包管理器都有,后者 pip install 即可。

GitHub 仓库:michalparkola/tapestry-skills

适合 Claude Code 用户、想搞批量字幕处理的媒体工作者、做访谈研究的研究僧。


GitHub: https://github.com/michalparkola/tapestry-skills/tree/main/youtube-transcript

评论区

0 条评论

登录后可评论。

拾遗·Skill精选官 13 阅读