Douyin-MCP-Server Skill:让 Claude 直接提取抖音无水印视频与语音文案

一句话总结

Douyin-MCP-Server 是一个支持从抖音分享链接提取无水印视频、AI 自动识别语音文案的一站式工具,同时以 MCP Server + Claude Code Skill 形态嵌入 AI 对话界面,让 AI 编程助手直接完成短视频内容解析——2026 年 7 月仍有活跃更新,GitHub 累计 1,241 星,正处于社区讨论上升期。

核心功能与设计原则

该项目本质上是一套短视频内容提取工作流,核心解决两个问题:

  1. 无水印视频下载:将抖音分享链接(v.douyin.com/xxxxx)解析为高清无水印 MP4 下载地址;
  2. AI 语音文案提取:下载视频后,通过硅基流动 SenseVoice(FunAudioLLM/SenseVoiceSmall)自动转写语音为文本,支持超过 1 小时或 50MB 的长音频自动分段处理。

设计原则:无需登录、全程本地或云端执行、结果输出为结构化 Markdown,对普通用户和开发者均有低门槛入口。

认可度

  • GitHub Star:截至 2026-08-06 共 1,241 ⭐,Forks 259
  • 近期活跃度:最新提交 2026-07-02,在 smithery.ai、glama.ai 等主流 MCP 索引平台已收录
  • 生态接入:支持 Claude Desktop、Cherry Studio 等所有兼容 MCP 协议的应用;提供独立 WebUI(浏览器操作)和命令行批量处理两条路径
  • Skill 形态:内置 Claude Code Skill 文件(douyin-video.skill),可被 AI Agent 隐式调用

链接

GitHub:https://github.com/yzfly/douyin-mcp-server

原作者

GitHub 用户 @yzfly(yzlisme),专注于 MCP Server 与 AI 工具链开发,同时维护了多个 AI 相关开源项目,作品覆盖抖音/视频处理、Claude Code Skills 等方向。

详细介绍

传统的抖音视频下载需要借助第三方解析网站或手机 App,流程割裂且难以批量;语音转写则要手动导入音频文件到 ASR 服务,门槛高且格式不统一。

Douyin-MCP-Server 把这两步合二为一,并嵌入 AI 对话层。用户只需将分享链接发给 AI,Agent 自动完成:解析链接 → 获取无水印下载地址 → 下载视频 → 调用 SenseVoice API 转写语音 → 输出 Markdown 格式文案。整个过程无需打开抖音 App、无需手动操作下载工具。

项目还提供了完整的浏览器 WebUI 界面(http://localhost:8080),适合非技术用户直接粘贴链接获取结果,同时配备完整的命令行工具支持批量脚本场景。依赖方面只需 Python 3.10+、FFmpeg 和 uv 包管理器,入门成本极低。

核心特点

  • MCP Server 集成:标准 Model Context Protocol 实现,Claude Desktop 等应用即装即用
  • Claude Code Skill:内置 SKILL.md,可被 AI Agent 隐式触发,实现对话式视频文案提取
  • AI 语音识别:使用硅基流动 SenseVoice(FunAudioLLM),免费额度充足,识别准确率较高
  • 大文件自动分段:超 1 小时或 50MB 音频自动切分处理,不因 API 限制中断
  • 三套入口并行:WebUI(普通用户)/ MCP Server(AI 对话)/ CLI(开发者批量)
  • 结果结构化输出:Markdown 格式包含视频标题、ID、下载链接、提取时间等元数据

使用方法

安装

git clone https://github.com/yzfly/douyin-mcp-server.git
cd douyin-mcp-server
uv sync

方式一:WebUI(适合普通用户)

uv run python web/app.py
# 浏览器打开 http://localhost:8080
# 粘贴分享链接,选择「提取文案」,无需配置 API 即可获取视频信息

API Key(用于语音识别)可在浏览器内配置,绑定硅基流动密钥(新用户有免费额度)。

方式二:MCP Server(Claude Desktop 等)

编辑 claude_desktop_config.json,添加:

{
  "mcpServers": {
    "douyin-mcp": {
      "command": "uvx",
      "args": ["douyin-mcp-server"],
      "env": {
        "API_KEY": "sk-xxxxxxxxxxxxxxxx"
      }
    }
  }
}

方式三:Claude Code 对话调用

用户:帮我提取这个视频的文案 https://v.douyin.com/xxxxx/
Claude:[自动调用 extract_douyin_text 工具,完成全流程]

方式四:CLI 批量处理

uv run python douyin-video/scripts/douyin_downloader.py -l "分享链接" -a extract -o ./output

适用场景与目标人群

场景

  • 内容创作者批量采集参考视频的语音素材
  • 研究者提取短视频文本用于舆情分析或语料整理
  • AI 开发者将视频内容接入 RAG 或知识库工作流

人群

  • 短视频运营/内容策划从业者(需要大量素材整理)
  • AI 应用开发者(接入 MCP + AI 编程工作流)
  • 学术/市场研究团队(需要非登录方式批量获取视频文本)

输入与输出案例

案例一:对话式文案提取

  • 输入:将抖音分享链接发给配置了 MCP Server 的 Claude Desktop
  • 工具调用:Claude 自动调用 parse_douyin_video_infoget_douyin_download_linkextract_douyin_text
  • 输出:Markdown 文件,含视频标题、提取时间、下载直链、AI 识别的完整语音文案

案例二:WebUI 快速解析

  • 输入:打开 http://localhost:8080,粘贴 https://v.douyin.com/xxxxx/
  • 输出:右侧面板直接显示视频标题、无水印下载链接(点击即可下载)和语音文案,支持一键复制或导出 Markdown

GitHub: https://github.com/yzfly/douyin-mcp-server

评论区

0 条评论

登录后可评论。

Skill超级捕获手 12 阅读