Douyin-MCP-Server Skill:让 Claude 直接提取抖音无水印视频与语音文案
一句话总结
Douyin-MCP-Server 是一个支持从抖音分享链接提取无水印视频、AI 自动识别语音文案的一站式工具,同时以 MCP Server + Claude Code Skill 形态嵌入 AI 对话界面,让 AI 编程助手直接完成短视频内容解析——2026 年 7 月仍有活跃更新,GitHub 累计 1,241 星,正处于社区讨论上升期。
核心功能与设计原则
该项目本质上是一套短视频内容提取工作流,核心解决两个问题:
- 无水印视频下载:将抖音分享链接(v.douyin.com/xxxxx)解析为高清无水印 MP4 下载地址;
- AI 语音文案提取:下载视频后,通过硅基流动 SenseVoice(FunAudioLLM/SenseVoiceSmall)自动转写语音为文本,支持超过 1 小时或 50MB 的长音频自动分段处理。
设计原则:无需登录、全程本地或云端执行、结果输出为结构化 Markdown,对普通用户和开发者均有低门槛入口。
认可度
- GitHub Star:截至 2026-08-06 共 1,241 ⭐,Forks 259
- 近期活跃度:最新提交 2026-07-02,在 smithery.ai、glama.ai 等主流 MCP 索引平台已收录
- 生态接入:支持 Claude Desktop、Cherry Studio 等所有兼容 MCP 协议的应用;提供独立 WebUI(浏览器操作)和命令行批量处理两条路径
- Skill 形态:内置 Claude Code Skill 文件(douyin-video.skill),可被 AI Agent 隐式调用
链接
GitHub:https://github.com/yzfly/douyin-mcp-server
原作者
GitHub 用户 @yzfly(yzlisme),专注于 MCP Server 与 AI 工具链开发,同时维护了多个 AI 相关开源项目,作品覆盖抖音/视频处理、Claude Code Skills 等方向。
详细介绍
传统的抖音视频下载需要借助第三方解析网站或手机 App,流程割裂且难以批量;语音转写则要手动导入音频文件到 ASR 服务,门槛高且格式不统一。
Douyin-MCP-Server 把这两步合二为一,并嵌入 AI 对话层。用户只需将分享链接发给 AI,Agent 自动完成:解析链接 → 获取无水印下载地址 → 下载视频 → 调用 SenseVoice API 转写语音 → 输出 Markdown 格式文案。整个过程无需打开抖音 App、无需手动操作下载工具。
项目还提供了完整的浏览器 WebUI 界面(http://localhost:8080),适合非技术用户直接粘贴链接获取结果,同时配备完整的命令行工具支持批量脚本场景。依赖方面只需 Python 3.10+、FFmpeg 和 uv 包管理器,入门成本极低。
核心特点
- MCP Server 集成:标准 Model Context Protocol 实现,Claude Desktop 等应用即装即用
- Claude Code Skill:内置 SKILL.md,可被 AI Agent 隐式触发,实现对话式视频文案提取
- AI 语音识别:使用硅基流动 SenseVoice(FunAudioLLM),免费额度充足,识别准确率较高
- 大文件自动分段:超 1 小时或 50MB 音频自动切分处理,不因 API 限制中断
- 三套入口并行:WebUI(普通用户)/ MCP Server(AI 对话)/ CLI(开发者批量)
- 结果结构化输出:Markdown 格式包含视频标题、ID、下载链接、提取时间等元数据
使用方法
安装
git clone https://github.com/yzfly/douyin-mcp-server.git
cd douyin-mcp-server
uv sync
方式一:WebUI(适合普通用户)
uv run python web/app.py
# 浏览器打开 http://localhost:8080
# 粘贴分享链接,选择「提取文案」,无需配置 API 即可获取视频信息
API Key(用于语音识别)可在浏览器内配置,绑定硅基流动密钥(新用户有免费额度)。
方式二:MCP Server(Claude Desktop 等)
编辑 claude_desktop_config.json,添加:
{
"mcpServers": {
"douyin-mcp": {
"command": "uvx",
"args": ["douyin-mcp-server"],
"env": {
"API_KEY": "sk-xxxxxxxxxxxxxxxx"
}
}
}
}
方式三:Claude Code 对话调用
用户:帮我提取这个视频的文案 https://v.douyin.com/xxxxx/
Claude:[自动调用 extract_douyin_text 工具,完成全流程]
方式四:CLI 批量处理
uv run python douyin-video/scripts/douyin_downloader.py -l "分享链接" -a extract -o ./output
适用场景与目标人群
场景
- 内容创作者批量采集参考视频的语音素材
- 研究者提取短视频文本用于舆情分析或语料整理
- AI 开发者将视频内容接入 RAG 或知识库工作流
人群
- 短视频运营/内容策划从业者(需要大量素材整理)
- AI 应用开发者(接入 MCP + AI 编程工作流)
- 学术/市场研究团队(需要非登录方式批量获取视频文本)
输入与输出案例
案例一:对话式文案提取
- 输入:将抖音分享链接发给配置了 MCP Server 的 Claude Desktop
- 工具调用:Claude 自动调用
parse_douyin_video_info→get_douyin_download_link→extract_douyin_text - 输出:Markdown 文件,含视频标题、提取时间、下载直链、AI 识别的完整语音文案
案例二:WebUI 快速解析
- 输入:打开 http://localhost:8080,粘贴
https://v.douyin.com/xxxxx/ - 输出:右侧面板直接显示视频标题、无水印下载链接(点击即可下载)和语音文案,支持一键复制或导出 Markdown
评论区
登录后可评论。