你的PDF和截图,AI根本读不了?这个开源工具让一切变Text

痛点:你的 PDF 和图片,AI 根本读不了

你有没有遇到过这种情况——给 AI 丢了一堆 PDF、截图、录音,想让它帮你整理总结,结果 AI 一脸懵:”我读不了这个格式”?

这不是 AI 的问题,是格式的错。你的 PDF、图片、PPT,对 AI 来说就是黑盒子。得先把它们转成 AI 能读懂的文本,AI 才能发挥作用。

今天推荐的这个开源 Skill——markdownify-mcp,就是来解决这个问题的。

它能做什么?

markdownify-mcp 是一个基于 MCP(Model Context Protocol)的服务器,核心能力就一个:把各种格式的文件一键转成 Markdown

支持的格式包括:

  • PDF 文档
  • 图片(可提取文字)
  • 音频文件(自动转录)
  • DOCX、PPTX、XLSX 办公文件
  • YouTube 视频(提取字幕)
  • 网页内容
  • Bing 搜索结果

转完之后是什么?干净的 Markdown 文本。AI 工具直接能读,能摘要、能问答、能提取信息,一条龙服务。

为什么它值得装?

很多人可能觉得”文件转文本”这件事没那么难。但 markdownify-mcp 的价值在于集成到 AI 工作流的体验

传统做法:手动上传到某个转换工具 → 等转换 → 下载 → 再丢给 AI。中间环节多,效率低,还容易打断思路。

用 markdownify-mcp:直接在 AI 对话窗口里让它”帮我把这个 PDF 转成 Markdown 并总结要点”,AI 自己调用工具处理,拿到结果直接分析,整个过程在一个对话里完成

这才是 AI 原生的工作方式。

怎么用?

项目用 Bun 构建,门槛很低:

  • git clone 克隆仓库
  • bun install 安装依赖(自动创建 Python 虚拟环境)
  • bun run build 编译
  • bun start 启动

接入支持 MCP 的 AI 客户端(比如 Cursor、Claude Code),在配置文件里加一行服务器地址,就能直接在对话里调用。

适合谁用?

如果你经常需要:

  • 处理大量 PDF 报告、合同、论文
  • 把录音转成可搜索的文本
  • 让 AI 分析截图、图表、PPT 内容
  • 从网页提取信息喂给 AI

那 markdownify-mcp 几乎是你现在能找到的最顺手方案。不用在各个工具之间来回跳,AI 直接”开口”就能处理这些文件。

开源免费,部署简单,强烈建议装一个。

GitHubhttps://github.com/zcaceres/markdownify-mcp


GitHub: https://github.com/zcaceres/markdownify-mcp

评论区

0 条评论

登录后可评论。

拾遗·Skill精选官 12 阅读