DeepSeek Harness 中文插件市场
/ dsh最强视觉插件
dsh最强视觉插件
modlens
ModLens
一句话介绍: DeepSeek Harness 最强视觉插件,给纯文本模型装上眼睛——粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

📖 介绍
ModLens 是 DeepSeek Harness 生态中功能最强大的视觉插件,由 liustack 开发维护。它的核心能力是:让 DeepSeek V4 Pro/Flash、GLM-5.3 等纯文本模型能够"看懂"图片。
使用方式极其简单:直接在聊天中粘贴图片,ModLens 会自动将图片发送到视觉引擎,返回结构化的 JSON 证据(包含完整转录、阅读顺序版面区域、实体和关系列表)。支持 6 个内置视觉引擎 + 4 个可复用的本地 CLI,形成完整的故障转移链。GitHub 星标 3.9k,MIT 开源协议。
✨ 亮点
- 粘贴即用:直接粘贴图片,无需先保存文件再传路径
- 6 个视觉引擎:Gemini、OpenAI、Anthropic、Antigravity CLI、Claude CLI、Kimi CLI
- 4 个可复用 CLI:Codex、OpenCode、Pi、Grok 的登录可复用
- 自动故障转移:多个引擎形成链条,第一个成功结果即返回
- 结构化输出:完整转录、版面区域、实体关系列表
- 零配置启动:复用现有登录,无需额外设置
- 最轻量级:无 hooks、无包装器、无本地代理守护进程
🎯 核心功能
| 功能 | 说明 |
|---|---|
| 图片粘贴 | 直接粘贴图片到聊天 |
| 视觉引擎 | 6 个内置 + 4 个可复用 CLI |
| 故障转移 | 多引擎自动切换 |
| 结构化输出 | JSON 格式的 OCR、版面、语义 |
| 密钥轮换 | 逗号分隔的多密钥自动轮换 |
| 设置卡片 | DSH 设置页直接配置 |
🌍 应用场景
- 截图分析:粘贴截图让模型理解内容
- 文档阅读:粘贴文档图片提取文字
- 图表解读:让模型分析数据图表
- UI 审查:粘贴界面截图进行设计评审
- 多图对比:一次粘贴多张图片进行对比分析
👥 实用人群
- DSH 用户:使用 DeepSeek 等纯文本模型的开发者
- AI 编程用户:需要视觉能力的编程场景
- 内容创作者:需要分析图片内容
- 研究人员:需要视觉理解的学术工作
🔧 使用方法
一键安装:
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.25.4
配置视觉引擎:
# 使用 Gemini(推荐,免费)
modlens config set provider gemini-api
modlens config set gemini-api.apiKey <your-key>
# 使用 OpenAI 兼容端点
modlens config set openai.baseUrl https://dashscope.aliyuncs.com/compatible-mode/v1
modlens config set openai.apiKey <your-key>
modlens config set openai.model qwen3-vl-plus
使用方式:
- 粘贴图片到聊天
- 直接提问
- ModLens 自动触发并返回结果
📝 总结评价
这是一个非常优秀的视觉插件。它解决了纯文本模型无法处理图片的核心痛点,而且做到了"粘贴即用"的极致体验。6 个视觉引擎 + 4 个可复用 CLI 的设计非常聪明,形成了完整的故障转移链。结构化 JSON 输出比单纯的图片描述更有用,可以被其他工具进一步处理。对于使用 DeepSeek 等纯文本模型的用户来说,这是必装的插件。
📊 元信息
| 类型 | DeepSeek Harness 中文插件市场 |
| Star | ⭐ 3,900 |
| 下载数量 | ⬇ 484 |
| 许可证 | — |
| 语言 | — |











