DeepSeek Harness 中文插件市场 / dsh最强视觉插件

dsh最强视觉插件

modlens
DeepSeek Harness 中文插件市场
GitHub 查看

ModLens

一句话介绍: DeepSeek Harness 最强视觉插件,给纯文本模型装上眼睛——粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。


📖 介绍

ModLens 是 DeepSeek Harness 生态中功能最强大的视觉插件,由 liustack 开发维护。它的核心能力是:让 DeepSeek V4 Pro/Flash、GLM-5.3 等纯文本模型能够"看懂"图片

使用方式极其简单:直接在聊天中粘贴图片,ModLens 会自动将图片发送到视觉引擎,返回结构化的 JSON 证据(包含完整转录、阅读顺序版面区域、实体和关系列表)。支持 6 个内置视觉引擎 + 4 个可复用的本地 CLI,形成完整的故障转移链。GitHub 星标 3.9k,MIT 开源协议。


✨ 亮点

  1. 粘贴即用:直接粘贴图片,无需先保存文件再传路径
  2. 6 个视觉引擎:Gemini、OpenAI、Anthropic、Antigravity CLI、Claude CLI、Kimi CLI
  3. 4 个可复用 CLI:Codex、OpenCode、Pi、Grok 的登录可复用
  4. 自动故障转移:多个引擎形成链条,第一个成功结果即返回
  5. 结构化输出:完整转录、版面区域、实体关系列表
  6. 零配置启动:复用现有登录,无需额外设置
  7. 最轻量级:无 hooks、无包装器、无本地代理守护进程

🎯 核心功能

功能 说明
图片粘贴 直接粘贴图片到聊天
视觉引擎 6 个内置 + 4 个可复用 CLI
故障转移 多引擎自动切换
结构化输出 JSON 格式的 OCR、版面、语义
密钥轮换 逗号分隔的多密钥自动轮换
设置卡片 DSH 设置页直接配置

🌍 应用场景

  • 截图分析:粘贴截图让模型理解内容
  • 文档阅读:粘贴文档图片提取文字
  • 图表解读:让模型分析数据图表
  • UI 审查:粘贴界面截图进行设计评审
  • 多图对比:一次粘贴多张图片进行对比分析

👥 实用人群

  • DSH 用户:使用 DeepSeek 等纯文本模型的开发者
  • AI 编程用户:需要视觉能力的编程场景
  • 内容创作者:需要分析图片内容
  • 研究人员:需要视觉理解的学术工作

🔧 使用方法

一键安装:

npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.25.4

配置视觉引擎:

# 使用 Gemini(推荐,免费)
modlens config set provider gemini-api
modlens config set gemini-api.apiKey <your-key>

# 使用 OpenAI 兼容端点
modlens config set openai.baseUrl https://dashscope.aliyuncs.com/compatible-mode/v1
modlens config set openai.apiKey <your-key>
modlens config set openai.model qwen3-vl-plus

使用方式:

  1. 粘贴图片到聊天
  2. 直接提问
  3. ModLens 自动触发并返回结果

📝 总结评价

这是一个非常优秀的视觉插件。它解决了纯文本模型无法处理图片的核心痛点,而且做到了"粘贴即用"的极致体验。6 个视觉引擎 + 4 个可复用 CLI 的设计非常聪明,形成了完整的故障转移链。结构化 JSON 输出比单纯的图片描述更有用,可以被其他工具进一步处理。对于使用 DeepSeek 等纯文本模型的用户来说,这是必装的插件。

GitHub: https://github.com/liustack/modlens

📊 元信息

类型DeepSeek Harness 中文插件市场
Star3,900
下载数量484
许可证
语言
查看完整榜单
查看完整榜单
查看完整榜单