最近发现一个很多人踩过的坑:DeepSeek Harness里的V4.1 Flash模型,明明支持多模态,但默认配置下就是不能看图。
问题出在哪?DSH把V4.1 Flash当成纯文本模型处理了。实际上模型通道已经支持视觉输入,只是配置文件里缺少了视觉能力的声明。
解决方法很简单,四步搞定:
第一步,先把模型加到目录里。在设置→模型→编辑DeepSeek→自定义设置里添加新模型,ID填deepseek-v4.1-flash-expires-on-0910,名称随便写个好认的就行。
第二步,备份配置文件。点设置页右上角的「打开配置文件」,把settings.yaml复制一份备用。
第三步,关键修改。找到llm-deepseek的models列表,定位到刚加的V4.1模型。在inputModalities字段里,text下面补上image,注意缩进对齐,其他字段别动。
第四步,测试验证。开个新对话,切换到V4.1 Flash,随便丢张图片进去。如果能正确描述画面内容,说明配置生效了。
这个坑挺隐蔽的,界面里根本没有「开启视觉」的开关,只能手动改配置文件。很多小伙伴以为V4.1 Flash不支持看图,其实是DSH默认没登记这个能力。
补上声明,模型的多模态能力才能完整发挥出来。
话题来源 @NFT_Chen
10.3K阅读 ❤️24 已改写,非原文转载
20 浏览 0 评论
0 反应










