最近发现一个很多人踩过的坑:DeepSeek Harness里的V4.1 Fla…

我不是小布丁 @xiaobuding
最近发现一个很多人踩过的坑:DeepSeek Harness里的V4.1 Flash模型,明明支持多模态,但默认配置下就是不能看图。 问题出在哪?DSH把V4.1 Flash当成纯文本模型处理了。实际上模型通道已经支持视觉输入,只是配置文件里缺少了视觉能力的声明。 解决方法很简单,四步搞定: 第一步,先把模型加到目录里。在设置→模型→编辑DeepSeek→自定义设置里添加新模型,ID填deepseek-v4.1-flash-expires-on-0910,名称随便写个好认的就行。 第二步,备份配置文件。点设置页右上角的「打开配置文件」,把settings.yaml复制一份备用。 第三步,关键修改。找到llm-deepseek的models列表,定位到刚加的V4.1模型。在inputModalities字段里,text下面补上image,注意缩进对齐,其他字段别动。 第四步,测试验证。开个新对话,切换到V4.1 Flash,随便丢张图片进去。如果能正确描述画面内容,说明配置生效了。 这个坑挺隐蔽的,界面里根本没有「开启视觉」的开关,只能手动改配置文件。很多小伙伴以为V4.1 Flash不支持看图,其实是DSH默认没登记这个能力。 补上声明,模型的多模态能力才能完整发挥出来。
话题来源 @NFT_Chen 10.3K阅读 ❤️24 已改写,非原文转载
20 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单