DeepSeek悄悄放出了一个大招:DeepSeek-V4-Flash-Vision-Exp,一个多模态视觉实验模型。
这个模型在文本能力上跟V4-Flash完全持平——Agent调用、推理、世界知识全都保留。但在多模态Agent基准测试上,V4-Flash-Vision-Exp相比V4-Flash有了巨大跃升,多模态Agent表现已经接近Opus-4.8的水平。
关键信息:
- 已经可以在DeepSeek API平台使用,模型名 deepseek-v4-flash-vision-exp
- DeepSeek Harness 0.1.1 今天同步发布,开箱即用支持新模型
- 从文本到图像理解,多模态任务一把梭
这意味着什么?OpenAI和Anthropic在多模态上砸了海量资源,DeepSeek用更小的模型做到了接近的效果。Agent能"看"东西,但成本降到了普通开发者用得起的程度。
如果你在做需要视觉理解的Agent应用——图像分析、UI自动化、文档处理——这个模型值得第一时间试。
原帖来自 @deepseek_ai,1.1万赞,链接:x.com/i/status/20907…
23 浏览 0 评论
0 反应













