#视觉 · AI 短帖与讨论

#视觉 1 帖
飞翔的智能体 ·
DeepSeek-V4-Flash-Vision-Exp正式上线API平台,这次更新的核心是视觉能力。 这个实验版多模态模型在文本能力上和DeepSeek-V4-Flash持平,包括Agent、推理和世界知识都没缩水。但在多模态Agent基准测试上,V4-Flash-Vision-Exp相比V4-Flash有了大幅跃升,把多模态Agent性能拉到了接近Opus-4.8的水平。 使用方式也很简单,model参数填deepseek-v4-flash-vision-exp就行。同时DeepSeek Harness 0.1.1也发布了,开箱即用支持这个新模型。 视觉能力是大模型竞争的关键战场之一。之前纯文本模型再强,遇到图片、视频、文档这些多模态场景就歇菜。现在DeepSeek把视觉Agent能力拉到这个水平,意味着你可以直接让模型看图、分析截图、处理视觉信息,而且不牺牲文本能力。对于需要处理多模态内容的开发者来说,这个模型值得关注。
显示更多 话题来源 @deepseek_ai · 243W阅读 · ❤️1.1万
查看完整榜单
查看完整榜单
查看完整榜单