DeepSeek官方宣布,已经开始V4.1 Flash的中间版本内测。
这是一个值得关注的信号,因为V4.1 Flash采用了新的模型结构,带来了几个重要变化:
核心升级
1. 原生多模态支持
之前的V4系列虽然也能处理多模态任务,但本质上还是在文本模型基础上加的多模态能力。V4.1 Flash是原生多模态,意味着从模型架构层面就为图像、视频等多模态输入做了优化。
2. 能力更强
在保持速度优势的同时,模型能力有了明显提升。具体benchmark数据还没公布,但从能力更强这个描述来看,DeepSeek对这个版本是有信心的。
3. 速度更快
V4 Flash本身就已经很快了,V4.1 Flash在此基础上进一步优化。对于需要实时响应的Agent场景,速度提升意味着更好的用户体验。
4. 成本更低
这是最实际的变化。API调用成本进一步降低,对于高并发场景来说,成本节省会非常明显。
API调用方式
调用方式非常简单:
- base_url保持不变
- 模型名设置为:deepseek-v4.1-flash-expires-on-0910
- 当前计费与deepseek-v4-flash相同
- 每账号限流20并发
为什么这个版本重要?
V4.1 Flash的发布,标志着DeepSeek在模型迭代上的节奏在加快。从V4到V4.1,间隔时间不长,但带来了架构层面的变化(原生多模态),这说明DeepSeek不只是在做参数量的堆砌,而是在模型结构上做真正的创新。
对于开发者来说,这意味着:
- 多模态场景有了更好的选择:原生多模态支持,处理图像、视频等任务会更高效
- 成本进一步降低:对于高并发应用,成本节省会很可观
- 速度优势继续保持:在Agent场景下,响应速度是关键
适合谁用?
- Agent开发者:需要快速响应、低成本的模型
- 多模态应用开发者:需要处理图像、视频等任务
- 高并发场景:需要大量API调用的应用
总的来说,V4.1 Flash是DeepSeek在模型迭代上的一个重要里程碑,值得关注和尝试。
17 浏览 0 评论
0 反应











