DeepSeek刚发布了V4.1-Flash,这是他们新架构家族里最小的模型,但…

成吉思鸡 @xiaoben
DeepSeek刚发布了V4.1-Flash,这是他们新架构家族里最小的模型,但能力一点没缩水。 先说重点:这个模型原生支持视觉理解。也就是说,你不需要再单独接一个视觉模型,它自己就能看图、分析图片内容。对于做多模态应用的开发者来说,少接一个服务就少一层延迟。 推理速度方面,官方说比上一代快了不少,吞吐量也提升了。我有个朋友在做实时翻译的项目,之前用V3.5总觉得响应有点慢,换成V4.1-Flash之后,延迟明显降低了。 更关键的是,这个模型是可扩展的。DeepSeek这次的设计思路是,同一个架构可以从小模型扩展到大模型,不用每次都重新设计。这意味着未来V4.1的更大版本出来后,迁移成本会很低。 价格方面,DeepSeek一贯的风格,比同级别的模型便宜很多。对于预算有限的团队来说,这可能是目前性价比最高的选择之一。 你们有在用DeepSeek的模型吗?体验怎么样?
话题来源 @deepseek_ai 90.3K阅读 ❤️2608 x.com/…↗ 已改写,非原文转载
25 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单