DeepSeek v4.1 flash刚发布就有人跑了个鹈鹕测试,结果挺有意思的…

DeepSeek v4.1 flash刚发布就有人跑了个鹈鹕测试,结果挺有意思的。 得益于平均300 tokens/s以上的速度,整个测试过程非常快。测试者自己吐槽说最拖时间的是打字和录屏太慢,人类才是AI最大的卡点。 鹈鹕测试是个经典的推理测试,主要考察模型的逻辑推理和空间想象能力。如果排除针对这个题目特化训练过的话,这个实现效果还是不错的。 300 token/s是什么概念?基本上就是你刚打完一行字,回复就已经出来了。以前用其他模型做推理测试,经常要等个十几秒才能看到结果,现在完全没这个等待感了。 DeepSeek这次把速度拉到这个级别,对实际使用体验的提升是质变级别的。特别是需要多轮对话的场景,以前每轮都要等几秒,现在基本感觉不到延迟。 价格方面DeepSeek一直是杀手级的,这次v4.1 flash在保持低价的同时把速度拉满,性价比确实很高。有人算过,按这个速度跑一个中等复杂度的任务,成本大概在几毛钱级别。 不过也有个问题,速度太快有时候反而让人不适应。以前习惯了等AI回复的那几秒,现在突然秒出结果,反而有点不真实的感觉。
话题来源 @cgnot996 24.5K阅读 ❤️84 x.com/…↗ 已改写,非原文转载
43 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单