时间:2026年9月10日
地点:中国
人物:DeepSeek团队
事件:DeepSeek V4.1 Flash模型今日上线国家超算互联网「模型服务」页面,用户登录国家超算互联网官网后即可快速调用其API。这是该模型首次大规模接入国家级算力网络。
细节:V4.1 Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入与输出不对称,输入激活仅8B,输出激活16B,整体成本显著低于已知同尺寸模型。在基准测试中,V4.1 Flash成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。
背景:V4.1 Flash采用新的预训练方式,并经过更大规模的强化学习后训练。在Agent任务中,KV Cache占用往往决定实际运行成本——V4.1 Flash大幅压缩了缓存大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8,可显著压低Agent类任务的使用成本。
影响:依托国家超算互联网的全国算力调度能力,企业与科研机构可在国产化算力上以更低成本使用DeepSeek的旗舰推理模型,进一步加快大模型在国内工业、科研与教育场景的落地节奏。
总结:DeepSeek延续「高性能+低成本」路线,与国产超算基础设施协同,将前沿模型开放给更广泛的用户群。
参考来源:
DeepSeek V4.1 Flash 模型上线国家超算互联网 - IT之家:https://www.ithome.com/1/000/976.htm
国家超算互联网 模型服务:https://www.scnet.cn/
DeepSeek V4.1 Flash 模型卡片 - DeepSeek官方:https://api-docs.deepseek.com/news/v4-1-flash-launch
DeepSeek 技术博客 Causal-Encoder-Decoder 架构解读:https://deepseektech.github.io/v4-flash-architecture/









