时间:2026年9月21日
地点:北京·AICC 2026 人工智能计算大会
人物:浪潮信息首席AI战略官刘军
事件详情:浪潮信息在AICC 2026大会上正式发布元脑SD200 Ultra超节点AI服务器与元脑HC2000多元算力机组。元脑SD200 Ultra基于128芯本土AI芯片,采用3D HyperMesh架构,提供8TB带宽和64TB内存,单机即可承载运行2.8万亿参数的Kimi K3大模型,Token生成时延首次降至5.85毫秒。元脑HC2000则采用DirectCom 2.0极速架构,搭载全液冷高密整机柜,单柜供电能力达300千瓦以上,最大承载256张AI卡,通过MCIS软件栈实现多元算力协同,在典型Agent任务场景同等投资下Token产能提升10倍。
背景:IDC在AICC现场发布数据显示,2026年全球活跃Agent约7940万个,2030年将增至22.16亿个;同期Token消耗量将从0.026Peta激增至152667Peta,增长倍数高达数百万倍。以Kimi K3为例,其权重文件达1.56TB,普通服务器无法装下权重,官方推荐至少64卡集群运行;DeepSeek V4-Pro也曾因算力不足在降价75%之后又预告整体提价,凸显Agent规模化推理面临的"能力上限"与"容量供给"双重瓶颈。
影响:浪潮信息以"向上Capability AI Compute + 向广Capacity AI Compute"双方案破局。SD200 Ultra通过构建超级算子库,将KDA、Gated MLA、MoE等基础算子融合为计算+通信的大算子,算子数量降低为原先的1/11,跨芯片通信时延低至0.69微秒,实现百万Token上下文下国产前沿模型毫秒级推理。HC2000则通过Prefill与Decode阶段异构算力精准匹配,让不同芯片各司其职,在国产算力基础上实现同等投资10倍Token产能提升,为Agent时代Token工厂提供国产化系统级路径。
总结:浪潮信息以SD200 Ultra与HC2000双产品组合,重新定义Agent时代智算供给逻辑——从单点堆卡转向"系统协同",通过国产芯片、开放架构与软件栈协同创新,让2.8万亿参数模型首次实现单机毫秒级推理,并以10倍Token产能提升破解Agent规模化部署的算力瓶颈,标志着国产智算从"能跑"迈入"跑得快、跑得起"的新阶段。
参考来源:
1. 智东西:https://zhidx.com/p/596515.html
2. IT之家:https://www.ithome.com/1/005/504.htm
3. 界面新闻:https://www.jiemian.com/article/15124335.html
4. 36氪:https://36kr.com/newsflashes/3993809665669896
5. 新浪财经:https://k.sina.com.cn/article_6192937794_17120bb4202002um44.html
6. 网易新闻:https://m.163.com/dy/article/L7DPCKV80534A4SC.html
7. 搜狐新闻:https://m.sohu.com/a/1079277114_114760
8. 知乎深度分析:https://zhuanlan.zhihu.com/p/2085673380016022674







