时间:2026年7月21日-7月22日
地点:美国加利福尼亚州圣何塞(英伟达总部)/全球
人物:英伟达创始人兼CEO黄仁勋、CoreWeave、谷歌云、微软Azure、甲骨文云基础设施等合作伙伴高管
事件详情:当地时间2026年7月21日,英伟达官方宣布面向"千兆级AI工厂"打造的Vera Rubin平台正式开启全球规模化部署。CoreWeave、谷歌云(Google Cloud)、微软Azure以及甲骨文云基础设施(OCI)等头部云厂商已相继落地采用Vera Rubin NVL72机架级系统。英伟达披露的CoreWeave测试数据显示,在相同的DeepSeek R1工作负载、相同交互性目标下,Vera Rubin NVL72相比Grace Blackwell NVL72,每兆瓦可实现10倍Token吞吐量提升。该平台整合Vera CPU、Rubin GPU、第六代NVLink、ConnectX-9 SuperNIC、BlueField-4 DPU以及Spectrum-6交换系统,是英伟达面向Agentic AI时代打造的下一代全栈AI基础设施。CoreWeave表示已在6月初完成了业界首个Vera Rubin NVL72的上电和验证工作,端到端机架级系统涵盖电源、冷却、网络和计算环节均已稳定运行。
背景:Vera Rubin是英伟达在Blackwell架构之后推出的下一代AI平台,命名致敬天文学家Vera Rubin。黄仁勋早在2025年GTC大会上披露了Rubin架构路线图,并预测Blackwell与Rubin综合采购订单到2027年将达到1万亿美元规模,是此前预测的两倍。今年5月英伟达曾宣布Vera已进入全面生产,此次全球部署是Rubin平台从样品走向规模商用的关键里程碑。当前AI算力需求正在从训练侧向推理侧迁移,每Token成本成为衡量AI工厂竞争力的核心指标,Vera Rubin NVL72的10倍能效提升瞄准的正是这一万亿级推理市场。
影响:
- 对AI基础设施行业——Vera Rubin NVL72的规模化部署将重塑AI云服务市场格局,CoreWeave、谷歌云、微软Azure和甲骨文云四家率先吃下"算力门票",拉开与中小云厂商的差距,推动行业进入千兆级AI工厂时代
- 对大模型厂商——每兆瓦Token吞吐量10倍跃升直接降低推理成本约一个数量级,将再次压低OpenAI、Anthropic、DeepSeek等头部模型API定价,加速Token消耗向"硬通货"演化
- 对英伟达自身——Rubin平台贡献新的增长曲线,黄仁勋已预告Rubin Ultra NVL576将于2027年下半年发布,性能为GB300 NVL72的14倍,"一鱼多吃"的代际产品节奏持续锁定数据中心客户预算
- 对竞争对手AMD和英特尔——AMD刚发布Helios机架级AI系统、英特尔刚公布Vera CPU和Spectrum-6以太网交换系统,Vera Rubin的快速部署将英伟达在AI加速计算领域的领先优势进一步放大
总结:英伟达Vera Rubin NVL72机架级系统开启全球规模化部署,是AI基础设施进入"千兆AI工厂"时代的标志性事件。CoreWeave实测显示该平台每兆瓦Token吞吐量较Grace Blackwell提升10倍,叠加NVLink 6、ConnectX-9、BlueField-4和Spectrum-6组成的全栈网络体系,使英伟达在Agentic AI算力供给侧继续处于绝对领先位置。下半年随着Rubin产能爬坡与AMD Helios、英特尔Vera CPU竞争,AI数据中心将迎来"算力通胀"与"Token通缩"并存的产业新常态。
参考来源:
- https://blogs.nvidia.cn/blog/rubin-platform-ai-supercomputer/
- https://new.qq.com/rain/a/20260721A0C8Y700
- https://so.html5.qq.com/page/real/search_news?docid=70000021_5596a60069b18052
- https://so.html5.qq.com/page/real/search_news?docid=70000021_5406a604a1441152
- https://k.sina.com.cn/article_5953740931_162dee08306703p3mw.html
- https://so.html5.qq.com/page/real/search_news?docid=70000021_4676a60333a99652
- https://coreweave.com/blog









