**时间:** 2026年8月24日(北美时间 Hot Chips 2026 大会,加州帕罗奥图)
**地点:** 美国加州帕罗奥图 / NVIDIA 官方
**人物:** Jensen Huang(NVIDIA 创始人兼 CEO)、Sam Altman(OpenAI CEO)、Dario Amodei(Anthropic CEO)、Danila Shtan(Nebius CTO)、Kyle Aubrey 与 Farshad Ghodsian(NVIDIA 技术作者)
**事件详情:** NVIDIA 8 月 24 日在 Hot Chips 2026 宣布 Vera Rubin 平台进入全面生产阶段,七款芯片、五款机架组成的"AI 超级计算机"正式向 AI 工厂客户出货。旗舰机架 Vera Rubin NVL72 集成 72 颗 Rubin GPU 与 36 颗 Vera CPU,通过第六代 NVLink 互联,配合 ConnectX-9 SuperNIC 与 BlueField-4 DPU。同步进入量产的还有专为低延迟推理设计的 Groq 3 LPX 机架,搭载 256 颗 LPU 加速器,提供 128 GB 片上 SRAM 与 640 TB/s 横向扩展带宽。NVLink Fusion 同步发布,允许客户自研 XPU 直接接入 NVIDIA 的 NVLink scale-up 域,跨域延迟比 PCIe 低 3 倍。
**背景:** 代理 AI 工作负载(agentic AI)单次会话消耗的 token 量是普通聊天的 15 倍(OpenRouter 数据),需要机架级系统同时支持长上下文处理与超低延迟 token 生成。Vera Rubin 平台是 Blackwell 之后的下一代设计,目标是在每瓦效率、每 token 成本两个维度同时取得量级跃迁。Groq 3 LPX 基于 NVIDIA 2025 年 12 月以 200 亿美元收购的 Groq 公司 LPU 技术,由 NVIDIA 创始人 Jonathan Ross 与前总裁 Sunny Madra 加入后整合到 Vera Rubin 体系。
**影响:** 在 SemiAnalysis AgentX 测试中,Vera Rubin NVL72 运行 DeepSeek V4 Pro、Kimi K3、MiniMax M3、GLM5.3、Qwen3.5 等模型时,每兆瓦推理吞吐量最高可达 GB300 NVL72 的 30 倍;训练同等规模 MoE 大模型仅需 Blackwell 平台 1/4 的 GPU 数量,每 token 推理成本降至 1/10。Groq 3 LPX 在 Artificial Analysis 测试中以 Gemma 4 31B 模型、10 万 token 上下文窗口实现每秒 3400 token 生成速度,是该模型迄今最快的成绩,比最近竞品快 4 倍,叠加 Vera Rubin NVL72 后每兆瓦推理吞吐量提升最高可达 35 倍。三家首批客户已落地:Nebius 成为首家部署 Groq 3 LPX 的 AI 云厂商,SpaceXAI 宣布其下一代 agentic AI 将全面采用 NVIDIA Vera CPU,CoreWeave 则已部署 Spectrum-X Multiplane 网络连接 Vera Rubin 机架。
**总结:** NVIDIA 用七颗芯片 + 五款机架同时量产的方式,把"AI 工厂"的定义从单卡性能推向 POD 级协同系统;OpenAI 与 Anthropic 两位 CEO 同日站台表态,意味着前沿模型厂商已把 Vera Rubin 当作下一代 agentic AI 的默认底座。
**参考来源:**
- https://blogs.nvidia.com/blog/vera-rubin-nvl72-efficiency-ai-agents/
- https://blogs.nvidia.com/blog/vera-rubin-lpx-spectrum-x-nvlink-fusion/
- https://blogs.nvidia.com/blog/nvlink-fusion-xpu-ai-factory/
- https://nvidianews.nvidia.com/news/nvidia-vera-rubin-platform
- https://developer.nvidia.com/blog/nvidia-vera-rubin-and-blackwell-set-a-new-standard-for-agentic-ai-performance-per-watt
- https://siliconangle.com/2026/08/24/nvidias-dedicated-inference-accelerator-groq-3-lpx-enters-full-production-to-supercharge-ai-agents/
- https://www.globenewswire.com/news-release/2026/08/24/3349940/0/en/nvidia-groq-3-lpx-now-in-full-production-with-world-class-speed-for-agentic-ai.html









