时间:2026年7月30日
地点:美国旧金山/山景城
人物:RadixArk CEO 盛颖(Ying Sheng)、Google Cloud 核心机器学习与AI工程副总裁 Bill Jia、SGLang开源社区
事件详情:AI基础设施初创公司 RadixArk 与 Google Cloud 7月30日联合宣布达成合作,将开源推理引擎 SGLang 完整能力直接搬上 Google TPU,开发者可在 TPU 上以 GPU 完全一致的方式运行前沿大模型。SGLang 在 GitHub 已积累 30,000+ 星标和 1,700+ 名贡献者,在全球数十万张 GPU 上每日处理数万亿 token。合作落地后,开发者通过 SGL-JAX 后端即可在最新一代 TPU 上跑通 Gemma、Qwen、DeepSeek、GLM、Mimo、Kimi、Ling、MiniMax、Grok 等主流模型家族;今年晚些时候 RadixArk 还将推出基于 PyTorch 原生 TPU 后端的 SGL-torchtpu,提供 eager execution、PyTorch 生态兼容及 MPMD 支持,做到硬件可选的即插即用。RadixArk CEO 盛颖表示,公司使命是让前沿 AI 基础设施对每位开发者开放、触手可及;Google Cloud 工程副总裁 Bill Jia 则将合作定位为消除开发者跨硬件迁移税的关键一步,未来 SGLang 还将做到新模型在 TPU 上的 Day-0 支持,并将覆盖每一代新 TPU。
背景:RadixArk 2026年5月刚完成 1 亿美元种子轮融资,投后估值 4 亿美元,Accel 领投、Spark Capital 跟投,投资方涵盖英伟达 NVentures、AMD、联发科、Databricks 等核心硬件与系统层玩家,以及英特尔 CEO 陈立武、博通 CEO Hock Tan、xAI 前联合创始人 Igor Babuschkin、OpenAI 前联合创始人 John Schulman、PyTorch 联合创始人 Soumith Chintala 等多位技术领袖。SGLang 早期由盛颖在 LMSYS Org 主导开发,已成为大模型推理领域的开源事实标准之一,谷歌、微软、英伟达、xAI、LinkedIn、Thinking Machines Lab 等均将其作为生产推理底座。此次与 Google Cloud 联手,意味着开源推理栈第一次在英伟达 GPU 之外获得全球云厂商的体系级支持。
影响:
- SGLang 成为首个在英伟达 GPU 与 Google TPU 上同时具备完整功能与 Day-0 支持的开源推理引擎,打破硬件生态壁垒
- Google TPU 借 SGLang 接入大模型开源生态,企业可基于性价比与延迟灵活选型,强化 TPU 在前沿推理市场的渗透
- 国产模型家族 Qwen、DeepSeek、GLM、Kimi、Mimo、MiniMax 等借合作直接受益,TPU 成为国产开源模型海外部署的可行底座
- RadixArk 通过与 Google Cloud 的体系级合作,进一步锁定硬件中立推理引擎定位,巩固其事实标准的护城河
总结:RadixArk 与 Google Cloud 的合作把开源大模型推理的版图从 GPU 单一硬件正式拉入 TPU + GPU 双栈时代。SGLang 凭借 30,000+ GitHub stars、1700+ 贡献者以及每天数万亿 token 的生产级负载,第一次在另一大主流 AI 芯片上获得完整功能支持。这不仅让 SGLang 真正成为跨硬件的中立推理引擎,也将 Google TPU 拉入大模型开源生态主战场,对英伟达、AMD、英特尔在内的 GPU 玩家和依赖 GPU 的云厂商形成新的竞争压力。在国产开源模型集中出海的背景下,TPU 接入 SGLang 也为中国大模型厂商提供了更丰富的海外算力选项。
参考来源:
- https://www.lmsys.org/blog/2026-07-30-sglang-google-tpu
- https://www.radixark.com
- https://github.com/sgl-project/sglang
- https://github.com/sgl-project/sglang-jax
- http://finance.sina.com.cn/stock/t/2026-05-08/doc-inhxerwi4210788.shtml