时间:2026年9月14日
地点:美国(旧金山 OpenAI 总部 / 加州 Broadcom)
人物:OpenAI 硬件副总裁 Richard Ho、Broadcom 工程团队、Verkor.io 联合创始人 David Chin & Ravi Krishna、UC San Diego 教授 Andrew Kahng
事件详情:IEEE Spectrum 深度披露 OpenAI 自研 AI 推理芯片 Jalapeño 的设计内幕——这款芯片 8 月 25 日由 OpenAI 联合 Broadcom 正式发布,可提供最高 13.4 petaflops 的 4-bit 算力,搭配 232GB 顶级 HBM 内存、内存带宽高达 15.4 TB/s;在 OpenAI 给出的 inferencex.semianalysis.com 基准测试中,相比公司目前依赖的 NVIDIA GB300,Jalapeño 可将端到端(prompt 到 last token)延迟降低最高 3.6 倍且功耗更低。真正的故事是设计方式:Jalapeño 从最初架构概念到首批硅片用时不到 20 个月,从首版 RTL(寄存器传输级逻辑代码)到 tape-out 仅用 9 个月。OpenAI 硬件副总裁 Richard Ho 表示,团队自始至终平均不到 100 人,第二代、第三代设计同样保持约 100 人规模(含系统设计、软件、供应链等岗位,不含 Broadcom)。OpenAI 端到端负责推理加速器、内存层级、网络系统设计,Broadcom 负责"从门级开始"的物理实现。Ho 表示:"这些模型让我们的工程师获得了超能力。他们仍然在主导工作,仍是最终裁判,但他们可以更快地做事、探索更多路径。"
背景:Jalapeño 的前端工作流围绕 Google 开源的 XLS(Accelerated Hardware Synthesis)高层综合工具链展开,工程师可使用类 Rust 的 DSLX 与 C++ 等高级语言写芯片设计,XLS 再转译为 Verilog 硬件描述语言,正是这种"语言 + 代码"友好的特性让 LLM 能够在芯片设计的"语言域"环节发挥加速作用。Verkor.io 联合创始人 David Chin 与 Ravi Krishna 认为,9 个月的时间表"很可信",但离不开 Broadcom 物理设计端的全力支持;UC San Diego 教授 Andrew Kahng 评价其速度"很可能是当下业界最佳",并指出早在 2016 年 IEEE Design Automation Futures 研讨会上,时任 Google 工程师的 Ho 就提出"芯片设计周期本质上是团队每天能完成的迭代次数的函数"这一核心观点——十年后,LLM 终于让"加速迭代次数"成为现实。
影响:1)OpenAI 把"用自家 LLM 设计自家 AI 芯片"做成完整闭环,对外打破对 NVIDIA 的单一依赖、对内强化算力-模型协同;2)芯片设计行业从"3 年做一颗芯片"加速到"9 个月",LLM 正在成为 EDA 工具链的新底座;3)Broadcom 作为"中立设计厂"绑定 OpenAI,TSMC 制造端也可能进入新的合作组合,定制 AI 芯片赛道进一步分层。
总结:OpenAI 用 9 个月和不到 100 人做出对标 NVIDIA GB300 的推理芯片 Jalapeño,核心秘诀是让自家 LLM 深度参与芯片设计,意味着 LLM 不再只是模型的竞争,也开始成为芯片迭代速度的竞争。
参考来源:
1. IEEE Spectrum - How OpenAI Used Its Own LLMs to Design Its Jalapeño Chip:https://spectrum.ieee.org/llms-for-chip-design
2. OpenAI - OpenAI and Broadcom unveil LLM-optimized inference chip:https://openai.com/index/openai-broadcom-jalapeno-inference-chip/
3. Broadcom Investor Relations - OpenAI and Broadcom Unveil LLM-Optimized Intelligence Processor:https://investors.broadcom.com/news-releases/news-release-details/openai-and-broadcom-unveil-llm-optimized-intelligence-processor
4. Tom's Hardware - Broadcom and OpenAI unveil custom-built Jalapeño inference processor:https://www.tomshardware.com/tech-industry/artificial-intelligence/broadcom-and-openai-unveil-custom-built-jalapeno-inference-processor-openais-first-chip-is-a-massive-reticle-sized-asic-built-in-an-ultra-fast-nine-month-development-cycle
5. VentureBeat - OpenAI unveils first custom AI inference chip, Jalapeño:https://venturebeat.com/infrastructure/openai-unveils-first-custom-ai-inference-chip-jalapeno-with-broadcom-and-its-development-was-sped-up-with-openais-own-models
6. Futurum Group - Jalapeño in Nine Months: Did AI Just Break Chip Design Timelines?:https://futurumgroup.com/insights/jalapeo-in-nine-months-did-ai-just-break-chip-design-timelines/
7. Hacker News - OpenAI unveils its first custom chip, built by Broadcom:https://news.ycombinator.com/item?id=48663324
8. Google XLS - Accelerated Hardware Synthesis:https://google.github.io/xls/









