时间:2026年9月13日
地点:美国加利福尼亚州旧金山 / 全球
人物:蒂博·索蒂奥(Thibault Sottiaux,OpenAI Codex 负责人)、萨钦·卡蒂(Sachin Katti,OpenAI 计算业务负责人)、萨姆·奥尔特曼(Sam Altman,OpenAI CEO)
事件详情:OpenAI 旗下 Codex 团队负责人蒂博·索蒂奥于当地时间 9 月 11 日宣布,旗下编程模型 GPT-5.3-Codex-Spark 将于下周正式退役下线,原因是"用量持续下滑,且手头已有明显更好的模型"。这款被官方称为"OpenAI 史上最快模型"的产品,峰值输出可达每秒 1200 个 Token,是 OpenAI 首个跑在非英伟达硬件(Cerebras WSE-3 晶圆级处理器)上的生产级模型,也是 OpenAI 与 Cerebras 总额超 200 亿美元、750 兆瓦算力大单的首份交付。Spark 自 2026 年 2 月 12 日以研究预览形式上线至今,总寿命不足 8 个月。OpenAI 表示将于下周完成关停。
背景:GPT-5.3-Codex-Spark 于 2026 年 2 月 12 日发布,是 OpenAI 专为实时交互编程设计的轻量化模型,主打代码编辑、局部修改和定向测试等场景。其核心硬件 Cerebras WSE-3 晶圆级处理器集成了 4 万亿晶体管与海量片上 SRAM,能将传统 GPU 推理中权重在计算芯片与外部显存间反复搬运的延迟降到极低水平,因此输出速度可达每秒 1000+ Token,约为英伟达版模型的 15 倍。OpenAI 与 Cerebras 于 2026 年 1 月达成多年期合作,计划至 2028 年分阶段部署 750 兆瓦 Cerebras 推理算力,Cerebras 披露的合同总额超过 200 亿美元。然而,Spark 在 Terminal-Bench 2.0 准确率仅 58.4%,远低于完整版 GPT-5.3-Codex 的 77.3%;SWE-Bench Pro 准确率也仅 47%-51%。开发者反馈两极分化,有人认为它在机械重构任务上"速度惊人",亦有开发者直言"Spark 是好玩的模型,也是极度糟糕、根本没法用的模型"。8 月发布的 GPT-5.6 Sol Ultrafast 模式同样基于 Cerebras 推理、却跑完整大模型,速度达 750 Token/秒,被视为压垮 Spark 的关键一击。
影响:Spark 退役意味着 OpenAI"去英伟达化"的首个试验品正式谢幕,但其技术遗产已被 GPT-5.6 Sol Ultrafast 和 GPT-6 Astra 等后续模型吸收——后者同样依托 Cerebras 实现低延迟推理,标志着"降智提速"路线让位于"既要速度又要智能"。对开发者的直接影响有限:Spark 仅向 ChatGPT Pro 月费 200 美元用户开放,独立配额是其稀缺价值,部分开发者将其用作主额度耗尽后的"备用油箱",现在该额度将随模型一同消失。从行业视角看,Spark 不足 8 个月的服役周期,叠加此前 Kimi K2.5、GPT-5.2/5.3-chat-latest、gpt-3.5-turbo-instruct 等模型密集下线,折射出大模型行业正从"长寿命通用模型"转向"快速实验-快速淘汰"的互联网式产品节奏,针对特定场景推出专用模型、用完即弃、经验反哺主力产品将成为新常态,也意味着 OpenAI 内部资源回收和模型路由简化的加速。
总结:OpenAI 关停史上最快模型 GPT-5.3-Codex-Spark,是 Cerebras 晶圆级推理路线在 OpenAI 内部的一次实验性试水落幕,7 个月寿命未换来规模化留存,却验证了"超高速模型需要更强智能兜底"的行业教训;GPT-5.6 Sol Ultrafast 等后续旗舰的快速接棒,则预示着 AI 模型迭代正进入"周级淘汰"的新阶段。
参考来源:
1. https://36kr.com/p/3981223980923651
2. https://weibo.com/ttarticle/p/show?id=23093505342436427169849
3. https://www.sohu.com/a/1075330726_362225
4. https://huggingnews.com/ai/openai-retires-1000-token-per-second-gpt-53-codex-spark-model-next-week-cf13872d
5. https://aiidelist.com/blog/gpt-5-3-codex-spark-retirement
6. https://aicrier.com/post/88bx7gv8cfn2pehjzdj0
7. https://arstechnica.com/ai/2026/02/openai-sidesteps-nvidia-with-unusually-fast-coding-model-on-plate-sized-chips
8. https://eu.36kr.com/en/p/3981223980923651









