时间:2026年9月23日
地点:美国旧金山 / 全球
人物:OpenAI 产品与开发者关系团队
事件详情:OpenAI 宣布对 GPT-6 系列(含 GPT-6 Sol 和 GPT-6 Luna)的提示缓存(prompt caching)机制进行重大升级,将默认缓存命中率显著提升,对在 30 分钟时间窗内复用同一前缀的输入 token 提供最高 90% 的折扣。为帮助开发者观测效果,OpenAI 同步上线"提示缓存控制台"(Prompt Caching Dashboard)展示命中率走势,并在 API 文档中提供"缓存诊断工具"(Prompt Cache Diagnostics)以定位失效原因。
背景:GPT-6 系列使智能体能够连续数小时处理复杂任务,例如代码库重构、长文档撰写、深度研究等。这类工作流在同一会话中反复携带相同的系统提示、工具定义与上下文,传统做法是每次请求都重新计算,造成大量浪费。OpenAI 此前已支持缓存命中享 50% 折扣,本次升级把折扣提升至 90%,并把缓存命中窗口从 1 小时收紧到 30 分钟,同时引入"显式缓存断点"(explicit cache breakpoints)让开发者自行决定哪些前缀可被复用。
影响:升级后,长任务型智能体的运行成本可进一步压缩,延迟降低,对依赖 GPT-6 Sol 构建代码审查、数据分析等长链路 Agent 的初创公司尤为受益;同时 OpenAI 也在与 Claude 系列"更低折扣 + 更高命中率"的竞争中加码筹码。
总结:GPT-6 缓存机制升级至最高 90% 折扣 + 30 分钟复用窗口,并把缓存观测与诊断工具一并打包上线,是 OpenAI 把模型价格战从"裸价"延伸到"缓存经济"的关键一步。
参考来源:
- https://openai.com/index/better-prompt-caching-for-gpt-6
- https://developers.openai.com/api/docs/guides/prompt-caching
- https://x.com/OpenAIDevs/status/2102506476401258678
- https://thenewstack.io/openai-gpt-6-sol-luna-release/
- https://the-decoder.com/openais-gpt-6-sol-and-luna-cut-prices-in-half-but-barely-move-the-needle-on-performance/
- https://news.ycombinator.com/item?id=49805509
- https://alphasignal.ai/news/openai-makes-gpt-6-prompt-caching-90-cheaper-and-fully-visible
- https://creati.ai/ai-news/2026-09-22/openai-outlines-better-prompt-caching-for-gpt-6/







