OpenAI 改进了 GPT-6 Sol 和 Luna 中的提示缓存,以提高效率
核心要点
- GPT-6 Sol 和 Luna 中的新缓存升级可将缓存输入令牌成本降低高达 90%,同时减少开发人员构建代理工作流程的延迟。
- OpenAI 于 2026 年 9 月 22 日推出了 GPT-6 Sol 和 Luna,并提供了一系列即时缓存升级,可将缓存输入令牌的成本削减高达 90%,并减少处理长对话

GPT-6 Sol 和 Luna 中的新缓存升级可将缓存输入令牌成本降低高达 90%,同时减少开发人员构建代理工作流程的延迟。
OpenAI 于 2026 年 9 月 22 日推出了 GPT-6 Sol 和 Luna,并提供了一系列即时缓存升级,可将缓存输入令牌的成本削减高达 90%,并减少处理长对话上下文的开发人员的延迟。
实际上发生了什么变化
GPT-6 缓存大修引入了多项具体升级。默认缓存命中率开箱即用,这意味着开发人员无需手动优化提示结构即可节省成本。新的诊断工具可以让构建者准确监控缓存的执行情况。显式断点使开发人员能够精细控制提示的哪些部分被缓存以及这些缓存片段的开始和结束位置。此前,OpenAI 的缓存依赖于自动前缀匹配超过 1,024 个令牌的提示,这是 GPT-4o 引入的系统。
凯莱金融是华尔街的优势,现在是任何人的优势——凯莱财经是您的代理人工智能投资研究终端。获得优势 →
新系统还允许开发人员切换推理工作级别并交换可用工具,而无需使缓存的上下文失效。
定价数学和竞争影响
OpenAI 对 GPT-6 API 访问的定价比 GPT-5 促销费率低约 50%。结合缓存输入令牌的 90% 折扣,运行持续 AI 对话或多步骤代理管道的有效成本大幅下降。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
GitHub Copilot 之前使用 OpenAI 缓存系统的早期版本,将需要对数十亿个请求进行全新处理的提示令牌减少了 50% 以上。
GPT-6 Astra 和更广泛的推广
GPT-6 Astra 是该系列的旗舰版本,于 2026 年 9 月 3 日进入有限预览版,并于第二天正式上市。缓存改进扩展到多个 OpenAI 产品,包括 GPT-6 API、ChatGPT Work 和 Codex。
