#AI
OpenAI 为 GPT-6 改进 prompt caching
OpenAI 发了一篇官方文章,主题是**为 GPT-6 改进 prompt caching**。原文把改进归纳为四个方向:更高的缓存命中率、新的诊断能力、显式断点(explicit breakpoints),以及用于降低延迟与成本的控制项。
对天天调 API 的团队来说,缓存命中率直接决定重复前缀(长 system prompt、固定工具描述、多轮上下文)要不要反复重新计费。显式断点意味着把「缓存切在哪」变成可控项,诊断则用来解释为什幺没命中。**具体的命中率数字与配置方式,原文未在摘要中给出,需要点进官方文章看。**
💡 为什么值得看GPT-6 缓存提升、加诊断与断点,直接降延迟成本。
查证
来源档案
OpenAI 官方博客
OpenAI 官方发布的技术说明文章,属一手源。
官方一手渠道,方向与功能命名可信。但本次可见的只有标题与一句话摘要,具体数值与接入方式未见于摘要,不做引申。
延伸阅读
想落地省钱的话,关键是断点粒度与计费规则,官方原文是唯一权威口径。