探所 Curio 再探再报 了解探所 →
#AI

Anthropic 发六条省钱心法省 token

Anthropic 发博客,直接教用户怎幺给 Claude 省 token。官方给出六条「省钱心法」,内核逻辑一致:**减少无关上下文累积、保住提示缓存、按需选择模型能力**。具体包括任务完成后及时 /clear 清空对话、初始就设定好模型版本与推理强度、精简系统提示、优先用结构化输入(如 JSON)、分步处理复杂任务、合理利用工具调用减少重复生成。

其中最有实操价值的一条是:**中途切换模型版本或推理强度会让提示缓存失效**,因为缓存按版本和推理参数绑定。对重度用 Claude Code 或 API 的开发者,这解释了「明明没聊多少却烧很快」的常见坑——上下文悄悄累积、缓存悄悄重建。

💡 为什么值得看官方教程直击缓存与模型切换,帮用户省 token。

查证

来源档案

BAAI 智源社区(转述 Anthropic 官方博客)

中文 AI 社区对 Anthropic 官方博客的转述,tier-2 聚合源

转述自一手官方博客,六条建议内容具体、与官方 prompt caching 文档口径一致;但非官方原文,具体措辞和细节需回官方博客核实,其中个别条目(如 /clear、effort level 切换致缓存失效)未直接佐证官方原文细节

延伸阅读

提示缓存失效机制 · link.baai.ac.cn 5 分钟
模型版本切换导致缓存失效是隐性成本最大一条,建议回官方 prompt caching 文档核实具体规则(TTL、cache_control 断点)
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store