Claude Code /cost 缓存命中率怎么看
2.1.251 起 /cost 增加本会话缓存明细,能看命中率、未命中次数、重新写入的 token 以及冷热状态,状态栏脚本也可读同一对象。

claude code /cost 缓存命中率怎么看:2.1.251 给 /cost 加了一行本会话的 prompt-cache 明细,字段是 hit ratio、misses、tokens re-cached,以及 warm/cold。status line 脚本能读到同名的 prompt_cache 对象。以前只能在供应商账单或网关日志里猜命中;现在终端里就能对这一轮对话。
四个数字各表示什么
hit ratio:这一会话里缓存读成功的比例。misses:没打中的次数。tokens re-cached:因未命中又重新写入缓存的 token。warm/cold:当前前缀算热还是已经冷掉。
Changelog 没写百分比公式是按次数还是按 token。对比两次 /cost 时用同一会话,不要跨 --resume 把两段会话的行加在一起。status line 若自己画条,读 prompt_cache,别去解析 /cost 的英文句子。
这和「允许缓存留多久」不是同一旋钮。TTL 怎么设见 promptCacheTtl。命中率低先看 TTL 和网关有没有丢掉 cache 头,见 网关 prompt cache。
什么时候这一行会很难看
OAuth 刷新后工具定义重绘,2.1.248 修过大约每小时一次的整段未命中。2.1.251 的这一行会把那种 miss 变成可见数字,而不是你只觉得「这一轮突然贵了」。
--resume 时若账号进过 usage overage,旧版会因 ScheduleWakeup 工具定义变了而在第一回合全量 miss。升到 2.1.248+ 后这条应少见;若 /cost 仍显示刚 resume 就大量 re-cached,把版本和是否 overage 一起记下来。
走中转、自定义 ANTHROPIC_BASE_URL 时,供应商侧的 cache 语义可能和 Anthropic 直连不同。终端行是客户端统计,账单是供应商统计。对账、报费用终端对不上的数时,按供应商账单做钱的决定,终端行只用来调参。
和 Spend limit 条不要读串
同版本 /usage 给走 Claude apps gateway、并且网关设了花钱上限的人加了 Spend limit 条,status line 多了 rate_limits.spend_limit。那是「还能花多少」,不是缓存命中。网关触顶文案怎么读,见 网关额度警告。
两条同时出现很常见:命中率很低导致 burn 快,Spend limit 跟着掉。先把 cache 行看热,再谈加网关额度。
怎么用来省钱
- 升到 2.1.251,
/cost看有没有 prompt-cache 行。没有就还在旧客户端。 - 同一长会话隔十几分钟发一条短跟进,看 hit ratio 是否还在、是 warm 还是 cold。
- 短命子代理很多而 re-cached 暴涨:子代理 TTL 不要拉到和主会话一样长。
- 会话成本习惯见 会话省钱,那篇讲的是用法,这篇只讲怎么读新行。
status line 已经能画用量的人,把 prompt_cache 接进去比再开一个监控进程便宜。