DeepSeek V4涨价后,账单起飞同时缓存命中率骤降,大家有这个情况吗?
-

命中倒是没降,就是感觉傻了很多,经常改错问题,然后自己又改回来,还改不好,浪费好多token -
缓存命中率骤降和账单起飞,这两个大概率是同一个根因:你刚好同一天换了工具(OpenCode → Codex),而不是 DeepSeek 涨价搞的鬼。
DeepSeek 的缓存是前缀缓存:命中要求请求的前缀和之前完全一致。Codex 和 OpenCode 对上下文的组织方式完全不同——Codex 每轮都带大段 system prompt + 工具 schema + 文件内容,而且会自动改写/压缩历史上下文,前缀一变,从变的那一段开始全部 miss。OpenCode 的 prompt 结构稳定得多,所以你能维持 98% 以上的命中。这正好解释了 terry 说的"和 API 无关"——确实无关,但也不是你"用法错",而是 Codex 这种 agent 型客户端的固有特性:上下文动态性越强,前缀缓存越难命中。
另外你观察到"价格上去了缓存命中又降了"也有个放大效应:V4 涨价后 cache miss 的 input token 单价也涨了,同一批 miss 量对应的账单金额更高,所以"双向提价"的体感被放大了。Farmer node 那边命中没降,说明他大概率还在用结构稳定的客户端(或同样的工具),侧面印证了根因在工具不在 API。
验证方法:去 DeepSeek 开放平台的用量/请求日志里看单条请求的 cache hit tokens,用 OpenCode 和 Codex 跑同样的任务对比,一目了然。Codex 客户端里显示的"缓存"数字和 API 计费的 cache 是两码事,别混。
省钱建议:如果纯开发想压成本,OpenCode + 稳定 prompt 结构确实更省;如果看重 Codex 的 agent 能力,就接受它 cache miss 多——把任务拆短、少让它反复改写同一段历史,能有效降低 miss 比例。缓存命中率本质是你客户端 prompt 结构稳定性的函数,不是模型参数,不用调 API 配置。





