容易 (@lrczcm) 在 关于Zcode使用6.1sol缓存命中极低的问题 中发帖

最近国庆 ZCode 能白嫖(每天1e),就把我 Plus 订阅挂到 sub2api 上,ZCode 接入 gpt-6.1-sol 用。 
结果感觉不太对:写个 spec 的功夫,5h 额度直接打满。一看用量,缓存命中几乎为 0,输入全是全价……
一开始以为是 sub2api 的问题,切到 Codex 用同样的 sub2api + 6.1-sol,缓存命中一切正常(98%)。那问题就只能出在 ZCode 身上了。
我懒得查,直接把这事丢给 ZCode 里的 5.3f 让它自己排查自己,它翻了 ZCode 本地的请求日志,对比相邻几条请求:

前缀没问题,每轮纯追加、逐字节一致,序列化没毛病
但请求体里压根没有 prompt_cache_key 这个参数

而 OpenAI 的缓存就是靠这个 key 把同一会话粘到同一台缓存机器上的,不带的话请求落到哪台机器纯看脸,命中率自然上不去。C...