ZCode 接入 gpt-6.1-sol 缓存命中极低:缺 prompt_cache_key 参数
关于Zcode使用6.1sol缓存命中极低的问题
ZCode 接入 gpt-6.1-sol 后缓存命中几乎为 0,输入全按全价计费,写个 spec 就耗尽 5h 额度。排查发现 ZCode 请求体缺少 prompt_cache_key 参数,导致请求无法粘到同一台缓存机器;同样的 sub2api 配置在 Codex 上命中率达 98%。
2026 年10 月 5 日 04:28 1
最近国庆 ZCode 能白嫖(每天1e),就把我 Plus 订阅挂到 sub2api 上,ZCode 接入 gpt-6.1-sol 用。
结果感觉不太对:写个 spec 的功夫,5h 额度直接打满。一看用量,缓存命中几乎为 0,输入全是全价……
一开始以为是 sub2api 的问题,切到 Codex 用同样的 sub2api + 6.1-sol,缓存命中一切正常(98%)。那问题就只能出在 ZCode 身上了。
我懒得查,直接把这事丢给 ZCode 里的 5.3f 让它自己排查自己,它翻了 ZCode 本地的请求日志,对比相邻几条请求:
- 前缀没问题,每轮纯追加、逐字节一致,序列化没毛病
- 但请求体里压根没有
prompt_cache_key这个参数
而 OpenAI 的缓存就是靠这个 key 把同一会话粘到同一台缓存机器上的,不带的话请求落到哪台机器纯看脸,命中率自然上不去。Codex 每个会话都带,所以它没事。
解决办法:在 ZCode 给 6.1-sol 加个自定义参数模板,把 key 补上:
{
"reasoning": {
"effort": reasoningLevel
},
"prompt_cache_key": "随便一个固定字符串",
"prompt_cache_retention": "24h"
}
5 个赞
估计Z/自己没想到还有人能外带GPT模型给他送数据吧,没做这个处理
3 个赞
zhongruan (钟阮) 2026 年10 月 5 日 04:30 3
专门给GPT和Claude适配过思维强度,感觉是故意的,
为了宣传glm+zcode的高缓存率
2 个赞
lrczcm (容易) 2026 年10 月 5 日 04:34 4
感觉就是故意的,那大那么大一家公司,接入第三方api缓存命中低难道都不会发现吗,做适配的时候openai文档都不看的嘛 ![]()
1 个赞
CPA 的话,用 chat completions 格式,CPA 会自己补上
zhongruan (钟阮) 2026 年10 月 5 日 05:10 6
好像还真的不咋看
他们家最开的responses没适配文件读取写入
![]()
1 个赞
来源:LinuxDo · linux.do