跳到正文
LinuxDo· 容易·· 6 小时前AI 评分22

ZCode 接入 gpt-6.1-sol 缓存命中极低:缺 prompt_cache_key 参数

关于Zcode使用6.1sol缓存命中极低的问题

AI 导读

ZCode 接入 gpt-6.1-sol 后缓存命中几乎为 0,输入全按全价计费,写个 spec 就耗尽 5h 额度。排查发现 ZCode 请求体缺少 prompt_cache_key 参数,导致请求无法粘到同一台缓存机器;同样的 sub2api 配置在 Codex 上命中率达 98%。

正文

2026 年10 月 5 日 04:28 1

最近国庆 ZCode 能白嫖(每天1e),就把我 Plus 订阅挂到 sub2api 上,ZCode 接入 gpt-6.1-sol 用。

结果感觉不太对:写个 spec 的功夫,5h 额度直接打满。一看用量,缓存命中几乎为 0,输入全是全价……

一开始以为是 sub2api 的问题,切到 Codex 用同样的 sub2api + 6.1-sol,缓存命中一切正常(98%)。那问题就只能出在 ZCode 身上了。

我懒得查,直接把这事丢给 ZCode 里的 5.3f 让它自己排查自己,它翻了 ZCode 本地的请求日志,对比相邻几条请求:

  • 前缀没问题,每轮纯追加、逐字节一致,序列化没毛病
  • 但请求体里压根没有 prompt_cache_key 这个参数

而 OpenAI 的缓存就是靠这个 key 把同一会话粘到同一台缓存机器上的,不带的话请求落到哪台机器纯看脸,命中率自然上不去。Codex 每个会话都带,所以它没事。

解决办法:在 ZCode 给 6.1-sol 加个自定义参数模板,把 key 补上:

{
  "reasoning": {
    "effort": reasoningLevel
  },
  "prompt_cache_key": "随便一个固定字符串",
  "prompt_cache_retention": "24h"
}

5 个赞

估计Z/自己没想到还有人能外带GPT模型给他送数据吧,没做这个处理

3 个赞

zhongruan (钟阮) 2026 年10 月 5 日 04:30 3

专门给GPT和Claude适配过思维强度,感觉是故意的,

为了宣传glm+zcode的高缓存率

2 个赞

lrczcm (容易) 2026 年10 月 5 日 04:34 4

感觉就是故意的,那大那么大一家公司,接入第三方api缓存命中低难道都不会发现吗,做适配的时候openai文档都不看的嘛 :face_with_hand_over_mouth:

1 个赞

CPA 的话,用 chat completions 格式,CPA 会自己补上

zhongruan (钟阮) 2026 年10 月 5 日 05:10 6

好像还真的不咋看

他们家最开的responses没适配文件读取写入

:joy:

1 个赞

来源:LinuxDo · linux.do