Codex 接入中转API 后上下文压缩不会命中缓存, 为什么没人提这个事?

透眸 2026-09-02 01:23 1



最新回复 (7)
  • 美帝码工 09-02 01:24
    1

    我记得上下文压缩本来就不会 hit cache 因为会剪裁 reasoning 和 tool call

    不过 240k 有点高啊,用的是 encrypted compaction 吗?

  • 白泽 09-02 01:24
    2

    这取决于中转的压缩模型配置吧,我cpa反代的一直都有缓存的

  • 透眸 楼主 09-02 01:31
    3

    encrypted compaction



    我认为剪裁 reasoning 和 tool call 是另一种手段。我记得 openclaw 有。

    我说的上下文压缩是指达到上下文阈值后由当前模型根据压缩提示词进行总结。然后开启新会话,填充好 Harness 预设的上下文后,将这次的总结作为新的用户上下文。

    已知目前 codex 和 Claude code 都是使用这种方案。

  • 透眸 楼主 09-02 01:33
    4

    不清楚是裁剪后压缩但是丢缓存(输入少)划算,还是直接压缩(命中缓存)划算。

  • 透眸 楼主 09-02 01:34
    5

    Claude code 能命中,Codex 不行。

  • 美帝码工 09-02 01:44
    6

    1. codex 使用的 encrypted compaction 和 claude code 完全不同,不是简单的 prompt based compaction。这是 codex/gpt 目前相比竞品最大的优势之一,能够显著提高长程任务的能力。限制是必须 name 为 OpenAI 或 Azure,否则性能显著下降。大部分中转支持这个功能。


    [model_providers.custom_api]
    name = "Azure"
    base_url = "<url>/v1"
    wire_api = "responses"


    1. 看了下源码,compaction 好像不会丢弃 reasoning,那么 cache miss 确实有点奇怪。有可能换了模型给你 compact 不过总不会 luna 换 sol 吧

  • 透眸 楼主 09-02 06:27
    7

    是个BUG,快一个月了还没修

* 帖子来源Linux.do
返回