dph缓存高是harness的功劳吗

Ruan222123126 2026-08-14 00:19 1

感觉只要使用的harness只要不太离谱,高强度使用缓存都有99,当然,我也没量化测试过,但是现象确实就是这个现象,感觉不是harness的功劳

有些晚,太迷糊了,平时不熬这么晚的,打完这个帖去睡觉了,别笑我,harness打成humaness了(已改好,目测应该没有其他错别字,有可以提出,立马改)

最新回复 (12)
  • apparition 08-14 00:22
    2

    的确不是

    但自己手搓还是有点困难的

  • Ruan222123126 楼主 08-14 00:23
    3

    额,没有说完美平替吧,为什么会扯到完美平替上去

  • Ruan222123126 楼主 08-14 00:24
    4

    哥们我确实打错了但是人皆有错我马上改了不用这么说吧

  • Ruan222123126 楼主 08-14 00:25
    5

    如果影响到你刷帖了我向你道歉,不过下次语言不要那么尖锐

  • 惊鱼 08-14 00:26
    6

    主要还是DeepSeek infar的功劳吧

  • 张全蛋 08-14 00:26
    7

    你说的没毛病,和harness没有关系。无论怎么写最终都是调用api

  • Ringo 08-14 00:26
    8

    90%是CC里用的,而且CC+DS都说缓存命中率低,在我这几个任务来回切都稳定95%+,只能说模型本身就有这个特点。

  • ciarany 08-14 00:27
    9

    这个缓存是指prompt缓存还是kv cache

  • code 08-14 00:27
    10

    这几天用grok build 搭配opencode go的ds4f,缓存一直是99左右

  • aeroides 08-14 00:27
    11

    这缓存差不多啊,无非就是每次输入附加的信息少,CC 还会附加一些 git status 和 agent status,即使这样我用 K3 也能 98%cache hit

  • Ruan222123126 楼主 08-14 00:36
    12

    指最终在历史看到的缓存,不过主要是KV Cache优化好,所以harness只要提示词策略不要太夸张都能命中

  • JARK006 08-14 00:56
    13

    首要功劳:harness做到前缀上下文完全一致,或者尽量将不易变动的内容尽量安排到前面(例如若把AGENTS.md内容放前面,一旦涉及到该文件改动,下一轮对话就是一次新的上下文,要重建缓存)。


    次要功劳:deepseek对KV缓存的长有效期,之前听说好像是几小时到一天,上午暂停的对话,下午接着干,还能续上缓存。而 GPT、A\ 在高峰期好像就几分钟,再多可能就一小时,一个会话若10分钟你没接上话,缓存就没了,你的下一句就得触发整个会话的缓存重建。


    两者一综合,就是deepseek缓存命中高的结果。

* 帖子来源Linux.do
返回