DeepSeek-v4-flash的自动压缩上下文设多少合适

finelly 2026-08-02 23:05 1

佬们,你们的DeepSeek-v4-flash的自动压缩阈值设的多少,0.9到后面会不会性能下降很厉害

最新回复 (8)
  • sandiferresner 08-02 23:10
    1

    我设的是 256K. 用opencode 的话推荐试一下 magic context 这个插件, 管理上下文膨胀效果很好.

  • 夏天爱吃菠萝大西瓜🍉 08-02 23:17
    2

    虽然 ds-v4-flash-0731 支持1M,但是我实测,最佳上下文窗口在450~680K之间,个人建议取中间550K最好,超过这个上下文,我能明显感觉到上下文丢失、不太遵守规则等,有时候还没达到这个其间也开始有一点点出现,所以我个人推荐 550K

  • Decidable6471 08-02 23:19
    3

    1 - 1/e = 63%

    直接来个god

    别人问的话,直接数学上碾死他们

  • orangexd 08-02 23:20
    4

    我用的PI,加DCP插件,无论上下文多大,只要开始一个新的需求,与上文关系不大,就主动去压缩总结。用的gpt5.6,正常都不会超过200K。个人觉得不管是费用还是注意力精度都会比较好,有效的信息远比大量无用的垃圾更好,这也是DCP插件的思路

  • dirtyfancy 08-02 23:22
    5

    0731 的agent 能力真的好强啊,但写代码我目前还不太敢交给它,等pro 正式了,现在主要用它改改alias json 配置啥的,但确实改的又快又好,所以就没啥上下文管理的必要哈哈

  • neofetch 08-02 23:38
    6

    你用的是 @pi-vault/pi-dcp 这个吗?

  • darkstarrd 08-02 23:39
    7

    我在omp里开luna作为advisor


    400以上就已经不行了,基本每次都会被advisor插嘴找茬,还是200左右的相对好很多

  • 钟阮 08-02 23:43
    8

    我一般1M的模型限制400k,无论测出来的大海捞针/召回啥的多牛逼,


    GPT倒是遵循官方的限制272

* 帖子来源Linux.do
返回