长编程怎么有效控制上下文爆炸

知秋意 2026-08-01 22:30 1

快接近 20w token 了


有啥技巧嘛

最新回复 (4)
  • ldm2060 08-01 22:30
    1

    让AI用sub-agent派发,主对话只输出需要用户确认的信息和最终报告

  • awoaCrim 08-01 22:32
    2

    20wtoken也就200k上下文,算是比较少的了。如果用的是cc可以在配置里面配"CLAUDE_CODE_AUTO_COMPACT_WINDOW": “256000”,这样就能在快到达上下文上限时自动压缩。

  • wuxubiao 08-02 00:23
    4

    20W才哪到哪,随便拿一个会话都有几个亿的总量,用一些像magic context 之类的插件吧

  • jcc 08-02 00:25
    5

    200k才到哪?


    opus,glm5.2,dsv4,基本上到了200k是性能最好的时候,超过六七百k,才会有性能下降


    上下文少的时候,模型知道的太少,反而会不稳定

* 帖子来源Linux.do
返回