对于大模型可以选择200K,400K和1M,是不是通常用200K默认就行了?

whoami 2026-09-24 19:02 1

对于大模型可以选择200K,400K和1M,是不是通常用200K默认就行了?你们通常用的哪一个啊

最新回复 (12)
  • Jack 09-24 19:05
    1

    是的 大部分200解决不了的400也不能解决

    不过可能有的任务没办法 堆到1m也得跑

  • Blackwood416 09-24 19:06
    2

    看用的什么模型以及在不在乎成本吧,在你给这几个档位里400K算是对大多数模型比较平衡的了,强的模型可以撑住1M上下文但是花费高,弱的模型注意力撑不住1M上下文

  • 咪叭 09-24 19:08
    3

    200K有点吃Harness了,400K会好点


    1M一般成本太高 收益不高我不用

  • Mordenkainen 09-24 19:09
    4

    贵的200k,便宜的400k,不要钱的1m

  • 时牧 09-24 19:09
    5

    codex用默认的就行,远程压缩是真好用,我用过质量最好的压缩,不用特意做上下文管理

  • NianForge 09-24 19:09
    6

    如果 DeepSeek 这种缓存很便宜的是拉高好还是低点好

  • codecat 09-24 19:10
    7

    400k,200k稍微有点紧凑了。

  • gobert 09-24 19:12
    8

    20万太少了,100万费用顶不住,grok build 的50万实际上最通用

  • loyicnaup 09-24 19:12
    9

    400k 我是够用的

  • JoeZhangYN 09-24 19:43
    10

    看任务的边界,一般来说272k,为什么是272k?因为openai的272k收钱分界线。1M上下文只是支持,但能力是边际下降的。

  • cyilin 09-24 19:49
    11

    个人感觉200k一会就到了,起码也得写400k

  • 中二骆驼 09-24 19:51
    12

    佬们上下文满了是选择压缩上下文,还是另开一个会话?

* 帖子来源Linux.do
返回