GPT-6 Astra的上下文开多少合适

shc13765 2026-09-13 11:49 1

RT,大佬们用的时候上下文都设置的多少

最新回复 (17)
  • xiiiao 09-13 11:50
    1

    256

  • 买鸡狂魔 09-13 11:50
    2

    真有钱 用得起这个

  • ponyo 09-13 11:52
    3

    降至了 设置多少感觉都没用了。

  • leic-山水 09-13 11:52
    4

    272,本来就贵,长上下文x20都不好使

  • shc13765 楼主 09-13 11:53
    5

    @买鸡狂魔 #2 现在是周限,还有重置卡,一天一张还可以勉强用用,就是干活一会压缩一会压缩的很烦

  • ShowUNow 09-13 11:54
    6

    512k上下文注意力100%

    我选512k

  • Mosasaurus 09-13 11:58
    7

    1M

  • iArimaKana 09-13 12:08
    8

    同512k,5.6sol时候就用512k,体验挺好的

  • kevin77 09-13 12:08
    9

    拉到最高即可

  • shc13765 楼主 09-13 12:09
    10

    @ShowUNow #6 发布于2026/9/13 11:54:16,编辑于2026/9/13 11:54:30

    512k上下文注意力100%

    我选512k


    @iArimaKana #8 发布于2026/9/13 12:08:19

    同512k,5.6sol时候就用512k,体验挺好的


    感谢,我也调到512k试试

  • shc13765 楼主 09-13 12:10
    11

    @kevin77 #9 发布于2026/9/13 12:08:52

    拉到最高即可


    @Mosasaurus #7 发布于2026/9/13 11:58:49

    1M


    太高了怕有点吃不消,有点担心流口水

  • kevin77 09-13 12:11
    12

    @shc13765 #11 那就砍一半试试

  • shc13765 楼主 09-13 12:11
    13

    @kevin77 #12 嗯,我先试试512k

  • qiangwenjun 09-13 12:13
    14

    272默认的就行,但还如果你不喜欢开子代理,那频繁压缩肯定会丢细节,你就看看这个项目吧:billion-context,解决长会话中上下文窗口耗尽的问题——但不靠硬截断,而是把一个 compress 工具交给模型,由模型自己决定何时压缩、压缩什么、摘要里保留什么。

  • Kingrz 09-13 12:17
    15

    我记得astra上下文没有分段计费了?如果是这样开多少就看注意力的保持了

  • yiyezq162 09-13 12:30
    16

    我在用372

  • 大鸡吧 09-13 15:40
    17

    缓存也很贵啊,astra本来就贵

* 帖子来源NodeSeek
返回