cline pass的额度进度刷新太慢了吧,我以为很省呢

linganshi 2026-09-29 20:34 1

跟风买了个2刀的cline pass

来回对话了很多论,一刷新后台额度进度,

霍~才用1%的周限,怎么用得完。


然后出门吃个饭回来,再刷新,

霍~月限额都用了5%了

这延迟也太大了,我怀疑之前有人发帖说cline耐用完全是因为刷新太早了吧。

最新回复 (15)
  • wuula 09-29 20:47
    1楼

    得看和哪家比了,比如O某 ^-^

  • 3GZ 09-29 20:49
    2楼

    具体用的什么模型啊?不同的模型额度好像不一样了现在。之前都是统一50刀的,现在有些模型,尤其是K3感觉消耗速度快了很多。

  • tido 09-29 20:50
    3楼

    贴一些用量图呢


    那就是缓存问题了

  • linganshi 楼主 09-29 20:53
    4楼

    DeepSeek 4.1 flash

  • 3GZ 09-29 20:54
    5楼

    4.1我这边前几天用了用看是1亿≈1%月额度。

  • linganshi 楼主 09-29 20:55
    6楼

    额 我以为只有官方API区分峰谷呢

    这家也要分峰谷,那就不奇怪了

  • zining 09-29 20:58
    7楼



    额度掉得好快啊,我一直都是用的ds4.1f,这是咋回事啊佬们,我今天才订阅的(用了6亿左右token)

  • linganshi 楼主 09-29 20:59
    8楼

    我之前的对话上下文经常是接近跑满1M的状态,所以每次对话消耗巨高。

    所以我现在都把上下文窗口主动缩小了,限制到400K差不多,消耗就少了很多了。

  • aogo 09-29 21:01
    9楼

    想起那些订阅opencodego拿去用glm kimi的人了,我们都默认这些第三方订阅是 deepseek plan的

    用别的真不如claude pro

  • jeffccie 09-29 22:42
    10楼

    27亿用了50%还不错了



  • linganshi 楼主 09-29 22:43
    11楼

    我看了CPA的记录,是有些大上下文的请求缓存突然失效了,导致单个请求就是0.2-0.3刀。现在我限制上下文了,就怕缓存莫名其妙失效

  • jeffccie 09-29 22:44
    12楼

    这就不要用CPA了吧,感觉缓存失效,还是直连更好

  • linganshi 楼主 09-29 22:45
    13楼

    我感觉是cline今天有抽风,那个缓存失效的请求前后不少失败请求。TPS也掉很低,都个位数了。

  • 时牧 09-29 22:48
    14楼

    上下文限制400k试试

  • kingstacker 09-29 22:51
    15楼



    一个月将近45亿。 ^-^

* 帖子来源Linux.do
返回