Gemin的PRO额度消耗猜测

LIN-2077 2026-06-26 23:17 1

个人感受

有记忆数据的Gemini和无记忆数据的Gemini

好像有记忆的Gemini消耗Pro额度的速度会更快

这是否是对深度使用用户的一种隐形剥削呢 ^-^

最新回复 (11)
  • Kingrz 06-26 23:19
    1楼

    你的 memory 是不用当作input的吗???


    如果你不想用记忆,把 memory 关了不就行了

  • Kingrz 06-26 23:19
    2楼

    大晚上还能看到乐子,晚上睡不着了

  • Aphrodite 06-26 23:21
    3楼

    这些记忆肯定要给你塞到上下文里,不然模型怎么知道发生了什么

  • LIN-2077 楼主 06-26 23:28
    4楼

    @Kingrz #2 ?我这怎么又乐子了,我的记忆配置很短,就几句话,但是额度消耗的速度是无记忆的两倍差不多

  • Kingrz 06-26 23:31
    5楼

    @LIN-2077 #4 那你在帖子里说了吗,乐子+1

  • Kingrz 06-26 23:31
    6楼

    @LIN-2077 #4

  • LIN-2077 楼主 06-26 23:33
    7楼

    @Kingrz #6 那我去学学写公文再来发帖子好了 ^-^

    耽误您的眼睛了 ^-^

  • Kingrz 06-26 23:34
    8楼

    @LIN-2077 #4 而且有没有可能虽然你的memory很少,但是影响了模型的思维链,thinking token暴增呢?


    “好像有记忆的Gemini消耗Pro额度的速度会更快”?这不是必然的吗?至于额度多了多少,具体的思维链你也看不到,觉得不划算关了就行了

  • Kingrz 06-26 23:35
    9楼

    @LIN-2077 #7 不耽误,笑一笑也是一个收获

  • sandlong 06-26 23:41
    10楼

    我也感觉1楼说话有点冲


    楼主的吐槽“对深度使用用户的一种隐形剥削”其实挺有意思的,从商业角度来说记忆占用的token确实不应该算在token用量里,因为这也算是对这些用户的subsidization。要不就应该只按对话轮次算用量

  • LIN-2077 楼主 06-27 00:15
    11楼

    @sandlong #10 因为我是多个号一起用的,大号用完就用家庭组的小号,因为小号就是临时应急一下,然后我做同一个项目的时候,同类型的问题,大号(有记忆)问2-3个问题就差不多消耗20-30%的额度了,小号(无记忆)同样情况却大概只消耗大概15-20%这样子,感觉有点夸张了 ^-^

* 帖子来源NodeSeek
返回