对于真正干活的场景,国产厂商喜欢搞的按token计费相比于按价格计费,真的很亏

samaltmen 2026-06-20 16:46 1

按token计费,就相当于缓存与非缓存输入一视同仁,意味着你在一个会话对话越多,越亏。


这种按token计费只适合做小项目的小任务+每次新开会话才最划算。


智谱glm的每天免费300w token,在一个旧的会话里面,发一句话,glm5.2甚至还没看完代码,今天用量就耗光了。缓存率是98%-99%。

如果他是每天给5元 10元人民币用量,肯定不会出现这种情况。


国产厂商设计套餐的时候肯定不会按你长任务98 99%这种缓存率来计算,防止自己亏 肯定是最保守的比如90% 80%缓存率。


如果是按价格计费,对于这种长上下文,就非常划算(比如OpenCode Go跟ollama cloud的这种国外厂商的套餐,都是按价格计费)。

最新回复 (5)
  • iceberg01 06-20 16:48
    1

    DeepSeek官网的 API 还是按价格计费的吧,缓存率也很高,缓存也很便宜。GLM的套餐不知道有没有缓存?

  • 钟阮 06-20 16:48
    2

    GLM的套餐不知道有没有缓存?



    输入+输出+缓存创建+缓存读取


    的总和,=消耗

  • 钟阮 06-20 16:49
    3

    DeepSeek官网的 API 还是按价格计费的吧



    而且帖主用的是ZCode的体验套餐 ^-^


    压根不是付费的

  • iceberg01 06-20 18:23
    4

    那还是挺不错的,最近 OAI 也不当人,封了我48个月优惠码开的team号也不退款,正在找国产替代^-^

  • 钟阮 06-20 19:28
    5

    国产替代



    我个人体感是CC限速限流,尤其是高峰期


    论我OpenCode没429,然后单开CC帮我写个MD文档的左右,就能触发好几次429…


    但是周末非常爽,基本在50~200以内的T/S


    然后我有个参考值就是,Pro新版本套餐周限为3亿,如果全用高峰期,那就是只有1亿Token


    还有就是用哈雷佬的CurSor++丢到Cursor也挺好用的

* 帖子来源Linux.do
返回