试着简单估算一下 GLM-5.3-Flash 不使用 Plan 的成本,目前结论没 Plan 别用

弦塔_ 2026-08-27 00:23 1

看到有一些朋友(佬友)在讨论 GLM-5.3-Flash ,所以试着简单估算一下 GLM-5.3-Flash 如果不使用 Plan 的成本

首先是价格展示:


























模型名称 输入价格 (元/1M Tokens) 输出价格 (元/1M Tokens) 说明
GLM-5.3-Flash 0.8
(限时 5 折: 0.4)
2.8
(限时 5 折: 1.4)
缓存命中: 0.23
(限时 5 折: 0.115)
支持图片/视频,限时两周
DeepSeek-V4-Flash
(deepseek-v4-flash)
空闲: 1.5
高峰: 3.0
空闲: 4.5
高峰: 9.0
缓存命中: 0.05 / 0.10

然后是实际用例,这里我以 DeepSeek 其中一天的消耗量来对比,暂时不考虑两家的缓存率:



那么:

最新回复 (19)
  • Ningbainb 08-27 00:24
    1

    差不多实际使用还是要比v4 贵一倍 但是应该比v4p便宜吧

  • 弦塔_ 楼主 08-27 00:25
    2

    除非是灰测的 V4p 不然目前的 V4p 就是一个炸炉的情况,不太适合用

    所以拿 V4f 来对比

    当然智谱是有 Plan 的,OpenCode Go 似乎也上了,有 Plan 的情况成本就有点难核算了

  • hirakawa 08-27 00:28
    3

    关键是最重要的,5.3f有多模态,不是瞎子

    其次,5.3f干活也比v4f强一点

    这些都是模型溢价的组成部分

  • 弦塔_ 楼主 08-27 00:29
    4

    强一点吗?那还是不影响没 Plan 别用的结论

    就我测试 ox 的情况来看,这个模型不值得付出 40 的溢价,更何况这里还没有拿智谱的缓存率说事

  • 中条智世 08-27 00:29
    5

    有plan也没有ds flash直接买api便宜,这plan也有高峰低峰的

  • 小K 08-27 00:31
    6

    你漏算了,5.3f的token消耗远小于dsv4,有人反馈差3倍。

  • 弦塔_ 楼主 08-27 00:32
    7

    给个链接或者数据,我看看去

    本来也只是简易估算来着

  • youer 08-27 00:34
    8

    5.3f有多模态



    dsf-exp也有多模态了吧,并且API价格和dsf一样,跑分还高一点


    虽然glm给出的跑分对比图中还是glm的模型更强

  • Q A 08-27 00:34
    9

    等第三方部署肯定比智谱的plan便宜,智谱的plan用flash的话,和OpenCode go的额度差不多,也就是1.5倍率

  • crepe 08-27 00:36
    10

    现在包5.3f便宜的 token效率高 晚上用or的d4f和glm5.3做 能明显感觉到glm的wild try少很多

  • 小K 08-27 00:37
    11



    知乎上说的。你可以自行实验。另外我实际使用,在codex用5.3f,不怎么说话,直接咔咔干活,不像dsf4话唠一个。

  • sandiferresner 08-27 00:37
    12

    glm 5.3 flash TOKEN 效率高是哪里来的说法, 有来源吗?




    我看看 aa 上差不多的呀

  • Kevin 08-27 00:38
    13

    确实,牛来卡卡干,ds一直碎碎念

  • sandiferresner 08-27 00:38
    14

    这个什么数据都没有, 有可信度吗? AA 上两者效率差不多的

  • 弦塔_ 楼主 08-27 00:39
    15

    虽然目前确实是g3f价格低我打算迁移过去看看效果了但是

    你拿一个知乎的评论就来当令箭,那和我目前直接得出没 Plan 别用有什么区别()

  • 小K 08-27 00:42
    16

    我让5.3f 修bug,找出3个网页的bug,改完它自己引入了bug,它又自己弄好了。这一顿操作,花了3m。按缓存90%算的话,大概0.3-0.5元。

  • 未命名 08-27 00:44
    17

    这个问题其实本质上是:按当前主流定价(假定价格上输入:缓存命中=10:1),长程任务缓存价格占主导因素。所以不能只看输入、输出价格,缓存命中才是大头。


    PS:zai的定价从商业角度看那是相当成功啊!

  • 弦塔_ 楼主 08-27 00:47
    18

    确实,缓存命中相当重要

    可能每涨价或者跌一分钱最终价格都会有不同

    比如说如果这里的v4f命中是0.04,那么命中的价格就是15.37,是0.025那么就是9.6

  • Ovear 08-27 00:52
    19

    看了眼数据还没稳定的OpenRouter,这两Weighted价格Input没啥差别,Output DS-4F会贵点,GLM-5.3F的Input缓存上去后应该还会降点。


    不过OpenRouter是全天混合负载,看不到峰谷数值;按照这个数据API就峰用GLM,谷用Deepseek,和隔壁另外一个帖的结论差不多。


    GLM-5.3F


    DeepSeek-4F-0731

* 帖子来源Linux.do
返回