GLM-5.3-Flash测评2:反转?API才是真牛来?

HCPTangHY 2026-08-28 00:00 1


[image]
我真流汗了,这已经不是pony-alpha那样的降智了。那样的降智我都能接受,你这个直接拆除前额叶是什么操作?
正式版
[image]

竞技场/牛来
[image]

正式版
[image]
[image]

牛来
[image]
[image]

正式版
[image]

牛来
[image]

有1/3的case超过5轮没有把自…


RT,今早通过coding plan测试的glm 5.3 flash简直不能用区来形容了,简直就是屎。

晚上看到站内佬友帖子


https://linux.do/t/topic/2820585


这个差距太大了,不太对劲,立刻去重测了我的bench。

没有那么多时间所以就把昨晚和今早的低分项测试了,其他正常分数的沿用了CP跑分。



结果简直震撼我妈





牛来都没有做完美的题目API做对了



MC也恢复了牛来水平

所有case几乎都是一遍过,没有多余的返工重修

我用错API了?


这对么?这对么?这对么?

难道CP用户用到的都是GLM 5.3 Flash Lite?


======后记======

本次使用的OR的API版本,写完之后突然觉得不严谨返回去重新找了一下返回体,供应商为ZAI的和GMI/Novita的差异性并不大(上面的MC就是ZAI供应商),至少说明智谱开源出来的模型是没问题的,其API部署理论上也没问题,但为什么CP里用到的就是臭区呢?太诡异了


总之不太严谨,欢迎各位自行测试对比!

最新回复 (15)
  • alizoed 08-28 00:03
    1

    依旧节省成本,跟O\学的是吧,

  • GMYXDS 08-28 00:03
    2

    啊?差别有这么大吗?这是一个模型吗?是不是降低精度了?

  • 咪叭 08-28 00:03
    3

    还有这种事情?


    难不成Coding Plan用户用的是8bit量化+8bit量化 KV的


    然后API用BF16?

  • HCPTangHY 楼主 08-28 00:03
    4

    但是看其他佬友计算的,CP里的实际上比API更贵。就很诡异,,,

  • ZeusFunk 08-28 00:03
    5

    而且 tps 貌似也不太一样,我不知道哈,api我这边30-40 plan50-60 ^-^

  • 3GZ 08-28 00:05
    6

    我也是30多T,我还好奇这模型怎么比大哥还慢呢?

  • HCPTangHY 楼主 08-28 00:05
    7





    是的,,,快小一倍

  • 土土先生 08-28 00:05
    8

    啊,如果有降智,那岂不是等于在吃屎?

  • lisa111120 08-28 00:06
    9

    那open code也回降智吗,正好有个没用完的open code

  • heymeow 08-28 00:07
    10

    跟o/学的订阅降智吗?g/你这家伙,被称为中国a/不是没有原因的啊…

  • leonvxe 08-28 00:08
    11

    昨天半夜 5.3也降智, 前半夜coding plan 还用不了5.3flash,工程师半夜在加班部署 ,估计在切换模型部署的时候,估计都路由到了低端模型扣费 ^-^

  • 关注塔非喵 08-28 00:18
    12

    glm to c实在是太傲慢了, 从最开始的低价引流, 到涨价背刺,到再背刺,早就没有信誉了,就算想用glm家的模型,随便找一天其他家的glm,速度都要更快。。。。。自己体会吧。。。

  • 宁 河图 08-28 00:20
    13

    就是降智版本的,我测试了一下,qq佬的公益站模型比opencode里面的智商高

  • OpenAI_Q-Star 08-28 00:51
    14

    所以5.3 flash 在OR 应锁定ZAI/GMI/Novita

  • c.skeleton 08-28 00:55
    15

    意思是订阅用户用更贵的价格换来了更弱智的版本?

* 帖子来源Linux.do
返回