GLM-5.3-Flash测评:牛呢?唐杰我问你牛呢??

HCPTangHY 2026-08-27 10:19 1


今早OpenRouter和Opencode上线了神秘牛来模型。
先放野榜
[image]
一开始在OR上测试,其不命中任何现存已知脏token。测试一度陷入绝望。不过看到站内帖子,果然在OC抓到了智谱的网关报错和zz甲流式拒绝
[image]
[image]
所以可以判断,智谱正在训练一款全新基模和分词器,原生多模态的新模型。至于是GLM5.5还是GLM6就不得而知了。
看几个案例 …




我真流汗了,这已经不是pony-alpha那样的降智了。那样的降智我都能接受,你这个直接拆除前额叶是什么操作?

正式版



竞技场/牛来



正式版





牛来





正式版



牛来



有1/3的case超过5轮没有把自己修好,判0分了


模型的代码质量极其极其差



你是人类吗


低分项在昨晚和今早经过了两次测试,二审维持原判。

这真有点过分了

最新回复 (19)
  • 赤足行进 08-27 10:26
    1

    是降智还是炼炸了,有人说ox是早期版本,5.3f应该最新版

  • Sokeu 08-27 10:27
    3

    这有点离谱了.


    换个工具再试试?


    可是比如AA, deepswe这些评测, 难道不是基于正式版的吗? 我看评测分都挺正常的啊

  • HCPTangHY 楼主 08-27 10:28
    4

    我的测评都是裸环境的,看其他群友的测试在zcode也并没有什么更好的提升

  • Sam Altman 08-27 10:29
    5

    这波其实是致敬 DeepSeek V4 Pro GA 有没有懂的

  • 淹没 08-27 10:29
    6

    实战这么拉吗…本来都有些心动想买个plan试试的。

  • WWT 08-27 10:29
    7

    这波磕到了

    终将成为你这一块^-^^-^

  • Ringo 08-27 10:31
    8

    上正式版了秀肌肉免费用的宝贵算力当然不能继续给客户用了。等别家部署了再试下吧,现在完全不如继续V4 Flash或者5.2。

  • usbwe 08-27 10:31
    9

    看样子上了coding plan就开始诓骗国人,

  • AmeowCAT 08-27 10:32
    10

    以为智谱良心发现了 结果是手段升级了 ^-^

  • fengchris 08-27 10:33
    11

    两眼一黑 这退步的太说不过去了么吧

  • xz-dev 08-27 10:34
    12

    你就看他那个 GLM coding plan,我从来没想过我也能体验到信创定价




    (我是真的买了)

  • Yostia 08-27 10:35
    13

    成猪来了,定价还这么高 ^-^为啥和匿名测试的表现差这么多

  • shock 08-27 10:36
    14

    信创定价



    哈哈哈,太给力了这个说法。


    又贵又不好用,专门国内圈钱。。。

  • MrQ 08-27 10:38
    15

    这就是 1/10 价格的代价吗?

  • 白芸汐 08-27 10:40
    16

    可能是小范围测测,算力给的比较宽裕,上线了就不能这么给你用了

  • 白鸟 08-27 10:41
    17

    你Pro后训练炸了,那我Flash也炸一下礼尚往来

    就是不知道有没有ds4proga发布那时一起来找补的鲸子,快进到我们正式版路由错了(

  • unsafetrait 08-27 10:41
    18

    我在ZCODE里测试了一个小范围的复杂任务,一坨屎啊,纯屎这模型,长程任务偷懒的非常厉害

  • LouisL 08-27 10:43
    19

    coding plan 又没有 1/10,才 0.4x,这么搞真的过分了吧。。。

  • MrQ 08-27 10:44
    20

    plan用户不如API,这种定价策略我是没想到的,不知道他们是不是忘了改

* 帖子来源Linux.do
返回