GLM 5.3 你是真牛逼吧

大鲨鱼 2026-08-19 11:36 1

首先大家对跑分不信任很大程度来自各家模型每次模型发布后,都会配上自己的跑分图,连豆包甚至都对标过 claude opus 和 gpt 5.5,下面全是小字营销,鬼知道它们怎么跑的



  • 此图为豆包模型发布时自己配的跑分图



所以 Artificial Analysis 榜应运而生,谁也不惯着,而且测试项目严谨专业,如果你关注 ai ,你会发现很多测评博主和社区都会优先依据此榜单,目前为止较为权威的榜单了,基本代表了真实体验




Artificial Analysis Terminal-Bench v2.1 跑分(最体现真实编程场景的权威测试)



GLM 5.3 用 753B 参数,做到了比肩 kimi k3 的 2.8T 超大模型,仅仅是在 GLM5.2 的基础上进行了后训练,且价格不变!


可能在 DeepSeek 眼里,这才是梁子想要 v4 pro 正式版达到的效果吧,可惜拉了坨大的,GLM 已经不屑于对标 DeepSeek 了(另外 DeepSeek v4 Pro 是 1.6T 大模型)


这才是技术力的体现,不是靠堆参数来强行力大砖飞,力大砖飞的代价就是成本高,所以 kimi 贵,DeepSeek 涨




OK,好的说完了,那么剩下该说:操你妈了


最新回复 (16)
  • meklo-DE 08-19 11:37
    1

    赢了就行

  • mesta 08-19 11:37
    2

    直接路由转移不就跑出来成绩了么?deepseek老套路了

  • EdwinMartin 08-19 11:37
    3

    k3后训练会更牛逼吧,非编程能力超越fable5?

  • krx 08-19 11:37
    4

    贵贵捏

  • hi2hi 08-19 11:38
    5

    还是不支持图片(难受

  • menzhu 08-19 11:38
    6

    总结:这价格不如继续用gpt

  • BANG 08-19 11:38
    7

    我使用了下,返工还挺多,可以的话还是得选claude/gpt

  • AaronNS 08-19 11:40
    8

    用不起

  • 小赤佬 08-19 11:40
    9

    但是前端k3确实不错

  • Whwitpohe 08-19 11:41
    10

    gemini3.7这么厉害吗, 平时用都不敢让他写除了前端之外的代码

  • happyfool 08-19 11:43
    11

    glm体感不如mimo (5.2^-^

  • 大鲨鱼 楼主 08-19 11:45
    12

    @meklo-DE #1


    不知道在阴阳怪气什么,虽然但是确实赢了,你气不气

  • waimao2024 08-19 12:01
    13

    前端代码 哪个最强

  • 这瓜保熟吗 08-19 12:18
    14

    GLM太慢了,我选择哈基米

  • hzy 08-19 12:25
    15

    用不起

  • sudoerx 08-19 12:27
    16

    好家伙

* 帖子来源NodeSeek
返回