GLM 5.2 王朝了

arlo_do 2026-06-17 15:30 1

新鲜出炉的评分,智商紧咬 Opus 和 GPT,超越哈基米。Agent 能力跻身 TOP 3。


AI Arena 上更是给前端开发能力以极高评价,仅次于Fable 5




最新回复 (19)
  • 熊猫抓虾 06-17 15:31
    1

    智谱: 我竟然有这么强,我怎么不知道 ^-^

  • L 06-17 15:35
    2

    ^-^ 为什么不升级一下自己的算力?融资融了干嘛的?

  • ruchen 06-17 15:37
    4

    这不正忽悠投资人呢,比如这个帖子排名。


    不过真忽悠到它可能真能成,确实开源里面妥妥的天花板

  • listening 06-17 15:37
    5

    希望其它国模奋起直追,同行已经打好样了。

  • QYY 06-17 15:38
    6

    有没有可能融了钱去接官方正版API开中转站蒸馏数据、训练模型了,然后发现没钱升级算力了。。。 ^-^

  • user2983123 06-17 15:38
    7

    问题从来都是买不到,不是没钱买。

  • Honyee 06-17 15:39
    8

    啥评测啊,Gemini flash能跑到Pro前面去,是使用人数吗

  • wxyzh 06-17 15:39
    9

    也许,可能是给阿姨和旺仔付货款啦。

  • sooo 06-17 15:40
    10

    图中的 4.8opus 高于 gpt5.5-xhigh,就我平时开发感受,gpt5.5-xhigh 明显好于 4.8opus,所以这还得看个人使用吧

  • LLMeme 06-17 15:41
    11

    都跨代了不一样很正常,3.5Flash的价格也快赶上3.1Pro了

  • Lyra Celeste 06-17 15:41
    12

    能刷评分的 一般都不靠谱,亲身写点东西试试就好了。

  • Erez 06-17 15:42
    13

    在指名道姓某公益站吗 ^-^,明天域名就到期了 ^-^

  • wool 06-17 15:44
    14

    每次智谱发新模型 都要庆幸当初我的老套餐没有退订

  • mole_on_the_moon 06-17 15:45
    15

    看上去确实不错,但是始终拿不到他的coding plan。同时我内心还是偏向于信任梁圣的ds这种不刷分的,而且通用性的。创新才是我最信任的东西。以ds的基模加好好后训练,国内算力好好干,后续加上多模态,那就真的是厚积薄发了。我对于国模的评价偏向于厚积薄发,因为在算力紧缺环境下的极限求生式的创新。后续只要算力有细微突破都会带来难以想象提升。加油吧国模,崛起吧,国模,现在掏钱都要看外国佬脸色的日子真的一天都不想继续了 ^-^

  • wurengnong 06-17 15:46
    16

    为什么不能像ds一样爽用哦,这api价格好贵

  • Gray Paris 06-17 15:46
    17

    实测了一下,opus4.8在需求不清晰的情况下,会在cc中向用户确认需求,而在国模中,只有GLM5.2能稳定做到类似opus的向用户确认需求的情况,其他国模只会闷头苦干

  • 你好❤️ 06-17 15:49
    18

    其他国模只会闷头苦干



    麻烦带上gpt-5.5,闷头瞎干 ^-^

  • 相遇不识君 06-17 15:54
    19

    deepseek v4都没融资,上来以后各渠道铺开用都没有智普它这么卡。

    我都怀疑这家到底有没有拿钱去扩展基础设施啊,光买地和玩金融游戏了么

  • 潮汐 06-17 15:55
    20

    跑分这块,只服雷军的小米手机产品,不服跑个分

* 帖子来源Linux.do
返回