GLM5.2 个人感觉有点被吹大了

hihihihihi 2026-06-19 13:42 1

前几周用了几天 Claude-fable-5 模型,确实很明显的感觉准确率非常高,理解能力也非常高,基本一遍过。在这个之前我大部分使用 Opus4.8 以及 Sonnet4.6, 理论上我用 sonnet 4.6 更多。


这段时间看 GLM 这么火,我也凑热闹去抢了下,一直没抢到,干脆购买了国外版本的 z.ai 的套餐。这几天重度使用了一下,说说我的感受:


前提:我都是用的 claude code cli




  1. GLM5.2 有点话痨,有的时候说一堆话,甚至大段重复,不够言简意赅





    1. GLM5.2 对整个项目的把控不如 claude code ,要 GLM 做一个功能,他有时不先去看程序是不是有什么已经做了的,或者是否影响别的地方,就是感觉整个考虑不周到,要我来指正。 我明白很多时候需要描述更清晰需求,但是有的需求应该是显而易见的。 这点我感觉全局上,fable > opus > sonnet > glm




  2. 慢,卡,经常一个小问题,要搞好几分钟,明显提赶上 claude 效率要更高。




所以总结起来说:相对目前所谓可用模型第一来说,我觉得 GLM5.2 过誉了,理解能力欠缺,整体把控能力不够,效率不够高。总的来说也是国产模型里面一梯队的,但是和 claude 确实还有半年到一年的差距。


PS:个人意见,很主观,仅供参考。

最新回复 (20)
  • wombat 06-19 13:49
    1
    确实是这样。 昨天对比了 GLM5.2 ,Cursor Composer2.5 ,GPT5.5 ,Opus4.8 。 确实 GLM5.2 还是有差距。慢的话,可能是因为部署的问题? zai 的算力不足? 但相比 GLM5.1 ,确实提升了不少,特别在多 agent 任务上,但感觉思考深度更深,时间更长,知识比较老。
  • woodnaonly 06-19 13:50
    2
    Cursor Composer2.5 也能放到 GPT5.5 ,Opus4.8 一个梯队了?
    @wombat
  • wombat 06-19 13:56
    3
    @woodnaonly 整体智力上肯定不行。但写日常代码我用起来感觉有点 opus 的感觉。 主要 Composer 速度快,干活还可以。
  • wombat 06-19 13:59
    4
    @wombat 模型各有各的优点,我觉得 composer 是能干活的,行动不拖泥带水,比 GLM 的行动更简洁。 个人比较喜欢。
  • toubi 06-19 15:44
    5
    glm5.2 还是可以的,每个人的项目不一样,所以每个人用下来都是有不同感觉的。我整体感觉下来和 gpt5.5 大差不差。至于你说的慢卡,你可以去使用硅基流动的,速度超级快,30 多分钟就花了我 30 元。
  • MuyuQ 06-19 15:53
    6
    你都把 glm5.2 和 4.8 放一起对比了。
    已经是巨大的进步。
    期待 glm6.
  • huanxianghao 06-19 16:11
    7
    Opus4.8 感觉也挺降智,让它编辑个文档,还给我搞重复内容了
  • zxjxzj9 06-19 16:22
    8
    @woodnaonly 快就是好,好就是快.... 天下武功唯快不破
  • weiyunjun 06-19 17:06
    9
    你居然还真的花钱测试国模啊,有点震惊。不过长个记性也好。下次冲动的时候去隔壁站先看看有没有白嫖的渠道。理性消费!
  • woodnaonly 06-19 20:01
    10
    @zxjxzj9 请多多支持豆包
  • herozzm 06-19 20:08
    11
    请问你国内哪一家大模型不是过渡吹捧的?你不吹就没人用
    一坨屎也吹成金凤凰
  • wolfie 06-19 20:11
    12
    试试 gpt-5.5 看看什么叫废话连篇
  • NewYear 06-19 22:04
    13
    国内的为啥一直追不上第一梯队呢

    难道是因为语料太少,还是因为人家国外的买书扫描进去做语料所以更加聪明?
  • YanSeven 06-19 22:41
    14
    @NewYear 从根儿上就缺卡
  • v400127 06-20 00:41
    15
    宣传是有些过,目前做些不疼不痒的东西还行,比 minimax3 好多了
  • royo 06-20 01:16
    16
    不要看模型怎么说,看他们的定价。如果国产这些模型真的追上甚至超越 claude 和 gpt ,要么这个模型涨价、要么 claude 和 gpt 降价,资本最诚实了。
  • nVic 06-20 08:24
    17
    他们花了大量钱买评论喔,代码质量也就那样。
  • crocoii 06-20 14:24
    18
    claude 家只有 fable 还可以,opus 降智降的感觉都不如 deepseek 了。
  • MIUIOS 06-20 19:36
    19
    哪个性价比高用哪个,一个 CRUD 场景又不是造火箭要啥顶模
  • cubecube 06-21 10:49
    20
    @NewYear 英伟达,另外国内付费用户能够提供的资金比国外少太多,没办法快速变现继续堆规模
* 帖子来源V2EX
返回