GLM5.2 实际表现如何?

fregie 2026-06-18 09:57 1

很多自媒体都在说多强多强,实际体验又多强呢?

最新回复 (36)
  • Siiloo 06-18 10:00
    1
    我刚刚用了用 codex 修了一个鸿蒙的桌面卡片然后 codex 额度用完了,接着用 opencode go 的 glm-5.2 继续开发,然后就把桌面卡片搞炸了,把五小时额度都用完了也没有修好,没办法把 codex 额度重置了后五分钟搞定了
  • iwasthere 06-18 10:02
    2
    cc+glm5.2 表示和 gpt 差距还是很大,理解用户的意图混乱,gpt 我只要模糊的表达就能很好的明白我想干什么,沟通起来不费劲
  • xiaowoli 06-18 10:15
    3
    铺天盖地的广告,我感觉是怕股价掉下来
  • defaw 06-18 10:16
    4
    可以无监督移植 fluidnc 这种 cnc 程序,移植我的新电机,剪裁功能,重写单测,通过 qemu 执行,逆向分析 elf ,剥离 arduino ,自动重写 portinglib 兼容层,解决我的一切问题,而这一切就发生在昨晚凌晨,gpt 反正做不到,除非我开 pro 一直用 xhigh
  • fregie 楼主 06-18 10:18
    5
    居然出现了截然相反的使用体验
  • HHHans 06-18 10:35
    6
    感觉有 gpt5.4 的水平🤔
  • tommyshelbyV2 06-18 10:42
    7
    实测不如 kimi k2.7
  • lancevps 06-18 10:44
    8
    我在 ZCode 和 trae 用的 GLM5.2 ,我感觉比 GPT5.5 强,有很多问题他会自己审查第二遍才发给我答案,这点很赞
  • longaiwp 06-18 10:47
    9
    出现相反的评论这很合理,毕竟训练的数据有差异,再多点人来看看情况
  • sanqian 06-18 11:04
    10
    用了一次一直提示重新连接中 放弃
  • jimrok 06-18 11:06
    11
    glm 5.1 的套餐抢不到就说明了一些问题,人家真迈过可用的阶段。跟 claude 一样,如果有大量的人在用,那么每解决一个问题,就多一份数据。就好比模型已经懂了基本知识了,但实操过程非常不熟练,通过你们使用他,纠正他的错误,他会把这些经验融入到模型的记忆里,后续如果是重复考试,那就是一遍过。所以,你们让 GPT 写出规格说明书,规划了开发步骤,都是让 GLM 偷窥了别人的经验数据。
  • jimrok 06-18 11:07
    12
    反而是 MINMAX 这种,模型没迈过可用阶段,越没有人用,就越无法收集到数据。所以我觉得 DS 这种直接降价,让你用 ds 干简单活的方式,就是收集你的数据,这是每个人从徒弟到师傅的成长之路。
  • miniliuke 06-18 11:08
    13
    比 glm5 强太多了。和 gpt5.5high 比的话目前感觉不太出来(但是是真慢啊,跑一个任务半天,算力不够),模型差距不大,但是 gpt 的工程配套是真好
  • yvescheung 06-18 12:03
    14
    MiniMax M3 > Kimi K2.7 Code > GLM 5.2
    这几天使用下来的感受
  • defaw 06-18 13:10
    15
    再补充一个发布当天测的场景,kotlin 仿写了一套 jetbrains 的 compose dsl 的简化实现,实现大部分基础布局参数,随后基于这个渲染底座,构造了 html 解析器,实现了 html to compose dsl ,js 和 css 分别用 Rhino 和自建状态机实现,实现一个基本的 kotlin 版本的浏览器实现。
    总结一下我这几天的使用,简单任务用 glm5.2 没意义,毕竟他的输出速度只有 35tps ,写前端界面这种用 minimax 这种输出速度 70 以上的然后智力还过得去足够了,基础设施这种需要长期作为其他代码底座的东西才是最需要 glm5.2 的地方。
  • lyonll 06-18 13:51
    16
    看模型倍率最简单,谁愿意用贵的价钱用差的呢
  • datougua 06-18 13:58
    17
    搭配 zcode 用,比单独使用好很多
  • jackerbauer 06-18 14:11
    18
    5.5 和 GLM5.2 一起在用,感觉差距不是很大了。5.2 还是能打的
  • jlkm2010 06-18 14:16
    19
    足够用
  • FerrisCc 06-18 14:40
    20
    很玄幻 有点各说各话 自己试了才知道
    居然有觉得 MiniMax M3 强于 Kimi K2.7 Code 和 GLM 5.2 的
  • REALLYASD 06-18 14:43
    21
    我感觉如果你的 prompt 整理的很详细很具体,出来的活相当可以,不逊色 gpt5.5 ;但我用 gpt5.5 extra-high 的时候,基本是许愿式对话;
  • REALLYASD 06-18 14:45
    22
    @REALLYASD 但是 gpt 太便宜,找不到理由去订阅 glm ;买了个火山的 pro 备着了
  • yvyvyv 06-18 14:45
    23
    zCode 用了下免费的, 给他个功能给我分了 4 步 到第二步一半的时候 告诉我超限了,可能是付费才能有好的体验
  • wengjin456123 06-18 14:48
    24
    我刚在 codex 5.5 xhigh 给一个公司项目在线阅读软件加上切换页面的阻尼+动画+tips 告诉用户切换页面,5.5 xhigh 做出来的东西一会有 bug ,一会切页面特别快,我切 zcode glm5.2 ,立马发现了问题修复一条龙,有点费时间,大概 10 分钟,gpt 一般这种事 2-3 分钟。但是人家 glm 写的东西我可以交付,确实不错。我是老 lite 套餐。
  • wengjin456123 06-18 14:50
    25
    我一般是中低难度 kimi code + kimi k2.7 code ,中高难度以上 codex gpt5.5 xhigh ,最近 5.5 不太好用,全靠 glm5.2 救场。总不能我自己下场吧,那不是钱白花了,哈哈。
  • jedeft 06-18 16:34
    26
    @wengjin456123 kimi code 用的啥终端? kimi 官方的吗?有没有响应慢、过程繁琐、死循环之类的问题?
  • wengjin456123 06-18 16:38
    27
    @jedeft kimi code cli ,没你说的问题,就开箱即用就行
  • stanley0black 06-18 16:44
    28
    @yvescheung 哥们是认真的吗
  • longaiwp 06-18 17:36
    29
    @yvescheung 其他人说的情况也就算了,你这排序是不是过分了点,MiniMax 真的是治好都流口水的程度。
  • ixixi 06-18 17:40
    30
    有没有人比比和 deepseek 呢 ?
  • kaedea 06-18 17:41
    31
    比 ds4 更接近 opus 平替,但是价格没 ds 低。
  • beimenjun 06-18 17:55
    32
    这么说吧,GLM-5.2 肯定算是可以用的,根本不要怕被禁海外模型。

    唯一问题还是算力吧。
  • longaiwp 06-18 19:25
    33
    我下午用了一下,感觉比 DeepSeek 智能要高一些,写代码这一块比较细致,考虑得更全面,比如 HashMap 换 ConcurrentHashMap 不能放 null 这个 API 差异问题,Opus4.8 也没有第一时间想到这个问题,DeepSeek 也是,Gemini 3.5 flash 也是,但是 GLM 第一次就想到了,还是蛮特别的。我用的阿里云的部署,速度有点慢,偶尔会丢缓存,价格相当于 1/3Opus (按 Token 计费的),说实话比 DeepSeek 还是贵好多。
  • dingawm 06-18 19:40
    34
    @ixixi #30 比 DeepSeek 肯定是要强的,DeepSeek 弱在后训练,GLM5.2 应该算国内编程 T0 级别的了,但是和 Opus 4.8 还有 GPT 5.5 的差距那就见人见智了,和使用场景等都有关,还有一两次测试可能说明不了啥。
    我准备等等 DeepSeek 4.1 尝尝咸淡,希望能有个惊喜,没有惊喜就还是拿 GLM5.2 做备用了
  • dobelee 06-18 19:51
    35
    @jedeft 有,上月买了个尝试,cc 经常连不上,而且速度极慢。能力还 ok 。
  • yvescheung 06-18 22:28
    36
    @stanley0black
    @longaiwp
    在我一直用的测试环境下结果确实如此,最简单的一点,GLM 5.2 不听从提示词的概率远高于另外两个,很多单次的长编程的任务也不能做到一次就完成,总体顶多跟 Step 3.7 Flash 一个水平,营销水平倒是很强。
* 帖子来源V2EX
返回