智谱的模型慢是没有算力,还是模型的问题啊

CZ 2026-06-17 15:44 1

不专业,不太懂智谱为啥一直这么慢,跑着跑着就断了,GLM5.2 确实挺好,5 的时候就觉得好用了,但是慢实在受不了啊。


有用过别的云部署的么,慢不慢

最新回复 (19)
  • BreakFeeling 06-17 15:49
    1

    至少飞书群里面,工作人员的理由是卡不够

  • HeriX 06-17 15:50
    2

    智谱一方面是缺算力

    二方面是coding plan超售

    所以高峰期慢, 容易限制, 断流

  • ludi gllt 06-17 15:51
    3

    本来还在找便宜点的咸鱼代抢的,看到佬友的帖子就打消念头了,我还是去玩我的free注册机去吧 ^-^

  • jcc 06-17 15:53
    4

    低价套餐慢,基本就是用的人多,算力不够


    真想快的话,把算力加上去肯定是能快的


    参考glm-5.1高速版可以做到 800每秒的输出,glm-5.2的架构是一样的,所以高速版也可以的


    只不过,价格肯定要上天

  • 星火花葵 06-17 15:53
    5

    确实是缺算力,超售的本质也是缺算力,缺算力了才会“超”


    还有字节的seedance2.0无限排队、额度暗改克扣等争议的根源也是缺算力


    国内苦缺算力久矣。。

  • Nul1_ptr 06-17 15:53
    6

    纯算力问题,因为官方5.1/5.2都没有更新paper,那说明架构没变,75/78是MOE,注意力还是DSA,这种情况下硬件要求甚至低于DeepSeek V4,看看A/的服务就知道ZAI还是太缺卡了

  • Skinger 06-17 15:54
    7

    缺算力,而且超卖了。大模型参数量其实不大,好像是六七百B的参数

  • JsonSong89 06-17 15:58
    8



    这是阿里云百炼的速度,也谈不上快

  • a12908 06-17 16:00
    9

    模型过度思考会导致输出结果变慢 但是只要你的卡够多给他堆满速度也不会慢到哪去

    所以本质上还是卡不够 总有人说智谱不买卡拿钱去买楼了 ^-^ 但是楼是遍地都是的 卡就难说了 现在都在抢 DS抱上华为大腿了还得排队等呢

  • Aaalice 06-17 16:03
    10

    DeepSeek也有排队?什么时候的事情,API只有出问题报错,没遇到排队,而且DeepSeek的并发给的非常高,300,我之前拿来测试做的mod翻译工具,并发直接拉到100,爽的一比 ^-^

  • CZ 楼主 06-17 16:03
    11

    买楼的新闻也看到了,搞笑。


    现在主要是终端啊。慢点不断也行

  • CZ 楼主 06-17 16:04
    12

    deepseek 没遇到,很快,v4 pro 也挺稳,可惜没有 coding plan

  • mordo7238 06-17 16:05
    13

    之前半夜的时候跑glm5turbo能有两三百的token速度,非常丝滑。可见速度是能够提上去的

  • a12908 06-17 16:05
    14

    我是说鲸鱼还在排队等华为的卡 之前官方不是说下半年华为的卡才到位吗 也不知道现在到哪了

  • Aaalice 06-17 16:07
    15

    哦这个啊,确实好像还没到位,不过DeepSeek没弄coding plan,算力还不算特别吃紧,如果也搞套餐的话,估计也难顶,希望下半年国内算力能突破吧,有GLM这种好模型不能爽用太难受了,这上不去下不来的…

  • CZ 楼主 06-17 16:09
    16

    turbo 模型的能力和 5.1,5.2 的版本是一样的么

  • a12908 06-17 16:09
    17

    是的 coding plan一开基本都往死里蹬啊恨不得一点不浪费 api的话用多充多少一般还收着点的

  • CZ 楼主 06-17 16:09
    18

    真的,好模型不能爽用。


    如果下半年 Anthropic 和 openai 都不让我们用了,感觉只有智谱的能力能顶的稳一些,加油

  • a12908 06-17 16:11
    19

    还可以期待下V4.1 疑似在灰度 有可能真和小道消息说的一样就在这个月了

    要是能追上4.6基本都够用了 无非是多改两次的问题

* 帖子来源Linux.do
返回