Qwen 3.8 max 的跑分终于出来了

大鲨鱼 2026-08-06 13:21 1

看来表现中规中矩,和 gpt 的 luna max 坐一桌


最新回复 (24)
  • 快乐的出帆 08-06 13:23
    1

    经典娱乐跑分 ^-^

  • Yeon 08-06 13:23
    2

    这个测试是测得什么方向的

  • qwer-12341234 08-06 13:23
    3

    感觉他的视觉能力很差,比kimi系的速度差远了


    顺带一提这老哥真牛逼,122天升到了lv6

  • 奥术魔刃 08-06 13:23
    4

    ai也是进入到不服跑个分的阶段了

  • 大鲨鱼 楼主 08-06 13:27
    5

    @快乐的出帆 #1


    如果这个榜还是娱乐榜的话,那没什么说的了

  • 大鲨鱼 楼主 08-06 13:28
    6

    @快乐的出帆 #1


    其次你首先得知道这是哪个网站吧?不会不知道就来评价了吧?

  • wssgcjsg 08-06 13:29
    7

    luna max拿啥比glm5.2,同样的任务glm5.2 40分钟做完还是对的,luna max做4h还没有做对,唯一的优点就是便宜了

  • 快乐的出帆 08-06 13:29
    8

    @大鲨鱼 #5 开源方面,阿里确实牛逼。但是他这个闭源Ai确实性能一般,阿里人自己都不爱用。 ^-^

  • 大鲨鱼 楼主 08-06 13:30
    9

    @快乐的出帆 #8


    原来不知道啊,那就是张口就来了

  • sunsong 08-06 13:31
    10

    artificial的榜单毫无价值,

    arena才靠谱些

  • sandlong 08-06 13:31
    11

    @快乐的出帆 #8 qwen 3.8 max是开源的

  • z318969887 08-06 13:31
    12

    5.5在哪

  • sunsong 08-06 13:32
    13

    @大鲨鱼 #5

    就是娱乐榜。 luna比ds flash就tm搞笑

  • ida 08-06 13:33
    14

    @sunsong #10 难崩,arena就是投票打分,one shot的评测野榜

  • xuefengjia1 08-06 13:34
    15

    这个网站上价格是认真的吗,怎么比肥波5还贵 ^-^

  • dushixiang 08-06 13:34
    16

    qwen 每次发布都吹极其牛逼,吊打友商,实际上一用一个不吱声

  • 快乐的出帆 08-06 13:36
    17

    @大鲨鱼 #6 我是就是论事罢了,你去看看那几个卖token的大站,看看API调用量,就好了 ^-^

  • 陌生人 08-06 13:37
    18

    我打螺丝的,不用太高深的智商

  • 大鲨鱼 楼主 08-06 13:39
    19

    @快乐的出帆 #17


    大模型的智能程度看调用量都来了,消费市场是越便宜越好,其次我寻思我也没吹 qwen 3.8 啊,我说它和 gpt luna max 坐一桌

  • 快乐的出帆 08-06 13:44
    20

    @大鲨鱼 #19 我吐槽的不是你,我吐槽的是Qwen冲榜能力一流,实际并不好用 ^-^

  • 老衲推车 08-06 13:46
    21

    跑分没输过

  • Fyzzp0o0 08-06 13:47
    22

    @qwer-12341234 #3 这年头谁还不会水帖了 ^-^

  • aRNoLD 08-06 13:49
    23

    @大鲨鱼 #19 发布于8/6/2026, 1:39:02 PM

    @快乐的出帆 #17


    大模型的智能程度看调用量都来了,消费市场是越便宜越好,其次我寻思我也没吹 qwen 3.8 啊,我说它和 gpt luna max 坐一桌


    也得能干事儿才行。


    实际上普通人说的性价比,是指在完成任务的情况下,耗了多少成本。


    买个隆江猪脚饭,价格打下来,可以不是隆江的,但得有猪脚和米饭才行啊,一杯紫菜汤加片午餐肉还是混不过去的。

  • BITJEBE 08-06 13:54
    24

    这个已经算是比较客观的跑分了,不过任何跑分也只是参考,给一个大概的能力范围,在不同任务的表现可能不同模型不同,在不同人手里可能也不同

* 帖子来源NodeSeek
返回