opus 4.6没想到还能再次登榜

合本丶 2026-06-26 18:01 1

gpt5.5和opus4.8现在真的是拉完了 ^-^

(实时更新的智力测试榜,能大概看到模型降智情况,仅供参考切勿当真)


最新回复 (19)
  • 0x0000000 06-26 18:04
    1楼

    主要是这类型的测试排行可不可信呢?AI的能力其实是不是不大好量化?

  • lktoken 06-26 18:05
    2楼

    这种让微信公众号看到就会说“是GLM-5.2放了他们一马”

  • 迪亚哥 06-26 18:05
    3楼

    这个是每间隔一段时间就测试更新的,可以看个大概,有波动正常,不过也存在有模型低迷很长时间

  • zining 06-26 18:06
    4楼

    写代码方面,4.8真不如4.6嘛,我现在还在用着4.8呢

  • 飞行计划 06-26 18:06
    5楼

    这图哪儿来的,感觉也就一乐子吧?

  • eroneko 06-26 18:07
    6楼

    GLM 5.2没有吗,按这个排法至少前三吧

  • Marisa 06-26 18:07
    7楼

    你这啥榜单 是那个方面的评分 有些没头没尾啊 ^-^

  • d12344321d 06-26 18:07
    8楼

    ds flash比pro 高,glm 5.1在而5.2不在,这是什么榜

  • 合本丶 楼主 06-26 18:08
    9楼

    评分是这些

  • zwtlovebmy 06-26 18:09
    10楼

    野榜吧,什么网站的,一般不会倒退更新吧

  • 合本丶 楼主 06-26 18:09
    11楼

    实时刷新的智力测试榜,模型降智情况能看个大概

  • CheviChan 06-26 18:10
    12楼

    看到跌到14、15了我脑袋都嗡嗡的, 怎么可能呢。

  • 时牧 06-26 18:18
    13楼

    我不信gemini3.1pro有那么高^-^

    这模型降智还不明显嘛,难道只是统计最近这段时间的

  • JiangLong 06-26 18:19
    14楼

    但是 但是, 但是, 体感方面, 我目前依然感觉 5.5 依然强的可怕哎。

  • Hifumi Mizuhara 06-26 18:21
    15楼

    我也不相信,说是3.5也就算了,3.1真没给人留下什么好印象^-^

  • 合本丶 楼主 06-26 18:23
    16楼

    已经跌下来了 ^-^

  • A2A 06-26 18:32
    17楼

    这个榜很奇怪的,你点进去看某个模型的时间线,最近时间的一次分数一直会是降低的趋势,但是你隔天再点进去看那个时间点的分数很大概率又离奇的回归高水平了

  • xunxun 06-26 18:34
    18楼

    是的 可惜any大善人不让用4.6

  • outgoing 06-26 18:36
    19楼

    体感上4.6就是比4.8强啊,考虑的也全面

* 帖子来源Linux.do
返回