GPT 6 Astra 惊人分数

OpenAI_Q-Star 2026-09-04 08:00 1

MRCR v2 256K 8针 100%

MRCR v2 1M 8针 96.3%


这还是ai吗?


希望Deepseek也跟上这成绩


个人偏好R1

耐何长上下文不佳

最新回复 (10)
  • ikb 09-04 08:03
    1

    脚踏实地慢慢赶吧,今年以来我一直在说国模和顶级模型之间的差距在越拉越大。


    估计至少这几天国模赶超三巨头的话题会消停一段时间了。

  • sunnysab 09-04 08:06
    2

    我觉得前不久 k3, glm5.3 刚追上……体验超级好,哎,总是还差几个月的时间。


    希望国模可以加油

  • Kinney Lorraine 09-04 08:23
    3

    gpt5.4到fable刚出那会觉得,dsv4难产,GLM5.2不及预期,当时觉得国模药丸了,下半年没觉得,感觉形式更乐观了。

    真正的是硬件问题,nvidia的rubin上市之后,算力差距又拉大了

  • ikb 09-04 08:24
    4

    有点盲目乐观了,就现在这种刷分氛围下这些国模团队的模型研发方向都有点偏了,几个月内几乎不可能追得上的。


    唐老板还说GLM年内就能赶超fable,当时信心满满现在希望渺茫。

  • randname 09-04 08:26
    5

    刷分谁比得过 muse 啊,至少今年国模都是能用了,在不少任务上用国模做没什么问题

  • 余君 09-04 08:27
    6

    抛开benchmark来看的话,差距依旧很大

  • Jason_ghost 09-04 08:28
    7

    重点是agi,99%

  • Pepper 09-04 08:28
    8

    年初形式比现在差多了吧,当时opus4.6一骑绝尘,国模加起来连一个能正常用的都没有。现在基本日常工作用glm和kimi都没问题了

  • ikb 09-04 08:31
    9

    跑分下个月就能追上,但实际体验一年内都难,国模的神经刀太严重了,唯跑分至上。

  • 余君 09-04 08:32
    10

    国模估计很快就能在benchmark上刷到这个分数吧,不过实际能力的话就…

    差距还是放大

* 帖子来源Linux.do
返回