牢马的Grok4.7拉了一坨大的啊,除了版本号+1,好像没咋变

Neptune 2026-09-22 12:29 1

最经典的俩跑分DeepSWE和Terminal Bench,一个所有模型拉不开差距过拟合了(哈基米3.8都74分),一个远不如opus5,非要搞个cursor bench,自己数据集打赢别人是吧。真拉完了,果然4.5第一次融合cursor,是牢马第一次高光,也是最后一次。

最新回复 (11)
  • 嘻嘻 09-22 12:30
    1

    grok 和美国大豆包比起来咋样

  • Neptune 楼主 09-22 12:32
    2

    强点吧,北美豆包思维链太短了,大懒蛋,能干的就又快又好,不能干的打死也干不出来

  • 水之笔记 09-22 12:33
    3

    今天看其他佬的帖子说甲变厚了,感觉要更麻烦了。不知道价格额度变没变

  • promiseteh 09-22 12:34
    4

    想知道如何破甲 搞了半天也不行啊

  • 时牧 09-22 12:35
    5

    消耗上应该是会更高了,更积极的去工作长思考

  • QuickHarbor66 09-22 12:38
    6



    鹈鹕看着还行

  • 叮叮提醒小程序 09-22 12:39
    7



    我这个还行,应该是满血状态

  • yibachaodou 09-22 12:40
    8

    看着反正没太大进步,感觉老马的话经常信一半就行了

  • qwwuyu 09-22 12:58
    9



    grok4.7

  • staff08 09-22 12:59
    10

    这个好,用上自动驾驶了,遥遥领先^-^

  • firespoon 09-22 13:01
    11

    不降智的话强多了。而且grok搜信息确实快 ^-^

* 帖子来源Linux.do
返回