Claude Fable 5 在 Epoch FrontierMath v2 上碾压了 谷歌AI co-mathematician 与 GPT 5.5

lueluelue 2026-06-13 13:04 1



我觉得,我希望,能尽快看到 5.5 pro 的成绩

最新回复 (14)
  • neteroster 06-13 13:05
    1

    真-六边形战士了,传统弱项都能爆了GPT,大力出奇迹还是超模

  • lueluelue 楼主 06-13 13:06
    2

    简直太恐怖了,还不知道他这里面是不是会有拒绝后退回 4.8 opus 的,按说这个难度的题应该会触发反蒸馏吧?

  • neteroster 06-13 13:06
    3

    数学基本不会回退,所以这个我觉得是可以当mythos成绩的,其他leader board如果没有回退应该也类似领先幅度

  • NukaColaM 06-13 13:08
    4

    还得是大力出奇迹,就硬怼参数量,只要算力够,神也杀给你看。

  • lueluelue 楼主 06-13 13:08
    5

    啊哈,原来是这样!那简直太棒了!

  • IkedaTeresa 06-13 13:08
    6

    等等5.5pro的测试结果,不过这算Claude的模型第一次在数学能力上超过openai了吧,真是大力出奇迹

  • lueluelue 楼主 06-13 13:10
    7

    真变天了


    川普首次体验Claude-Fable-5!被吓到眩晕瘫坐,那一刻就像看到原子弹爆炸

  • hwastgs 06-13 13:10
    8

    模型训练差距就是因为算力吗,国内不缺电,可惜没有好用的cpu,什么时候国内来个好用的模型。用不了fable真是生气,gpt5.5瞬间就不香了

  • niubiPlus1 06-13 13:11
    9

    grok充分证明了大力出不了奇迹,anthropic又充分证明了大力出得了奇迹,所以奇迹也由人控制

  • O.v.O 06-13 13:11
    10

    参数量估计也是gpt几倍了 太贵了token ^-^

  • NukaColaM 06-13 13:13
    11

    马斯克不是租算力给A\了嘛,四舍五入grok也大力出奇迹了。

  • lueluelue 楼主 06-13 13:18
    12

    xAI + Anthropic >= OpenAI

    xAI → 0

  • shinorochi 06-14 03:09
    13

    GPT-5.5 Pro (xhigh) 的成绩出了



  • imperatorcaesar 06-14 03:14
    14

    這個是修正後的,他之前說有BUG

* 帖子来源Linux.do
返回