gpt-6-sol 糖果题都做不对

Hao 2026-09-23 03:22 1

账号不降智。三个模型对比,gpt-6-astra low 和 gpt-5.6-sol low 稳定答对糖果题。gpt-6-sol 哪怕开到 high 也无法稳定答对,得开到 xhigh 才有比较大的概率答对。



最新回复 (13)
  • lueluelue 09-23 03:22
    1

    这模型juice给满了吗?我记得他满的是768

  • ZRainbow 09-23 03:23
    2

    失望透顶,OAI是不是发错模型了??

  • Hao 楼主 09-23 03:26
    3

    juice 给的很低,如下


  • lyy0709 09-23 03:26
    4

    有可能是5.6luna

  • Hao 楼主 09-23 03:27
    5

    没有,看过的,账号不降智,astra 都是正常的

  • lueluelue 09-23 03:29
    6

    OpenAI真的是畜生啊,我测到low是1的时候,以为是测错了。。。。

  • LucasScott 09-23 03:33
    7

    正在体验,说实话,gpt-6-sol medium体感确实感觉快了很多。也很干练。但是他妈的一个5h下去,一个bug还没定位出来。

  • Hao 楼主 09-23 03:37
    8

    很干练



    因为思维链真的很短,如果你用的多的话,可以统计看一下思维链长度的分布情况

  • W1nge 09-23 03:38
    9

    沃趣,这sol低的简直逆天了

  • Infty 09-23 03:42
    10

    降智众说纷纭,不如来看看Openrouter的api请求的6 sol和6 luna! 佬友可以看看我用Openrouter api的结果,也是低思考强度一坨

  • Hao 楼主 09-23 03:44
    11

    应该就是 o/ 刻意降低了思维链长度

  • hmtdpetn 09-23 03:49
    12



    真的跟抽奖一样,luna答不对糖果题,但是水杯是没问题的,开个max有37分钟的雷霆思考

  • Hao 楼主 09-23 03:50
    13

    luna答不对糖果题



    我测出来的结果也是,6-luna 开到 max 依然答不对糖果题

* 帖子来源Linux.do
返回