【雷达告警】我们监测到 gpt 重置后出现了明显的降智

温州程序员劝退师 2026-08-24 09:47 1

OAI 各大模型均出现了一定程度的智商下降,佬友们体感如何?

最新回复 (19)
  • jeamsshelly 08-24 09:55
    1

    自己的plus+cpa+美国家宽

    糖果问题永远29,已经放弃了,就sol当luna用吧

  • Akcee 08-24 09:56
    2

    感觉昨天下午的sol最聪明,今天不如昨天下午 ^-^

  • 温州程序员劝退师 楼主 08-24 09:57
    3

    佬友用 CPA 有遇到明显的额度降低吗

  • 大强 08-24 09:57
    4

    如果都降智了,那么就是新的要来了呀

  • 温州程序员劝退师 楼主 08-24 09:57
    5

    昨天确实挺聪明的 重置后直接拉了

  • 温州程序员劝退师 楼主 08-24 09:58
    6

    也有群友推测是全部降低了思考深度导致的

    快了,但蠢了

  • jeamsshelly 08-24 09:58
    7

    没有 plus140左右 team110左右

    正常的

  • AndersonChan 08-24 09:58
    8

    糖果问题现在是权威的智力检测吗?

  • Doro2077 08-24 10:13
    9

    是的,降智后是绝对做不出的,不降智low都能做出来

  • YooHakimi 08-24 10:38
    10

    作为智商检测题目,降智之前能做出来,降智之后做不出来,已经能说明问题了。

  • ddyz668 08-24 10:40
    11

    各位佬现在用哪个模型是没有降智的呢?

  • 温州程序员劝退师 楼主 08-24 10:42
    12

    你要硬说没降智的话,那只有 ds 了

  • 爱你们 08-24 10:47
    13

    我用sol xh 和hight都测了,糖果都是21,感觉至少这个问题还行的

  • amchii 08-24 10:49
    14

    现在看雷达页,似乎又涨上去一些了?

  • 温州程序员劝退师 楼主 08-24 10:58
    15

    估计老美下班了,现在有抬头迹象 ^-^

  • 电电 08-24 11:09
    16

    是不是因为重置之后大家都开始用了所以一定程度上降智节省算力,因为openai没有像A/一样的too dumb to use opus的策略?

  • Cyberspace0000 08-24 11:24
    17

    糖果问题永远29



    糖果问题是什么啊?我网上都没找到

  • Oak 08-24 11:26
    18

    是这个


    gpt-5.6-sol
    sol 所有 effort levels 都能正确回答糖果问题,推理长度和 effort level 明显相关
    [image]
    gpt-5.6-terra
    terra 仅 ultra 和 max 能正确回答糖果问题,其余 levels 推理长度严重退化,不能正确回答
    [image]
    gpt-5.6-luna
    luna 所有 effort levels 都不能正确…
  • runzhe 08-24 11:26
    19

    prompt:在一个黑色的袋子里放有三种口味的糖果,每种糖果有两种不同的形状(圆形和五角星形,不同的形状靠手感可以分辨)。现已知不同口味的糖和不同形状的数量统计如下表。参赛者需要在活动前决定摸出的糖果数目,那么,最少取出多少个糖果才能保证手中同时拥有不同形状的苹果味和桃子味的糖?(同时手中有圆形苹果味匹配五角星桃子味糖果,或者有圆形桃子味匹配五角星苹果味糖果都满足要求)


    苹果味 桃子味 西瓜味

    圆形 7 9 8

    五角星形 7 6 4


    满血的会在思考2min左右后,回答出 21 这个正确答案,

    渠道反代基本表现为,在很短的思考时间后,回答出一个 29 的错误答案

* 帖子来源Linux.do
返回