gpt降智到底是什么?

heymeow 2026-08-26 03:57 1

最近很多佬友的gpt号都出现了降智的情况,如果你感觉sol最近特别智障,这很可能不是主观感受,而是openai把你的sol换成了luna,还扣取sol的额度


gpt降智到底是什么?

1:降智,是你在请求高级模型的情况下,openai官方将你的请求主动的,恶意的路由到了低级模型

2:在web端中,比较明显的特征是你选择gpt5.6sol,或者solpro,询问模型身份,模型回答我是gpt5.5mini

3:在codex/work app端中,比较明显的特征是明显变蠢,调用子代理意愿下降,糖果题,水杯题做不出,使用脚本检测出来强指向其他模型

4:目前看来,降智只出现在订阅账号的额度中,不会出现在openrouter,官方key等原价api中

5:低级模型,不太可能是未公开发布的某些量化/降智特殊版。大概率是路由luna,但也明确出现过路由terra,5.5,5.4的情况。甚至可能因为负载高将luna路由到5.4(这个没有明确证据)


降智可能是什么原因?

以下仅为猜测

目前的经验来看。降智多发于新模型发布前,凌晨(美国高峰)等高负载时间段,很有可能是因为新模型大规模部署中,但因为未发布无法承载流量。所以在高峰时间利用严格的风控措施,将被风控的请求主动路由到负载小的低级模型集群上。

不知道大家有没有注意到一个现象,大约两周前,降智不是很频繁,但是经常报高负载报错,并且不是所有号都报,也是被风控了才报。


如何避免降智?

目前没有足够的信息量化出openai的风控规则,但是只要使用非常便宜的订阅额度,从经济学的角度看,在oai高负载下都是有可能被降智的。

但是可能有一些操作可以降低订阅账号被风控的概率,或者oai内部的优先级

1:降低会话/登陆设备数

2:使用更好的ip:还是发一下新的中转解决oai标记降智焚决吧

3:浏览器指纹:https://linux.do/t/topic/2699713

其他讨论:对最近gpt大规模降智的研究结果,希望对佬友有所帮助

(佬们随时评论补充)


如何检测降智?

1:糖果题:



在一个黑色的袋子里放有三种口味的糖果,每种糖果有两种不同的形状(圆形和五角星形,不同的形状靠手感可以分辨)。现已知不同口味的糖和不同形状的数量统计如下表。参赛者需要在活动前决定摸出的糖果数目,那么,最少取出多少个糖果才能保证手中同时拥有不同形状的苹果味和桃子味的糖?(同时手中有圆形苹果味匹配五角星桃子味糖果,或者有圆形桃子味匹配五角星苹果味糖果都满足要求)
苹果味 桃子味 西瓜味
圆形 7 9 8
五角星形 7 6 4



正确答案21

2:水杯题:糖果题补充版-水杯题(关心GPT降智的佬友进)

3:检测脚本:gpt掺水/降智检测器,从此告别掺假![附实战案例] 4.1.0重大更新


另外由于最近降智太频繁,而我的脚本本意是测试中转掺水的,而掺水和降智本质都是模型被替换,很多佬测自己的账号也测出来的问题,于是我对检测脚本进行了补充测试

1我自己的测试,使用openrouter作为可信端:低档正确判定80/82 中档正确判定39/40。错误判定都为0。

(ps,or对并发要求比较严格,一个时间窗内不能出现太多请求,否则直接429,所以测试用的是低并发,并且保持 X-RateLimit-Remaining低于18)

2第三方佬友 @zooclean 的测试,同样使用openrouter作为可信端



足以证明对于真正的sol,误报的概率非常非常低


最后:

我的建议是,如果你在用中转站,可以多买几家的额度,充值不要超过10元,干活之前测一测有没有降智,干活途中也可以多测测。这个方法看似复杂,实则磨刀不误砍柴工,我就是用这个方法,本来一天要骂10次gpt,现在效率高多了

如果是自己的订阅,可以试试佬们讨论的恢复降智的办法

如果对品质要求极高,最近or在打折,相当于原价的40%,虽然比中转和订阅贵了几十倍,但是也可以尝试


佬们有什么应对gpt大降智时代的好办法吗?我都有点打算拼个claude team车或者转opencode国模了

最新回复 (1)
  • 成浩 08-26 04:58
    1

    谢谢佬,写的很详尽。想问一下,降智会导致juice值发生变化吗?想了解一下juice值不对,是降智了还是掺水了。(测出来的sol的max是768,high是48)

* 帖子来源Linux.do
返回