看了一位 v 站博主的 OpenAI 模型降智测试,于是也测测自己用的客户端模型是否被降智

senyuLight 2026-09-14 09:37 1

原贴:一些关于 openai 订阅降智,账号风控的独立测试


通过模型指纹识别:https://xqy2006.github.io/ModelTrace


识别结果如下,看到是 gpt6 就放心了,真害怕是 gpt6 收费,使用的是 5.6


最新回复 (52)
  • Cabana 09-14 09:46
    1

    你这一点也不准啊,我用 gemini3.8flsh 测的
  • senyuLight 楼主 09-14 09:50
    2
    @Cabana 我勒个豆,那这不炸了,我还沾沾自喜,以为用的是真正的模型
  • msg7086 09-14 09:51
    3
    > 真害怕是 gpt6 收费,使用的是 5.6

    5.6 ?没那么高,给你个 4 级别的就差不多了。
  • senyuLight 楼主 09-14 09:57
    4
    @msg7086
  • Tink 09-14 09:57
    5
    我刚试了一下 grok4.6,搞笑,试出来是 opus4.6



  • senyuLight 楼主 09-14 10:00
    6
    @Tink 我又看了一下网站说明,这个网站只收录了,cluade 和 OpenAI 的模型,其他模型测,算出来的因子,去和收录的对比,毕竟没有收录其他模型,也就是说只能测 cluade 和 OpenAI 的模型。
  • zwyhzxy 09-14 10:10
    7
    astra high ,测出来是 luna ,日乐天了这
  • senyuLight 楼主 09-14 10:13
    8
    @zwyhzxy 那你测要么是被降智了,要么就像我同事一样,使用的是中转站,以为用的是 gpt6 ,结果是路由到 5.6 luna 。
  • zhaotian5868 09-14 10:15
    9
    5.6 sol high , 测出来确实是 sol
  • loopq 09-14 10:20
    10
    gpt 拼车 两次测试 [5.6 sol 和 6 astra] xhigh 都直接落到了 5.6 luna ,悲催了

    我自己的 codex plus 和 claude 都分别识别正确,6 astra - opus5 ,感觉这种 风控更多还是针对 sub2api 用户
  • StudyFung 09-14 10:21
    11
    中转站的 gpt6 ,测出来是 5.5 ,避雷
  • kapr1k0rn 09-14 10:23
    12
    这种测试的意义是什么?难道因为是个 5.6 就默认回答得不对,是 6 就是对的?AI 版的因人废言?
  • BenCoper 09-14 10:25
    13
    测指纹这个意义不大,糖果题一直都是最容易发现降智的
  • senyuLight 楼主 09-14 10:26
    14
    @loopq 是的大佬,你自己的是官方客户端没问题的😀。这波是那些使用中转站和非官方的难受了
  • senyuLight 楼主 09-14 10:28
    15
    @kapr1k0rn 意义在于你使用的是不是真实你想用的模型。并不是对不对的问题,而是模型一致问题。
  • senyuLight 楼主 09-14 10:29
    16
    @BenCoper 糖果题是指什么呢,大佬科普一下呢
  • lscho 09-14 10:31
    17
    取糖果和鹈鹕是目前最快能测出来智商的
  • senyuLight 楼主 09-14 10:31
    18
    @StudyFung 我身边同事,使用中转站,选择的是 gpt6 ,实际上测出来是 5.6 luna ,从评论区大佬们反馈来看,中转站和反代的,基本都被降智了。
  • senyuLight 楼主 09-14 10:32
    19
    @lscho 好的,谢谢科普~
  • layxy 09-14 10:37
    20
    你看下那个帖子下我的回复,我昨天使用 300 多次,有一半被路由到 gpt5.6,也就是我的任何一次交互都有一半可能降智,鬼知道哪一次对话哪一次处理是 gpt5.6 还是 gpt5.6 ,下面的数据是在 https://chatgpt.com/codex/cloud/settings/analytics#usage 的轮次监控数据中可以看到,另外说明下我是 gptpro20x,一直官方 codex 使用,没有使用反代
    gpt-6-astra 154 次
    gpt-5.6-luna 151 次
    gpt-5.6-terra 8 次
  • senyuLight 楼主 09-14 10:49
    21
    @layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
  • plants 09-14 11:11
    22
    @senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
  • layxy 09-14 11:14
    23
    @senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
  • yiranw09 09-14 13:21
    24
    测了一下中转站的几个渠道
    1. 研究院渠道 GPT6

    2. Pro 号池

    3. Plus 号池

    测试方法应该是蛮准的,并且消耗比醍醐糖果小多了,开一个 chat 就能进行测试
  • senyuLight 楼主 09-14 13:36
    25
    @yiranw09 可以的,那我更加放心了👍
  • pwinner 09-14 13:44
    26
    其实最简单的是鹈鹕测试,大部分人日常使用可能注意不到被降智而已...
  • zjttfs 09-14 13:50
    27
    @pwinner
    降智体感很明显..
    特别是 astra 降智.降智后明显弱智,做事做不全等
  • kianwww 09-14 13:54
    28
    有些客户端在触发风控或者高负载时也会静默降级
  • None123 09-14 13:56
    29
    astra max ,测出来是 gpt-5.6-luna
  • tim9527 09-14 14:04
    30
    还可以,看来家宽挺准的,我鹈鹕测试也过了
  • FakerLeung 09-14 14:10
    31
    丸辣,中转站 gpt-5.6-sol ,测出来是 gpt-5.6-luna
  • senyuLight 楼主 09-14 14:22
    32
    @FakerLeung 中转站必炸,官方重点关注的,以后中转,反代,肯定是能不用就不用了
  • tim9527 09-14 14:59
    33
    用 Astra 又测试了一次 稳
  • yinmin 09-14 15:04
    34
    openrouter 选 sol ,测出来 100% sol
  • jko123 09-14 15:18
    35
    自用订阅测的


    中转站测的


    中转站果然不能用啊
  • senyuLight 楼主 09-14 15:28
    36
    是的,中转以后肯定不能用了,一方面是对话数据可能会被卖,最新网上一个博主花 5 位数卖 6tb 的中转数据,大量的 ssh 等 key ,另一方面中转可能会注水,最重要官方会限制,可能会对自己的项目有影响。
  • Cruzz 09-14 15:48
    37

    我这的肯定没降智,因为让他给我测试下 hive 认证跑了我百分之 40 的额度。根本用不起,我也不开。5.6sol 够够的。
  • andie 09-14 16:07
    38
    很准
  • sampeng 09-14 16:25
    39
    @layxy 应该不是你要求,而是 codex 的背后会有模型任务,compact ,explore ,都可能是 lua 。。
  • layxy 09-14 16:27
    40
    @sampeng 如果没降智,咋会这么拉啊,感觉现在使用没有刚出那两天好使了,有时候还不如 gpt5.6 sol
  • sampeng 09-14 16:29
    41
    @layxy 换 pi/opencode 试试。。那个 codex 太臃肿了。
  • jwk345 09-14 17:01
    42

    可以可以,我用 DeepSeek 官方 flash 带思考模式,给我测出 gpt-6-astra
  • jwk345 09-14 17:08
    43
    @jwk345 还能说啥?😑
  • senyuLight 楼主 09-14 17:21
    44
    @jwk345 #43 还能说啥?只能说明,deepseek 蒸馏了 gpt 。这个网站只能测 gpt 和 cluade code ,其他模型,测出来的结果,只能去和这两家模型里面匹配。
  • Kokomashiro 09-14 17:21
    45
    Composer 2.5 测出来是 3 个 9 的 gpt 5.4 ,你别说还真差不多。
  • 0xcode 09-14 17:22
    46
    deepDeepSeek4.1
  • senyuLight 楼主 09-14 17:34
    47
    @0xcode 根据前面数据来看,deepseek 应该是蒸馏了,gpt 和 cluade code 。
  • jsq2627 09-14 18:18
    48
    测试了 Azure OpenAI 上的 gpt-6-astra, gpt-5.6-sol, gpt-5.6-luna ,结果非常准确。
  • jiayouzl 09-14 20:23
    49
    @StudyFung 一份价格一分货,中转站这种玩意想想也知道有猫腻的。
  • menghuitangchao 09-14 20:25
    50
    我试了官方订阅的 5.4 、luna 、terra 、sol 、6 ,都测出来了,这个算法还是有东西的
  • jiayouzl 09-14 20:29
    51
    codex+open ai 官方 api 接口(非中转站)
  • dongzhimin 09-14 20:56
    52
    @jsq2627 卖给第三方的特别是微软的不敢狸猫换太子
* 帖子来源V2EX
返回