某家中转提出了不依赖题目的降智检测方法,佬友们觉得靠谱吗

Scaxlibur 2026-09-01 15:06 1

最近OpenAI风控搞得我人麻了,无论是领鸡蛋体验的几家中转还是我自己的挂在CPA上的team都出现了各种降智,糖果题开到xhigh都做不对


我自用的题目就是糖果题和站内佬友的水杯题,测出来惨不忍睹



刷到 中转站降智问题严重 - #3,来自 ajd 帖子和 @Scaxlibur 佬的回复,想到自己领了好多家站内高级推广/富可敌国的中转站赛博鸡蛋还没用,于是就来挨个测试一下,相关信息如下。
题目(来自 @Scaxlibur 佬)
水杯题
应该用sol medium测试,正确答案是 8
有一个水杯配对游戏。共有 4 种不同颜色的水杯,每种颜色各有两个。将同色的两个水杯分别放在上下两层,因此上下…


最近看到某家中转提出了一种通过检测OpenAI错误报文中的模型全名响应数据,判断账号是否被路由到降智模型的方法,看起来挺有道理的,佬友们觉得靠谱吗?


如果通过这种方式真的可以直接知道是否被路由到了降智模型,我想可能比各种检测题更有说服力。


以下是原文



为什么你的 5.6-sol 答不对糖果题?深扒 Codex 降智账号的模型路由抓包


经常做中转站的朋友都知道,Codex 中的模型是部署在独立集群的,系统会根据账号的订阅状态进行不同的路由分配。


之前的路由规律(以 5.5 为例)

以往的模型命名通常以 -1p-codexswic-ev3 结尾,通过抓包可以清晰看到订阅差异:


付费版路由: gpt-5.5-codex-1p-codexswic-ev3


免费版路由: gpt-5.5-codex-free-1p-codexswic-ev3


5.6-sol 降智之谜

被“降智”的账号在使用 5.6-sol 时,连简单的“糖果题”都答不对,是被偷偷路由到了低阶的 Luna 模型?还是用上了严重量化的阉割版?


其实,答案就藏在底层的模型代号里。


通过抓包发现,被降智的账号请求 5.6-sol 时,系统实际返回的模型版本是:

gpt-5.6-sol-codex-abuse-1p-codexswic-ev3 官方显然对疑似滥用或异常的账号做了一层专门的请求拦截和降级处理(至于为什么会被打上 abuse,懂得都懂)。


如何自己抓包复现这个代号?

如果你想验证自己的账号是否被分到了 abuse 节点,可以尝试以下方法:


调用底层的 responses HTTP/WS 接口。


将模型的思考强度reasoning.effort强制设置为 minimal


多请求几次,有一定概率能在返回的 400 错误报文里直接刷出这个带有 abuse 标签的模型全名。


最新回复 (13)
  • Ys Ltr 09-01 15:17
    1

    道高一尺,魔高一丈。


    这是一种军事竞赛,新的检测方法短时间内有效,但时间一长就会被针对应付。


    必须常常出新的检测方法,因此在降智检测或模型路由检测领域,检测方法由开源转闭源才是合理方式。

  • Scaxlibur 楼主 09-01 15:19
    2

    感觉很难呀,闭源的检测方式不利于传播,而且也容易引来栽赃的非议

  • Ys Ltr 09-01 15:22
    3

    闭源相当于内部方法了,确实不利于传播。


    不过现有的测试都是依赖老题目,一点创新都没有,哪怕是改动一点都能防一防针对应对。

  • Scaxlibur 楼主 09-01 15:24
    4

    对的,像是糖果题类似的,有些站可以通过屏蔽关键词拒绝回答,或者注入提示词绕过,确实是防不胜防

  • IssunmiHaichi 09-01 15:26
    5

    题目都很难找 要么过于难 要么过于简单 事实上还是自己的感觉比较重要 我自己翻HLE找了一题 dsv4f,gemini,glm-flash,opus,grok等都能过,但是gpt即使不降智的版本也可能答不对,有股炼炉练爆的感觉 在目前没有比糖果更准确的模型检测了


    感觉只能自己跑测试集来看了。。。

  • Scaxlibur 楼主 09-01 15:28
    6

    糖果最大的特点就是快,可以用python脚本批量测试也不会很浪费时间


    另外区分度比较高,正常的sol med几乎是稳过,降智之后几乎都过不了

  • Ys Ltr 09-01 15:29
    7

    很难找



    公认的好用的题目容易被针对,自创的传播不广的题目容易被忽略,两头堵了。



    gpt即使不降智的版本也可能答不对



    像是过拟合了一样,好像练到头了

  • yutzzt 09-01 15:45
    8

    比较复杂,这个只能测自己的号,中转站得完全透传才能拿到吧

  • 未羽 09-01 16:27
    9

    管他透没透传,先试了再说,干活也安心点啊

  • haoqiu 09-01 16:37
    10

    其实还有稳定测试的方案,但也不能发出来,发出来公开后又得花大量时间训练。。。

  • heymeow 09-01 21:25
    11

    原文是站内的吗 这已经是完整原文了吗,感觉还挺有意思的

  • Scaxlibur 楼主 09-01 21:26
    12

    是的,引用部分就是他们发的原文,觉得有点道理就搬过来了

  • lueluelue 09-01 21:26
    13

    -abuse-



    好家伙,好家伙,OpenAI这也太直白了

* 帖子来源Linux.do
返回