【夜间科研成果】果汁值和概率层测试,可能确实存在点问题

hlool 2026-08-10 01:49 1

经过我不断的测试

今天晚上8点多,我对自己的所有账号都进行了一轮测试

juice全部准确,没有一个漏到48

但是到凌晨以后,我的账号到48了

非常的离谱,juice我本来前面认为是非常准确的

也就是确实oai可能存在降智情况,并且是oai主动路由过去的


至于概率层测试,这个一直不是很准确

也丢了两个号到我的售后群里面让群友去测试了

目前来看,测试juice值,可能确实存在问题,我对我前面的发帖表示抱歉!



你要相信的就是你自己,还有


GitHub - chen-006/gpt56_api_detector: 用于检测api是否路由真实gpt5.6模型 · GitHub


我测试了,脚本是真的,而且非常真,



现在的情况是,对于同一个账号,果汁值和概率层这两种检测方法存在以下情况:果汁值不正确的时候,概率层可能会正确;概率层正确的时候,果汁值可能会不正确。


实锤主要是Juice层单独抓出来的,概率层大部分时候还是站在"这就是真模型"这边——这跟"整体掉包"完全不同,是"平时正常,偶尔在某个具体请求上漏出另一个型号的指纹",污染比例小到不足以拉偏整体统计特征。


也就是检测到混用,不一定代表全部号池掺水,如果是完全不正确,才可能可以锤的死


最好的方式,目前可能还是去试一下那个sol调用的时候会不会频繁拉子代理


脚本测试,确实存在一定的不准确性,但是可参考价值还是很大的


结论就是:检测出来混用不一定是掺水,也可能确实是官方降低智商,要看检测的过程中,有的时候juice有问题但是概率层没问题,有时候概率层有问题juice没问题


这个跟ip也有关系,因为我这里测试的异常,群友有的没有复现出来,有的有复现出来。

当我重新换一批ipv6以后,测试效果确实会出现不一致


juice_test_log_sanitized.csv (24.9 KB)


现在的情况是,对于同一个账号,果汁值和概率层这两种检测方法存在以下情况:果汁值不正确的时候,概率层可能会正确;概率层正确的时候,果汁值可能会不正确。


实锤主要是Juice层单独抓出来的,概率层大部分时候还是站在"这就是真模型"这边——这跟"整体掉包"完全不同,是"平时正常,偶尔在某个具体请求上漏出另一个型号的指纹",污染比例小到不足以拉偏整体统计特征。


也就是检测到混用,不一定代表全部号池掺水,如果是完全不正确,才可能可以锤的死


最好的方式,目前可能还是去试一下那个sol调用的时候会不会频繁拉子代理


脚本测试,确实存在一定的不准确性,但是可参考价值还是很大的


结论就是:检测出来混用不一定是掺水,也可能确实是官方降低智商,要看检测的过程中,有的时候juice有问题但是概率层没问题,有时候概率层有问题juice没问题


这个跟ip也有关系,因为我这里测试的异常,群友有的没有复现出来,有的有复现出来。

当我重新换一批ipv6以后,测试效果确实会出现不一致



但是也有不一样的地方

似乎是oai的问题

因为我在8-9点的时候进行的测试juice值都是正确的,我那时候发现值是不变的

现在这个点可能美国人上班了,算力不足,这种简单的问题就被路由去了luna



当出现了这个报错之后,我的账号就开始容易出现48的sol返回juice值了


以上内容不保证是否可以百分百复现,我还在整理测试中的日志,但是确实无法百分百验证


可以参考更多的验证方式


因为我们站内最近不知道是什么情况,然后很多说我们5.6sol掺水或者其他的这个说法,甚至没有证明,直接在商家评价评论说了这个情况
例如下面这种
[image]
帅站现征集方案,只要可以确实判定的,采用的是我们家的api的
无论你是任何方案,都奖励50元赠金
以证清白
需要确实详细,足够让佬友们信服的
允许10名,方式尽量不同一些。
站内目前有0.07倍率 0.17倍率 0.2…
最新回复 (16)
  • Petals 08-10 01:51
    1

    我感觉前一个帖子的时候慕鸢佬的压力是最大的

    @user792

  • zhx47 08-10 01:54
    2

    前排说一下,目前我再也帅站的群里,刚开始老板是反馈经过多次测试后,账号毁了,会固定开始降智了



    然后我开始开机导入之前老板在群里公开的两个账号进行测试,别因为测试脚本直接导致账号被毁了




    结果目前我这边目前是测试了500次还是正常的,说明账号没毁,还是正常的


    官方在高峰期路由降智好像也不是单方面判定账号的,和ip可能也有关系,降智是一个多因素结合的判定结果


    搞这么复杂,不会oai本身就做了单个账号一堆人用的预案吧




    相同的账号我复现不出来,所以我直接问了老板我最关心的问题:


    那很坏了,官方给你降智了,还按照sol收费




    @heymeow 脚本可能需要更改一下宣传了,或许并不能检测有没有惨水,但是可以检测出来有没有降智


    官方自己也惨水的情况下,果汁值虽然也有参考价值,能识别出来是否降智了,但是无法直接捶死站点主动惨水了


    不过脚本大家测下来,还是具有价值的

  • 爱吃番茄 08-10 01:55
    3

    这么看来奥特曼真出生啊,正价充值还要被他掺水

    那用中转的更惨,不仅奥特曼掺水,中转还可能继续掺水

  • 小瑾瑜 08-10 01:56
    4

    是的我之前也遇到过这个问题,但是自己好了

  • 白洲梓 08-10 02:01
    5

    看来掺水的本质是给你路由到其他比当前模型能力差的模型回复啊,包括pro模型路由mini,官方中转都一个样 ^-^

  • hlool 楼主 08-10 02:03
    6

    更加震撼的情况出现了

    我目前有家宽+多个服务器号池ip

    rn的服务器测试不降智

    ovh服务器测试两台都降智

    家宽部分测试不降智,部分降智

    同样的账号但是有多种结果

    以后还要搞oai严选ip了 ^-^

  • 白洲梓 08-10 02:07
    7

    那看来家宽机器势在必行了。O/是真会风控ip黑名单 ^-^ ^-^

  • 三月七 08-10 02:15
    8

    又有无极大反转了吗,真是一天一个大戏啊

  • 三月七 08-10 02:15
    9

    以后还要搞oai严选ip了



    没啥用吧,都动态降智了换个 ip 没准一会又降了

  • 黑化喵喵 08-10 02:16
    10

    我其实没看懂 之前的帖子 和现在的帖子 以及什么 测试脚本


    但是我始终觉得 你用一个脚本测试一个黑盒 的结果根本靠不住 或者说想靠的住必须要量够多 比如 100个号 从早请求到晚 来模拟 中转站的请求量级 或者低一个数量级^-^ 才有点说服力


    黑盒测黑盒 为什么会得出我们准的结论^-^ 我这有个盒子 我说里面装了一只猫 ,你说我在外面装了10种猫 在外面叫 里面的猫有不同的回应 所以 里面有一只猫 ^-^

  • hlool 楼主 08-10 02:17
    11

    我目前不能证明说脚本百分百没用

    只能说我复现出了脚本证实不出来的情况

  • ちーちゃん@ゴミねこスキル 08-10 02:18
    12

    可以查下日志对应账号有没有过capacity报错,似乎降智的和之前并发太高也有关联

  • 黑化喵喵 08-10 02:19
    13

    我只是觉得理论上有点说不通 因为 这东西 不是API调用 那边是数据库 你post个 A 我肯定返回给你个B 一个问你 用不通账号 不同的上下文对话。每次请求返回的内容 也不保证 每次都是相同的 ^-^我只是想说这个

  • 张荒唐 08-10 02:20
    14

    所以按这情况来看。

    大概逻辑是:


    由于中转站本身账户存在大量调用,所以更容易触发o÷的降智?

  • hlool 楼主 08-10 02:20
    15


    你看下这个,会确实有这个

  • zhx47 08-10 02:21
    16

    还是有一定作用的,虽然是黑盒测试,但是在正常情况下,似乎都是正常的,而且果汁值也是官方承认的。


    现在出现异常,在黑盒测试之外的情况,也依旧有价值,可以看这种中转站的能力怎么样,提供的模型是否是降智的

* 帖子来源Linux.do
返回