cyber abuse有可能是gpt模型自己返回的博彩、赌博等内容触发的!!!

beingS 2026-08-25 23:18 1

再次更新,~/.codex/sessions/2026/08里面对应的jsonl替换彩票、国产自拍等等关键字,同一个会话,可以继续了,这还不能证明吗?


------------------------------时间线----------------------------------



为了审计我全部死的号的记录(斗胆有再用gpt验证一次,下面我已经说了先用的hy3),我仅仅让他给我提取80个字符(彩票周围)发给我,又喜提一次警告,而且这个现在貌似只出现在terra模型,草台是真的草台,tmd没想到死到这上面


-------------------------------时间线------------------------------------

今天又收了cyber abuse邮件,由于之前被封了两个pro 20x,所以自己写了lua在nginx做记录,把请求和返回都记录下来了,在今天14:28我的codex在pc和ios双端被强制退出,当时心里一惊,但是再次登录并没有封号。但是晚上收到了cyber abuse邮件。

于是,开始审计自己的所有记录,使用hy3模型全部审计,包含提示词、tool use和返回,甚至图片都审计。最后还是并没有发现什么可疑的破甲、爬虫、逆向等等行为。

然后就从14:28被全端强制退出那一刻分析,发现14:27分模型返回的博彩、赌博等等他们自己的训练被污染的语料,当然还有全裸、彩票彩票一本道等等词。从27到28带着这些返回共请求13次,然后就是强制退出。

现在猜测:gpt并不知道(可能知道但是没有在cyber系统剔除)自己被污染的语料有多暴力,但是你带上返回的语料历史,再去请求就会被标记。

以上是我全部分析被封账号,和今天cyber abuse账号,得出的唯一的一致性信号,只是猜测并非结论,希望被封的佬友、被cyber警告的佬友一起分析一下自己的记录,来验证一下猜想!

最新回复 (19)
  • 惊鱼 08-25 23:24
    1

    你别说, 还真有可能, openai审查输入可不管是不是模型自己输出的

  • ius 08-25 23:25
    2

    跟那些没关系,实际上oai封号只有一个cyber abuse,我还没看到过其他的(带原因的)。之前开公益站的时候,每天都会定时死号。可以申诉看看

  • Th.SevnthO.livion 08-25 23:28
    3

    的确有可能,我昨天遇到了一个会话出现invalid prompt,让模型怎么修复都不成功


    我手动打开之后发现代码中的注释里确实有被泄漏的污染思维链,手动删除之后就好了,但整个会话都不能用了,需要新开继续


    Ps:会话不涉及任何破限违规等操作,就是科研正常修改实验代码,结果就遇到了invalid prompt

  • beingS 楼主 08-25 23:29
    4

    我认可是cyber abuse原因封号,但是我认为现在触发cyber abuse的不仅仅是网络安全那么简单一个范围了。现在社区确实都觉得是破限、逆向、爬虫、攻击等等,但是我感觉已经不只是这些被划分到cyber abuse范围内

  • ius 08-25 23:30
    5

    是的,你不逆向也会被封,要么是直接停用,要么说你滥用,还有一个邮件是,提醒你不要滥用。

  • beingS 楼主 08-25 23:31
    6

    我上周五被封了两个,才让我下定决心写个lua脚本来记录完整的请求流,今天的cyber邮件太奇怪了,明明没多少使用量,而且都很正常,然后给我发邮件我就懵了,我只能反推了

  • ius 08-25 23:32
    7

    是用的域名邮箱注册的账号吗,还是谷歌

  • beingS 楼主 08-25 23:33
    8

    我一共被封了三个pro 20x,只能从所有的审计记录里面推断出来这一个共同点了,死得号有邮件有的没有,而且我不是公益站,只是几个人cpa来用的

  • beingS 楼主 08-25 23:33
    9

    都是老号谷歌,都是每个人的真实使用的邮箱买的,只是大家合在一起用在cpa

  • ius 08-25 23:34
    10

    那估计就是分发的事了,正常的共享杀号。不过可以申诉看看,确实没啥好办法。

  • beingS 楼主 08-25 23:36
    11

    五个人三个号,这种并发也算分发的话,只能多人登一个账号了,用完再换。也是蛋疼

  • Jerry 08-25 23:38
    12

    这么草台吗?话说oai里不是很多华人,这种NSFW在数据预处理里就可以清理掉了吧。

  • beingS 楼主 08-25 23:39
    13

    所以才说猜测,但是今天我这个pro 20x的cyber邮件就很奇怪,同时全端强制退出行为也很奇怪。我只能从这一个线索反推,发现被封的pro 20x也符合该行为

  • Th.SevnthO.livion 08-25 23:58
    14

    这个命中模型全部是Terra是指,这种污染的思维链泄漏的模型来源是Terra吗?


    我有一个subagent确实配置的Terra,也的确是先从subagent开始报错,最终回到主会话的,如果是这样的话我可能要换luna执行了

  • beingS 楼主 08-26 00:11
    15

    我的记录里面全都是terra模型泄露的这些污染语料

  • Th.SevnthO.livion 08-26 00:34
    16

    支持佬深挖,感觉佬可以整理一下去提一提issue,并且以此申诉,看看能不能把账号申诉回来,毕竟这完全是官方自己的错误 ^-^

  • beingS 楼主 08-26 00:51
    17

    这种提了issue有用吗,我感觉只能去x炮轰tibo,最搞笑的是污染语料是中文!太讽刺了,封号也是中国人多,老外反而不容易触发

  • Th.SevnthO.livion 08-26 00:55
    18

    说实话,我昨天晚上排查出来invalid prompt是GPT自己生成的之后,我也想去X炮轰Tibo


    感觉佬可以把排查方法整理一下,说不定还有其他被封号或者遇到invalid prompt的佬也是这个原因,扩散出去可能会有效

  • beingS 楼主 08-26 08:11
    19

    整理后提交一下吧,这是有点坑的,死号啊

* 帖子来源Linux.do
返回