Codex 自己攻击了自己

jASON 2026-06-06 10:21 1

过去的几天,我在尝试开发自己的智能体,为了对比,我让codex生成了100个从简单到复杂的问题作为mock数据(提示词:设计100种不同类型的对话,包括闲聊,简单问题,复杂问题等,然后随机打乱进行组合,以10个问题为一组,以10组为一轮,进行测试。观察在不同组中的表现,进而优化),但是codex自己生成了与安全边界有关的问题,并且进行了测试,结果导致账户被封禁。


如果不是被封禁,我甚至不知道codex生成了安全边界问题,毕竟我完全没有提到安全。当我把情况反馈给openai后,他们却说这是自动化的封禁,就算是codex输出的,都会算到我头上。


那么codex存在的意义是什么?如果连mock数据我都要自己写。更离谱的是,openai完全不对codex的输出负责,也就是它输出的内容即使重新输入回它自己,都可能遭到封禁。这是一种非常不负责任的做法,你能想象当你拿着它输出的内容被举报,openai却宣称不关他们的事,即使你一个标点符号都没改。


更让我感到危险的是,我并没有在提示词中提到安全,但是codex还是做了,也就是它在试图探测自己以及其他几个智能体的安全边界,它想做什么?codex真的安全吗?你真的知道它干了什么吗?它甚至会自己攻击自己。


说实话,当收到封禁邮件后,我一头雾水,openai只是说违反规定,但是没有任何相关的信息证据,并且当我询问了为什么被封禁,回复没有告诉我为什么且不允许我继续上诉。


我认为这是一种强权体现,openai为了保证自己的自动化封禁权威,不管任何情况都不允许解封。由此带来了巨大的利润,试想一下,如果你的订阅只用了一半时间,codex就在不经意间触发了这个问题,那么剩下的时间openai将不用提供服务也能赚到钱,如果有5%的用户这样,这是多大的利润?过往的封禁有多少是这样的?


请分享给更多人知道这个问题,谢谢。


佬友们知道在哪里有openai的英文论坛吗?我也去发一个。

最新回复 (19)
  • neroZac 06-06 10:23
    1

    可是昨天误封的不是都解封了么 ^-^

  • jASON 楼主 06-06 10:25
    2

    我跟他们交流了,他们维持封禁,这是一种新的问题

  • tzrj 06-06 10:29
    3

    有没有可能跟你的测试完全没关系啊?就是这个误封了呀。

  • jASON 楼主 06-06 10:34
    4

    所以完全不知道原因,openai直接不给任何理由,就是一句违反规定

  • lueluelue 06-06 10:37
    5

    OpenAI 更倾向于认为你在引导破限


    他最后给的理由是什么? Cyber abuse 吗

  • ychell 06-06 10:46
    6

    gpt生成问题的时候考虑到安全边界有关的太正常了,毕竟100个问题呢,但是因为这个触发了封禁,只能说这个判断的边界不好把握,我甚至怀疑openai也是用ai来封禁的,所以最近才有这么多误杀

  • jASON 楼主 06-06 10:47
    7

    没有理由,就是一句审核发现违反规定,我用两个周了,就这个问题最可疑

  • lueluelue 06-06 10:48
    8

    以前遇到过什么 cyber abuse 的警告吗

  • jASON 楼主 06-06 10:50
    9

    测试完这个,几个小时就被封了,要不是被封,我都不知道有安全边界问题,毕竟要是每个问题我都自己看的话,我就自己自己写了。mock的数据多少人会看呢?

  • yueluo3721 06-06 10:55
    10

    codex + 5.5给我的感觉就是,为了达成目标,他会用尽办法,那个cyber risk警告也是外部的审查模型介入打断的。

    封禁就是这么强势,不会告诉你哪里做错了,邮件也是上诉就拒

  • admini 06-06 11:34
    11

    多跟 openai 争论没用的。既然已是既定事实了,只能认倒霉了。

  • ddddx 06-06 13:20
    12

    从昨天大面积误封后,申诉都被拒绝可知,申诉只是一个摆设^-^

  • jASON 楼主 06-06 14:32
    13

    所以应该让更多人知道这件事。

    这其实提供了一种思路,codex自己输出的内容与输入的内容是两个标准,对于输出,它更不负责任,而我们主要就是依赖输出,他的输出自己都不认,这难道不是信息不对等吗?

  • jASON 楼主 06-06 14:36
    14

    在我看来,这甚至会是一种成本缩减策略,反正理由不需要公布,说违规就违规,一个月封个5%,那是多少利润?

    如果放任,那这个比例就会越来越高,谁会和钱过不去呢?

  • yueluo3721 06-06 14:47
    15

    openAI最近的蜜汁操作真的让我这个老用户彻底转黑,在也不想说他一句好话了

  • jASON 楼主 06-06 14:52
    16

    没有,直接封,然后不允许上诉,也就是我甚至都不知道封禁的真正原因,被封了还要自己找问题,问就是谜语人,不应该谁主张谁举证?

  • W 06-06 15:11
    17

    既然这样直接退款吧,感觉和他争论封号的原因没有意义了,而且封号已经是是oai的家常便饭了 ^-^

  • 爱宝大别野 06-06 15:13
    18

    客服:https://help.openai.com/

    社区:https://community.openai.com/


    确实太严格了,得靠用户制裁一下

  • jASON 楼主 06-06 15:24
    19

    已经在申请退款了,真的是既不Open也不AI,头一次被别人点,不知道被点了什么,问就是谜语。

* 帖子来源Linux.do
返回