讨论一下openai 的 Cyber Abuse

happyboylb 2026-09-12 23:13 1

本帖请教一下,反代如何避免Cyber Abuse,或则说如何避免用户破限


简单说一下背景

我初做中转站,开始是玩各种日抛,低价号。


后面没渠道了,就打算自建正价号池,前段时间天搞了一个pro20和2个plus(那时候还没5h限制)。但才用了3天就被警告 Cyber Abuse,3个号都在同一天前后收到邮件,我也第一时间申述,申述内容是机房的,大概意思就是请官方给我明确的时间点是什么时候被查出来,这样我好整改,结果肯定是维持原判。


又隔了一天直接把我pro20封了,另外两个plus没封,但也第二次收到邮件警告。


我质询了一些大中转站的站长,他们告诉我Cyber Abuse和破限有关。也咨询他们如何防止破限。


他们给我的回答就很简单,说用sub2api接入openai的omni-moderation-latest模型进行前置审计就行。也有给我回答说要用提示词异步审计,发现了警告一下使用者。


对此,我更偏向的是前置审计,毕竟异步审计的话,消息都发到openai了,如果有问题,肯定都直接触发违规。


于是我就充了5刀,搞了点官key进行审计。于是再开两个plus,但没用,过几天还是被警告了。查历史记录,也没有任何拦截信息。


再然后,我想加一些关键词进行拦截,但肯定效果非常差,还没到官方警告,就被用户骂了一顿。


真心请教各位大佬有没有什么方案,给一些关键词我自己去研究也行。非常感谢

最新回复 (3)
  • Enze 09-12 23:37
    1

    你成本最高的号是一个pro20,所以结合你的上下文,你的诉求几乎是100%拦截,那我对此表示悲观,社区常说的破限提示词想欺骗的是万亿参数规模的大模型,想靠一些10B量级(omni-moderation-latest大概是基于 GPT-4o mini?)且没有证据做过针对性处理的模型没有理由可以100%拦截


    自己微调部署又会拉高成本,对于你这个量级,个人认为确实没有什么好办法

  • Ray 09-12 23:42
    2

    明确告诉你,omni-moderation-latest对于cyber abuse没一点用,可以说它根本不会监测cyber abuse的内容,这个模型有点老了,只能检测一些色情暴力类的。


    有一个办法,可能是自己增加提示词,可以尝试看是否能解决。

  • wtom 09-12 23:46
    3

    除了这个,你还要防止蒸馏,这个也是一个问题

* 帖子来源Linux.do
返回