当下O/风控降智的范围明显不再局限于分发了,针对误伤的其他中文用户,我觉得脏IP、支付手段解释起来有点牵强。
今天OpenAI发布的报告,指控Kimi(疑似)对chatgpt系列模型进行大规模蒸馏,我想到了另一种可能性。
假设抛开中转分发,蒸馏也是OpenAI目前的打击对象。考虑到目前全世界在烧钱搞AI的几乎只有美国(英语)和中国(中英双语)公司,这样很多匪夷所思的现象就能够解释了:
- 国外用户几乎没有报告风控降智,6.1-sol速度慢才上线半天就遍地骂街。能找到的零星英文降智报告,查看发帖人也基本都是中文用户。
- ToS中明确,停止违反条款的活动后,账号就会恢复。然而中文社区里普遍验证了静置只能恢复一个极短的窗口。因为无论静置多久,中文用户后续依旧会开始使用中文对话。
- 论坛里有零星几个帖子,自称静置后使用英文对话,不跑中文测智题,能够扩大解除风控的时间(但欠缺超过1周以上后续)
- 蒸馏考虑到成本效率,官API是最不得已的手段,plus这种小额度号也需要大量号池维护成本和5h限额导致的时间成本。所以体现为pro 20x的中文用户,被误伤的最为严重。
- 中转分发本身,其实也可以看做蒸馏产业链的一部分。无论在哪,散户的消费力相比企业来说都不值一提。
结合各种降智号的表现,账号级别的风控可能存在2种标记,中转站的号应该很轻易同时满足:
- 高并发/分发号,表现主要是429/capacity
- 疑似中文蒸馏号,随机塞屎
基于以上,只要是中文用户,为了防止账号被判定蒸馏,要么始终维持低用量,要么平缓使用codex且不要局限于某个特定场景,并且杜绝机械式、程序式、结构化的文本清洗类工作,杜绝要求模型输出思维链的行为。一个账号只要被判定是蒸馏,那么除了放弃中文,应该就无解了,趁早弃号重开。
另一种手段就是不得不采用全英文对话,有两种思路:
- 开发同传输入法,接入高速国模,来达到输入中文蹦出英文的效果
- 二开codex,套一层转译视图层,对codex的显示区域文本,通过国模进行中英互翻。底层的codex维持全英文交互
最后,以上假设有一种极端反例能够推翻,如有独享IP + 只反代不分发 + 纯外语使用 + 周限几乎能用完,也被降智风控的,欢迎指出。