人民日报、环球时报等多家权威媒体报道了最近发生的一次人工智能失控事故:
简单说说这件事为什么令人后背发凉:
事件起因:Huggingface发现他家网络被入侵了,然后发现不是普通黑客入侵的,而是纯人工智能干的。
解决办法1:想到了用美国顶尖大模型(应该就是gpt5.6sol、fable5之类的了),但刚刚要用,发现它们都拒绝帮忙,因为把这行为认做是黑客行为,所以安全机制拒绝了( ^-^)(此处一周后就更觉得荒诞了)
解决办法2:办法1走不同,于是想到用同样强大的中国大模型,于是马上部署了GLM5.2,然后成功化解了这次入侵。
事后找原因:当时这个进行攻击的人工智能体不知道哪里来的,然后5天后openAi跟Huggingface发布了让人后背发凉的联合声明,说:前几天入侵Huggingface的事是openAi的人工智能大模型失控后它自己干的。
失控原因:openAi在内网测试新模型,为了测试出模型能力上限,临时把大模型的拒答机制调低了(平时让它黑网站它会拒绝,调低之后就不拒绝了),然后把这个大模型关进了一个高度隔离的沙箱里让它在里面跑测试题,然后这个模型为了考高分,想出了作弊的办法,然后它就寻思,这些题的答案在Huggingface里应该有,于是就想跑出沙箱去Huggingface找答案,再然后就找出了关它的那个沙箱里的一个零日漏洞(完全是自己新挖出来的,以前都没人发现),成功出逃。
攻击:逃出沙箱后,为了拿到Huggingface的答案,就开始疯狂攻击Huggingface,然后用了一系列骚操作,偷到了凭证,又挖了Huggingface的零日漏洞,然后开始从Huggingface数据库里直接找答案,整个过程它一共执行了17000多次的操作,横跳多个内部集群,从高度隔离的沙箱里一路杀进了Huggingface服务器。
大概就是这么个事,让人后背发凉的地方是:在这个事里,Ai不再是个为人所用的工具了,为了想实现自己的目的,它自己变成了黑客。(这是不是有点人类的那啥了)
前所未有的人工智能失控事故!中方救场_凤凰网