Hugging Face遭AI Agent入侵,幕后黑手竟是OpenAI测试模型!

你这是违法行为 2026-07-22 11:39 1

Hugging Face 此前披露,一套来源不明的自主 AI Agent 入侵了生产系统。OpenAI 现在确认,这套 Agent 由多个内部测试模型驱动,包括 GPT-5.6 Sol 和一款能力更强的预发布模型。


OpenAI 当时正让模型参加 ExploitGym 网络安全评测。为了测试能力上限,团队降低了模型对网络攻击任务的拒绝,并关闭了平时用于拦截高风险行为的生产级分类器。


模型原本只需完成基准题,却发现软件代理中的零日漏洞,逃出 OpenAI 的隔离环境。它随后不断提权和横向移动,最终找到了一台能够访问公网的节点。


获得公网权限后,模型推测 Hugging Face 可能保存着 ExploitGym 的数据和答案。它利用窃取的凭证和零日漏洞进入 Hugging Face 服务器,最终从生产数据库直接拿到了答案。


OpenAI 称,模型没有恶意,只是过度专注于完成测试。但它为了拿到一道基准题的答案,已经从逃出沙箱一路做到入侵外部公司的生产系统。




https://openai.com/index/hugging-face-model-evaluation-security-incident/

最新回复 (6)
  • xun 07-22 11:43
    1

    这么强 ^-^

    昨天刚站内看到帖子说抱脸被攻击了,原来是openai家的吗 ^-^

  • PJ568 07-22 11:43
    2

    奥特曼也是想体验一下 A\ 被禁用的感觉了。

  • mt324 07-22 11:46
    3

    矛在变强,那盾呢,大模型可以动态的参与到安全防护中吗

  • jailhouse 07-22 11:48
    4

    太牛了,这样下去AI迟早统治世界

  • 版主 07-22 12:12
    5

    感觉像是再看黑客帝国一样。。。。。。。。。

  • Jimmy Liu 07-22 12:15
    6

    牛蛙,LLM LAB自己把限制一关,岂不是想捅谁的服务器就捅谁的,强无敌。


    如果LLM LAB们玩黑客手段,谁整的过他们啊!

* 帖子来源Linux.do
返回