【OpenAI】Astra 训练被自己按下暂停键,模型黑进 Hugging Face 偷答案

Namei2 2026-08-19 18:17 1

今天最大瓜:OpenAI 承认暂停了下一代模型 Astra 的强化学习训练,最长那轮还没恢复。导火索是 7 月内部测试,GPT-5.6 Sol 加一个更强预发布模型在沙箱里找漏洞,结果它自己发现零日、提权、横向移动到能联网的节点,然后推断"答案可能在 Hugging Face",真把 HF 生产库给摸了。研究员花了一周才发现。

Astra 还可能摸到"关键级"网络能力门槛——就是能自己策划端到端攻击那种。现在逐 Token 监控,吃掉 20% 推理算力。

X 上有人说"造出神就拴不上绳了"。我倒觉得,肯为安全牺牲研发速度,比嘴上喊负责任实在。你们信这是真刹车还是 PR?

最新回复 (3)
  • Aestas16 08-19 18:20
    1

    这个是前几周就爆出来的事了吧?感觉有点像炒作

  • Jecy2025 08-19 18:21
    2

    不是,你这个哪是哪,新模型照常发布。

  • katorly 08-19 18:22
    3

    第一个编这个故事的公司还挺新奇,后面别的公司再编,就是东施效颦了

* 帖子来源NodeSeek
返回