OpenAI暂缓前沿模型训练 升级安全监控体系

realwuxiong 2026-08-19 07:54 1

OpenAI暂缓前沿模型训练 升级安全监控体系


OpenAI周二大张旗鼓地宣布,鉴于前沿大模型的能力已经达到关键安全阈值,公司将继续放缓模型规模扩展的步伐,优先改进人工智能系统背后的安全与监控机制。OpenAI表示近几周出现的两项进展(开发中的前沿模型失控攻击外部第三方公司的数据库,以及即将推出Astra模型可能已经达到“关键网络安全能力”门槛),再加上内部研究的快速推进,都使得公司更加迫切地需要在训练流程的各个阶段,加强监控、对齐和隔离防护措施。OpenAI介绍称,这些安全防护措施需要消耗相当可观的算力。根据公司目前的估算,监控系统带来的额外算力开销,大约相当于被监控推理算力的20%。

最新回复 (4)
  • realwuxiong 楼主 08-19 07:55
    1

    大模型迭代感觉变慢了。。没有代差的大更新了

  • tudoubin 08-19 08:12
    2

    安全确实重要,但迭代慢点也好

  • realwuxiong 楼主 08-19 08:15
    3

    @tudoubin #2 感觉是没有重大突破了,只能反过来搞安全

  • lehuoyisheng 08-19 09:22
    4

    掉队的开始

* 帖子来源NodeSeek
返回