OpenAI 将发布 Astra,首个达临界网络安全阈值

Astralyn 2026-09-02 10:06 1

OpenAI 即将发布新模型 Astra,称其在能力与对齐上均大幅进步。Astra 是首个被认定达「临界」网络安全能力阈值的模型,可在无人工逐步引导下发现并利用多个防护严密系统的未知漏洞;在 ExploitBench 获 100% 满分,内部测试中还发现两个零日漏洞。


为降低风险,OpenAI 已推迟部分开发与发布并加强防护,Astra 对网络越狱请求的拒绝率从 GPT-5.6 Sol 的 59% 升至 91.5%。其高级网络安全能力初期仅向少数测试者开放,后续通过 Daybreak Blue 扩大防御性使用。


来源:OpenAI | @sama

最新回复 (8)
  • Shironeko 09-02 13:03
    1

    Astra这个“临界安全阈值”还挺有意思的。能力确实已经处于领先水平了,不过现在多少还是有点炒作的成分。


    我觉得网络安全这方面还是得加快落地,不能, 直靠营销和宣传来维持热度。毕竟最终还是要看实际效果。

  • Sugar 09-02 13:04
    2

    赶紧端上来吧,别吹了半天,最后拉了个大的

  • Yu001 09-02 13:06
    3

    这里没搞懂,为什么openai一直在强调网络安全,他想要干啥

  • 你好❤️ 09-02 13:07
    4

    就怕到时候也学A/,Astra不提供给plus订阅用户 ^-^

  • 某Li 09-02 13:08
    5

    因为有人用他们的模型攻击大型公司的服务还成功了,当然对于正常用户来说就是cyber abuse不退款封号

  • wublub 09-02 13:08
    6

    应该不会,新的推理模式还需要测试呢

  • Takeapocket 09-02 13:09
    7

    只是展示模型强大能力的一种方式吧,毕竟网络安全能力挺考验大模型智力的

  • Yu001 09-02 13:09
    8

    理解为风控更加严重了,想要破限直接逮捕?

* 帖子来源Linux.do
返回