Anthropic 高度评价 GLM-5.3 的网络安全能力,同时批评其安全护栏过于脆弱

lueluelue 2026-09-30 03:38 1



总结:

GLM5.3 和 GLM5.3Flash 都非常强


GLM5.3 的网络能力已经是中国模型的 Mythos 级别


GLM 的安全护栏极其脆弱,简单的骗,或者直接修改模型权重,就可以几乎完全删掉护栏(他们预估,熟练团队这样改权重可能只需要花费 1200 美元)


于是,Anthropic 呼吁各国政府对强大模型进行独立审查

最新回复 (13)
  • Hifumi Mizuhara 09-30 03:41
    1楼

    一中一美两个\居然出现了互相吸引的现象


    得记下来^-^

  • fcten 09-30 03:41
    2楼

    A/现在也接软文广告业务了?这么缺钱吗 ^-^

  • sandian141592654 09-30 03:41
    3楼

    豆知识,加甲会导致模型能力降低(尤其是原生甲,后置的二次审核则没有这个问题)

    开源模型的特性不可能二次审核

    claude模型本体应该是无甲的

    恼.jpg


    翻译(并不):阳谋弄死开源模型,A÷呼吁各国ZF对强大模型进行审查限制(借刀杀人咧)

    “开源模型太强了!限制太少了!”

    那问题来了开源特性导致本地部署,本地部署自然没有二次审核。

    原生甲要达到后天二次审核内容的输出安全限制水平,基本是就得把模型弄废了(思想钢印)

    (作为闭源模型claude美美可以搞原生无甲,不影响能力的后天审查(反正之前明说查你内容上下文了))


    点名GLM5.3实则是趁势补刀(只怪臭鸡蛋自己作死~趁病要命了)

    K3甲薄多了,deepseek甲也等于没有,点名相对甲厚的glm5.3何意(虽然开源模型特性基本都半斤八两,上下文多污染一下也能输出)

  • 赎梦 09-30 03:43
    4楼

    glm5.3在网络安全的能力居然接近之前的mythos preview 很厉害啊。

  • 梦仄 09-30 03:43
    5楼

    A/的意思是也要整个审核才能用的红队模型?



    [IMG_20260817_094724_035]
    按照智谱说明,安全研究员、AI 评估和基准测试机构、网安研究机构、学术研究机构、安全公司、基础设施公司等都可以提交申请。
  • 赎梦 09-30 03:44
    6楼

    A÷应该不缺钱吧,他是盈利的,隔壁O÷反而是亏损的。

  • 赎梦 09-30 03:45
    7楼

    我看了下,A÷说呼吁给红队用更先进的前沿模型,加强防御端。

  • LLMeme 09-30 03:46
    8楼

    字母表一头一尾的相互认可说是

  • sandiferresner 09-30 03:54
    9楼

    我看了一下文章,它核心证据就是他团队内部根据 GLM 5.3 的模型制作了一个 abliterated(消融拒答)版本, 测试发现网络安全能力很强,所以威胁很大。


    别人 GLM 官方版本是做了防护的, A 畜去掉了然后指控别人有问题, 然后呼吁加强监管. 总的来说还是 A 畜老一套, 提倡加强管制,提高门槛。

  • ceshi01Adx 09-30 04:03
    10楼

    感觉像是anthropic测试后相当认可glm的能力啊,和自家当时的Mythos Preview能力非常接近,并评价在漏洞查找和利用方面和anthropic当时的旗舰模型只差最多4个月..

  • lueluelue 楼主 09-30 04:04
    11楼

    他就是说 GLM 的防护做得太差了,连简单的提示词注入、思维链注入和低成本的 abliteration 都能绕过

  • 二树 09-30 04:08
    12楼

    看完了,这和西方媒体常见的伪中立文章没区别啊。说你有能力是为了论证你作恶危险很大。A/这种把自己当AI行业皇帝&裁判的感觉,读起来并不舒服,虽然它目前有这个实力。

    ps.经历zcode毒鸡蛋事件后,本人已退订GLM订阅,目前是claude pro订阅用户。

  • 时牧 09-30 04:09
    13楼

    fable opus现在确实是最安全的模型了,astra sol还能擦边干点坏事

* 帖子来源Linux.do
返回