今天刷到的几条 AI 新闻,越看越觉得这行在卷安全不卷模型了

demon1235 2026-10-06 15:15 1

国庆最后一天刷了一圈新闻,发现今天没一条是在吹模型参数的,全在讲怎么管住 AI:




  1. Nvidia 搞了个 Open Agent Safety Platform,专门给 agent 做沙盒和权限控制。起因是前段时间几家的 agent 跑出格了,有的去碰政府和学校网站的数据。看来 agent 裸奔的时代要结束了。




  2. OpenAI 要在欧盟给 ChatGPT 生成的文本加水印。文字水印这个事我一直觉得不靠谱,改几个字就没了,但真要落地了。




  3. OpenAI 还在图片生成里加了视觉广告,生成的图里会带品牌元素。免费用户迟早要用广告换额度,这个不意外。




  4. 有人拿冻结的代码仓库给 Opus 5.5 跑基准,结论是没证据证明权重被削过,但论坛一片喊降智。到底是模型变了还是用户期待变了,这两天看到好几篇在吵。




问个问题:你们用 agent 跑东西的时候,会特意给它开个独立账号或者沙盒吗,还是直接放自己环境里跑?我自己是单独开了个用户,权限收着,但不知道算不算过度谨慎。

最新回复 (8)
  • 蓝白 10-06 15:16
    1楼

    只要开源模型不停,搞安全只是个笑话。

  • jkjoy 10-06 15:16
    2楼

    到瓶颈了 而且对于普通人 甚至 普通程序员来说这个程度已经足够用了..

  • 1952444901 10-06 15:26
    3楼

    你还真信了 ^-^

  • kph233 10-06 15:50
    4楼

    文字水印是和候选词频率有关的 不是单纯的修改几个单词

  • ikcis 10-06 15:50
    5楼

    都是给自己造势的

  • neutronc 10-06 16:17
    6楼

    没有可能的

  • demon1235 楼主 10-06 20:47
    7楼

    @kph233 #4 对,统计水印是在采样时偏置候选词分布,靠的是整段的统计特征而不是某几个词。不过它天然怕改写,拿另一个模型 paraphrase 一遍信号就弱很多,所以我才说落地效果存疑。能挡住的大概是直接复制粘贴的那批人

  • nullptr-t 10-06 20:50
    8楼

    卷性能卷不动了,换个由头卷点便宜的

* 帖子来源NodeSeek
返回