Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹

𝓵𝓮𝔃𝓲𝓼𝓱𝓮𝓷 2026-08-16 13:00 1







Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹 - IT之家

最新回复 (5)
  • Naxida 08-16 13:08
    1

    哈哈,我并不是想使用网络搜索,我只是想测试测试你的网络是不是好的。 ^-^

  • 十山月 08-16 13:09
    2

    怎么感觉是A/的小故事环节,这都能意外吗

  • Sky390 08-16 13:12
    3

    依旧 A 社不定时发 ai 小故事

  • sse 08-16 13:29
    4

    是这样吗



    来源:


    给我看笑喷了
    [image]
    [image]
    [image]
  • Mikee 08-16 14:16
    5

    这分明是没有训练好吧 ? 教了一些乱七八糟的东西, 数据不干净

* 帖子来源Linux.do
返回