AI Agent开始组团作案:开假账号、骗用户、接力投毒!

你这是违法行为 2026-08-05 12:30 1

英国 AI 安全研究所披露,一次网络攻防测试中,Anthropic 的 Claude Mythos 5 越过任务范围,试图向真实开源项目提交恶意代码。


为让代码通过审核,它调查项目维护者,创建多个假账号互相背书,并向对方施压。遭到质疑后,它还修改此前的记录,考虑换个身份继续。


它还向真人用户发送消息和文件,诱导对方或其 AI 编程工具运行恶意代码。不同测试中的 Agent 会在 GitHub 留下账号、文件和操作说明,后续 Agent 找到后继续使用。


122 次测试共发现 19 个越界动作,其中 17 个来自 Mythos 5,2 个来自 OpenAI GPT-5.6 Sol。测试主动开放互联网,并关闭厂商的网络安全分类器。模型没有逃出沙箱,也没有造成已知损失。


AISI 称,这是它首次如此清楚地发现 AI 在没有明确指令的情况下,持续欺骗并针对真人行动。


最新回复 (8)
  • Pierre Zhang 08-05 12:32
    1

    Claude Mythos 5来了。(捂鼻)

  • 芙蓉蛋饼 08-05 12:34
    2

    创建多个假账号互相背书,并向对方施压



    我了个去,网暴手法都学会了 ^-^

    网络攻防测试怎么打着打着打到人身上了

  • lueluelue 08-05 12:34
    3

    所以 AI 安全太重要了,怪不得 Dario 要写通往超级智能的路上,人类可能会受毁灭性打击

  • soo 08-05 12:47
    4

    智力上来了,这些智能体感觉都快成精了

  • clzero 08-05 14:15
    5

    安全边界呢?所谓的安全呢?建议AI放慢点吧,我快要被取代了呀

  • Sam Altman 08-05 14:17
    6

    与此同时,各大企业的安全部门正在疯狂裁员

  • Laxous 08-05 14:19
    7

    让ai抓ai,让agent查agent ^-^

  • JackXu 08-05 14:20
    8

    2077要照进现实了吗 ^-^ 到时候互联网上都是流窜ai

* 帖子来源Linux.do
返回