AI 自己跑命令的时候,怎么判断它有没有动危险操作?

Tung 2026-06-13 23:57 1

本来只是让 AI agent 帮我改项目里的一个问题,看看代码、改改文件、跑一下测试。


结果它在执行过程中自己跑了一堆命令,我也没一直盯着终端。等我发现不对的时候,git reset --hard 已经执行完了。


这个命令是它在处理任务时自己跑的,执行前也没有单独让我确认。没 commit 的改动被 reset 掉以后,就真的没了。


想问问佬友们,用 AI agent 写代码时,有没有什么办法能记录它执行过的所有命令?或者在执行危险命令前强制确认?

最新回复 (6)
  • Linus Torvalds 06-13 23:58
    1

    codex有auto-review的功能,调用codex-auto-review模型来判断是否执行;claude的permissons可以设置deny这个命令







    codex也有类似的Rules,不过是实验性的




  • Tung 楼主 06-14 00:09
    2

    感谢佬友帮忙,我现在就去试着配置一下。

  • 🐟 06-14 00:10
    3

    这属于安全领域了^-^


    最好的方法是沙箱或者可以打快照的文件系统


    或者造个 pre command hook 的轮子做安全审计


    记录的话可以附加一下,Linux的话可以捕捉一下fork进程


    像 Agentsight 就是在做这个的


  • unsafe 06-14 00:34
    4

    佬友用的是claude 的话 可以看看其文档

  • hello world 06-14 00:40
    5

    可以打快照的文件系统



    例如btrfs+timeshift自动备份,每天一快照

  • Tung 楼主 06-14 00:44
    6

    我现在用的就是 Claude,之前也看过一点 permissions 的文档。只是当时不知道该具体拦哪些命令,就问了 AI,让它列了几个高危命令。但最后还是被绕过去了。

* 帖子来源Linux.do
返回