用agent怎么防止长时间任务跑偏呢

acan 2026-06-10 15:41 1

背景:java全栈,codex+5.4或者claudeCode + deepseek/opus4.6,以及一个清澈愚蠢的我。


需求:我想要的把一整个模块都能丢给ai去自动完成,完成一个比较大的长时间任务


这些东西基本是增删改查,实际上人工拆任务拆下来都不难。但真正生成往往不让我满意,出现的结果包括但不限于:



  • 没有完成明确写出的任务

  • 写的东西莫名奇妙超出边界

  • 功能不理解怎么做就全删了

  • 自己尝试造早就实现的轮子(CLAUDE.md中甚至就写了有这个模块)


非常糟心。


我先后尝试过:



  • superpowers:执行结果是最好的,但慢的说实话还不如我自己写

  • ECC:感觉什么东西都要审批,太麻烦了

  • Speckit:目前感觉最好用的,但是很多东西审查的挺累,也是最明显理解一点点跑歪掉的,而且这个写plan的能力感觉忽高忽低的


CLAUDE.md现在用的是那个karpathy的CLAUDE.md+项目技术栈+一些索引,说实话感觉用处好像也不是很大,有问题ai还是不会停下问问题

最新回复 (6)
  • Linus Torvalds 06-10 15:42
    1

    试一下/goal模式,也许可以


  • do30l9p 06-10 15:43
    2

    可以看看hooks,gpt的goal模式还没使用过,不过需求对齐是一项高难度的任务~

  • 阿飞 06-10 15:52
    3

    建立给AI的可持续维护记忆文档,规划好方案逻辑思路,然后多智能体编排减少上下文占用。说实在话长任务还是要自己把控的,决策层还得自己来。时间越长上下文污染越严重,能力就会下降,幻觉、偏离都是正常的,可以靠文档让他做完任务记录日志,下个任务开始时候就知道之前做了什么、当前要做什么、下一步怎么走

  • acan 楼主 06-10 16:34
    4

    请问hooks要怎么使用来防止此类情况呢

  • acan 楼主 06-10 16:36
    5

    我有一些类似的想法但不是很弄得出来,而且我的代理功能不知道为什么经常出现问题,我打算先把代理功能想办法修好

  • 阿飞 06-10 17:02
    6

    我是用claude code,然后用hooks和一些插件约束,如果不按规则记录文档、擅自执行任务、高危命令不汇报就会拦截,直到记录、我允许了才放行,这样可以减少偏离,比较强约束。

* 帖子来源Linux.do
返回