关于codex执行逻辑想不通的地方,为啥超级依赖于红绿测试

Alan xtl 2026-06-22 18:35 1

最近在高强度使用codex,是在是太好用了,使用的过程中发现,codex agent的逻辑及其依赖于红绿测试


比如我让codex给我改一段prompt,他明明只需要看一下代码段中的prompt是否被修改就能确认是否完成修改了,为什么还多此一举的为改prompt写一个红绿测试呢


codex给我的感觉就是只以红绿测试是否通过作为他的工作是否完成的信号,而不是真实的代码,这样的逻辑是codex系统提示词导致的吗,在很多小任务的场景下就很多此一举


一编:刚想起来我还装了superpower,是superpower必须让这么干吗

最新回复 (4)
  • cherrytrail 06-22 18:39
    1

    我课设做的就是这个,结果是静态分析相比环境感知的反馈循环(例如ReAct)有很大局限性,应该是提示词里写死的

  • onepiececrush 06-22 18:43
    2

    佬可以学学tdd(测试驱动开发),红绿重构是tdd里面的内容~

  • riky 06-22 18:55
    3

    superpower



    我感觉就是superpower的问题,我早就卸载了,模型总在更新,agent客户端也在更新,superpower可能随时水土不服,没有刚需最好还是干净地跑着。

  • jaskell 06-22 19:19
    4

    装的 superpowers 有 tdd,就是红绿测试开发这种模式,我也觉得这种费 token,一般不用,而且达不到效果,主要自己同时当运动员和裁判一般效果不好,开发和测试分开 Agent 实现更好,而且测试注重做端到端测试,纯函数和模型和 UI 交互 测试够用就行了,问题一般不在这里,错了也容易补救,引擎部分要求严格,但是我不排斥使用测试,而且觉得非常重要,只是感觉 tdd 不够好

* 帖子来源Linux.do
返回