完全不熟悉的领域,让 GPT5.6 进行 review,一个周了还是有 P1 问题咋整?

andforce 2026-07-24 12:27 1

让 gpt5.6 写了一个网络调试软件,

写完了之后,我会新开一个窗口,清空上下文,让 gpt5.6 进行 review 。

然后把 review 后的结果,发给开发的那个窗口,继续改,改了再 review ,就这么陆陆续续搞了快一周了,还是有问题


review 出来的那些问题,处于我的知识盲区,也不知道是不是真的有问题,崩溃
最新回复 (33)
  • scarlex 07-24 12:33
    1
    那你应该利用 AI 去补一下该领域的知识吧
  • yefuchao 07-24 12:33
    2
    换一下其他家模型试试
  • avenger 07-24 12:53
    3
    换模型 review 加一句:独立思考,联网搜索最佳实践
    一般会好一点
  • lscho 07-24 13:01
    4
    让模型 review 我就没见过不出问题的。。。
  • snxq1995 07-24 13:13
    5
    说明实现细节模糊,且可供选择的方向很多。AI 本质上还是一个带权重的随机数。解决方案就是你去了解下,然后提供一个你想要达成目标效果的思路。
  • night98 07-24 13:17
    6
    没啥用,自己实测比较合适,有生产问题再丢给它改,不然你换个模型扫依旧能扫出一堆问题。
  • afxcn 07-24 13:19
    7
    你用 5.6 Sol Ultra 试试,一次就给干好了。

    我让它解决错误处理和闪退问题,它给写了 4 万行代码,删了 2 千多年代码,还不停。
  • nuk 07-24 13:21
    8
    TDD ,让他自己写用例,如果测试不了,就重构到能测试
  • afxcn 07-24 13:21
    9
    现在它是跟 0-RTT 问题干上了。
  • doraemonki 07-24 13:22
    10
    每次 review 出来把某个结果丢给一个新对话,跟他说这是 claude 说的,合理吗?是小概率场景吗?有必要改吗?
  • Meteora626 07-24 13:23
    11
    只要评审 永远停不下,我用的 5.6 sol 极致。 我已经放弃了, 先实现再说
  • lins05 07-24 13:31
    12
    > 新开一个窗口,清空上下文,让 gpt5.6 进行 review 。
    > 然后把 review 后的结果,发给开发的那个窗口,继续改,改了再 review ,就这么陆陆续续

    让 codex 先给你写个 skill 吧,这个 skill 的内容就是: 启动一个干净上下文的 sub agent 在 subagent 里 review, 然后 main agent 根据 review 的输出再初步判断,值得修复的再修复

    这样至少不用几个窗口来回复制粘贴折腾了
  • HENQIGUAI 07-24 15:11
    13
    直接开/goal, 不改好不罢休
  • chengYT 07-24 15:18
    14
    开 goal 模式,review 完修修完 review ,直到没有问题
  • hope7777777 07-24 15:19
    15
    大概率底层设计就有问题,推倒重来,反复 p1 说明一直在兜底
  • lujiaosama 07-24 15:21
    16
    交叉审查,不要只用 GPT.其次是不要小修小补,按照近乎重构的方式.最后是你自己需要懂一些, 让 AI 给方案再进行抉择.
  • odirus 07-24 15:23
    17
    @nuk 效果不会好的,AI 会为了通过测试用例而故意修改测试用例,或者乱造一些测试用例。

    所以要想驾驭 AI ,还是得有专业领域知识才行,不然会来来回回很浪费时间。
  • rubyacgn 07-24 15:54
    18
    和你差不多的情况, 我是让 SOL 审 PRD, 总能找出新问题
    后来我放弃了, 重开项目用 ULTRA 产出 PRD, SUBAGENT 几轮审查后认为没问题就过了, 躺平
  • nuk 07-24 16:06
    19
    @odirus 我之前用 gemini 它就经常偷懒,但是把模块拆小后,限制它只能在当前模块测试和 fix 就也能一个一个做完,直接丢一整个大工程给它就容易瞎搞,改的乱七八糟的。
  • ntdll 07-24 16:20
    20
    本质上就是变成了萝卜开会。

    两个模型出于自己的立场,会强调自己没问题。这个时候只能靠人工来判断了。
  • ttt1088 07-24 16:50
    21
    需要换个模型审查吧
  • LittleControl 07-24 16:54
    22
    我 gpt-5.6-sol high 一般 review 出来的问题 修复最多两轮后面就没有了,当然也可能跟项目复杂度有关
  • hustfox 07-24 17:04
    23
    @afxcn 是真的细,一个需求 5.5 extra high 可能一两个小时搞完了,5.6 extra high+fast 能干个一两天。。。
  • fovecifer 07-24 21:04
    24
    需要制定一个标准,如果标准过于严苛,可能永远改不完
    就算是双模型互审,我也遇到过三四天不能收敛的情况,最后改出来一坨屎,只能回退
  • afxcn 07-24 23:25
    25
    你要求它每个小任务都提交一次就好了。 @fovecifer
  • nsjs 07-25 00:48
    26
    ai 不像人的,没有原则和偏好。如果设计本身就有问题,或者存在争议,那反复横跳是必然的事情。
    另外,世界上本身就不存在完美的程序,要让 ai 找茬是能够无限找下去的😂
  • Thesara 07-25 09:13
    27
    review 和修改不要用同一家族的模型
  • Onlybaidian 07-25 09:23
    28
    没有判断力,修改就是一个无底洞,有修改可能不重要, 你陷入在过度优化种
  • fovecifer 07-25 11:01
    29
    @afxcn 让 AI 解决的本来就是复杂的问题,如果是普通的问题或者简单的代码生成,几乎不需要 review
  • swananan 07-25 12:00
    30
    好奇是什么网络调试软件,具体是什么问题,发出来看看呢
  • alexluo1 07-25 13:22
    31
    一直 review 一直修修补补,写的代码也不知道对不对,我也遇到过
  • ldy619354397 07-25 14:04
    32
    要不就用多家 AI 互相审计一下
  • promontory123 07-25 14:05
    33
    换 opus4.8 吧
* 帖子来源V2EX
返回