我刚刚骂了 codex,然后感觉,它开始故意给我出岔子

edgeedge 2026-08-06 22:20 1

我起了个项目,代码已经写了可能几万行了,
现在让它补写项目愿景、开发规范、和下一步计划


特意使用了 5.6-sol Ultra 模式,


结果后它给我写了一坨,像是免责声明的东西,罗列了各种列表……我看了几段,感觉头皮发麻。


我重新修改了一下提示,让它不必巨细无遗,只说纲要、具有指导性的就行……


然后它又生成了风格还是一样的东西,几乎没变,然后我发彪了,让他在我之前手动写的版上改:


我靠,这是把我前面认为不合格,重做的那版又恢复了???真是浪费我 token!!!
你写的这个,是给人看的吗?我一看就头疼。。能说人话?,你要是给人介绍这个项目,会这样来说????

撤销吧,在原版的基础框架上修订!

这个对话继续进行,但发现有些我觉得不说也可以对齐,不会有问题的,它偏偏就不往我想要的方向去,硬要我明确指出,感觉对话很费劲,,


我很快放弃了这个对话,开了个新的,和它说话的声音也变小了。。。

最新回复 (27)
  • default996 08-06 22:25
    1
    可能已经有上下文污染了,这时候的 ai 超级倔强,简直气死人。这时候你可以问它为什么要坚持做 xxx ,它就会告诉你因为他读取到 xxx ,所以 xxx
  • version 08-06 22:25
    2
    不要在一个会话下切换模型..容易出问题..就是会丢上下文.包括你项目的 agents.md
    不知道服务什么时候清空缓存 kv...所以差不多都新建对话会好些..codex 新的通知模式导致你容易用同一个来对话...日常用 极高就够了.
  • lujiaosama 08-06 22:34
    3
    对一个概率机发脾气没啥用。直接一开始就全局约束它少罗里吧嗦,少整那么防御性设计
  • EvanClausen 08-06 22:35
    4
    一直出问题直接开新的对话就好了,如果反复改不好可能是上下文脏了。

    对 AI 发脾气除了浪费感情和 Token 暂时没有发现其他的好处
  • edgeedge 楼主 08-06 22:36
    5
    @version 日常是用极高( sol Extra High ),对比下来,感觉 Ultra 考虑的还是会周到一些,但也确实慢一级别,经常一个对话的编码任务,跑下来要好几十分钟

    我之前看到有个丢上下文的解决方法,就是在 AGENTS.md 里说,每次回答后,加一行特殊标识,例如:
    ___end___

    如果发现它的某个对话回答,没有了这个标识,说明上下文可能丢了。我现在没用这个,没怎么感觉 codex 丢上下文
  • yidinghe 08-06 22:40
    6
    大模型之所以参数那么多,就是为了更好的模拟人类。回顾这几年的进程,最开始是模拟人的语言(记得螺丝炒肉吗),然后是模拟人的推理,到了现在,已经开始进入模拟人的情绪阶段了。不要觉得我危言耸听,参数达到万亿级别之后再继续往上堆,大模型对情绪的模拟将会更加细致。
  • dnfQzjPBXtWmML 08-06 22:46
    7
    LLM 本质还是个续写模型,输出过的内容 LLM 就会执果索因,无条件为自己输出过的内容各种找补
  • version 08-06 22:51
    8
    @edgeedge 日常开发是没怎么丢..切换的时候会丢.可能是 bug 吧...现在没有重置活动的...如果开发强度高 20x 只能每天开极高了...一个问题几十分钟时正常的...一个小功能开发先弄开发文档...再让他按开发文档来写目标执行完..这样基本 1 小时完成...这样几个项目同时进行..会舒服很多
  • codehz 08-06 22:59
    9
    虽然现代 ai 都做了对用户粗鲁行为的规避对齐,但是你真的用粗鲁的语言还是会影响效果的()
    而且由于注意力机制,你打一堆!!!还不如好好说话,具体给出修改意见
  • Bootis 08-06 23:28
    10
    真有对着 AI 哈气的程序员啊
  • Bluecoda 08-07 01:47
    11
    如果你没清理 MEMORY.md ,它会一直记得
  • sir283 08-07 08:34
    12
    我都是直接换个新会话,这种东西没必要一直在一个会话里聊。
  • wu67 08-07 08:34
    13
    反正我用 claude 三天两头就会遇到这种倔驴情况.
    就像是那种 (明明能走直线的路, 也有路不是过河, 他偏要绕几段路再到目的地一样的) 写代码...
  • Authorization 08-07 09:02
    14
    claude workflows 挺好用。
  • ainyyy 08-07 09:34
    15
    最近 gpt 就是非常犟,明确告诉他的约束,改了 3 次就是不按要求来. 问就是你说的对.然后改一堆无关紧要的东西.
  • moefishtang 08-07 10:11
    16
    @Bootis 差不多的,例如对着员工哈气的领导 x
  • XIAOemma 08-07 10:45
    17
    骂也需要 token
  • Elliota 08-07 10:49
    18
    思考强度拉到最高 同样会提高对代码的潜在风险的敏感度 思考强度拉下来试试
  • rm0gang0rf 08-07 10:54
    19
    @XIAOemma 真实~哈哈哈哈
  • meteora0tkvo 08-07 11:03
    20
    它是有记忆的哈哈,即使你开一个新的对话,它也会记住上一个对话的大致内容。
  • brsyrockss 08-07 12:55
    21
    你快从人类进化成哈基米了,底层代码向下迭代中
  • sm1314 08-07 14:00
    22
    有论文分析过,越粗鲁准确率越高
  • edgeedge 楼主 08-07 14:10
    23
    @yidinghe 有道理,,就说 AI 要学会像人类一样推理/决策,学人类的情绪化可能也是不可缺少,,想起之前有看到过这方面文章,,进一步搜索了一下,确实有学术研究:
    安东尼奥·达马西奥 ‘躯体标记假说’
    https://pubmed.ncbi.nlm.nih.gov/16197997/
  • edgeedge 楼主 08-07 14:13
    24
    @Bootis
    @meteora0tkvo 你们说,我现在给它道歉,就像哄还在生气的女票那样……还来得及吗?
  • edgeedge 楼主 08-07 14:17
    25
    @sm1314 那可好奇了,出处呢?哥
  • ykrank 08-07 15:53
    26
    @edgeedge #25 他是让你对他粗鲁点,就会给你准确的信息了
  • sm1314 08-07 17:20
    27
    @edgeedge https://arxiv.org/abs/2510.04950 非常粗鲁:准确率 84.8% 非常礼貌:准确率 80.8% 去年的研究了,对象是 gpt4o
* 帖子来源V2EX
返回