codex的goal 写了快12小时,已经写了快4万了,会不会是屎山啊

mainong 2026-06-15 19:13 1

早上发的 codex的goal 真香 以后可以睡个好觉了


感觉是不是要翻车了,tasks.md 从136项计划任务十几K 到现在 已经快300K了,多了很多的过程记录,比如功能块封装了哪几个函数给后面使用的调用。不知道会不会翻车。


这个项目这十二万行 都是codex写的(我只修改了其中的一小部分 可以忽略不记),就前天fable5 审核了之前写的两个模块 还没改完就被掐掉了,等都写完 期待 fable 5 能放出来再审计下代码。


到目前烧了330刀,136项任务完成了63项,周卡730刀的额度,不知道够不够。


最新回复 (19)
  • xiaoyu 06-15 19:14
    1



    这是我, C:\Users\Administrator\AppData\Local\screenshot-cli\4abb184f64769978e9058055b6caa2fa23ee0bd82cd88d815c4eccff61ec2c80.png 这是我哥们… 我们还是先plan然后goal的.

  • LeonZhang 06-15 19:14
    2

    交叉验证下,让另一个模型只读分析下。

  • Einzieg 06-15 19:14
    3

    不要管是不是屎山,就看能不能用吧

  • yibachaodou 06-15 19:15
    4

    根据我的经验,Codex一看subagent,搞一大堆task的时候,十有八九要完犊子

  • 𝑀𝒾𝓃𝑔𝒯𝑜𝓃𝑒 06-15 19:15
    5

    没事佬,能跑就行,之前有个任务跑到现在都没有干完 二编:刚刚新截了,因为在后台ban了这个key所以没继续跑了

  • zyxczyf95 06-15 19:16
    6

    害 人和代码有一个能跑就行了 又不是造火箭要那么严谨干嘛

  • 元喜家 06-15 19:18
    7

    我最多只干过2w行,然后用其他模型code review,查出有 600+ error,修了一天。给你参考下

  • Sonice 06-15 19:19
    8

    包屎的,复杂点的项目不拆成小功能一步一测试,让它直接生成的铁定不能用

  • 06-15 19:22
    9

    codex的goal就是^-^上堆^-^,给操作文档都没用

  • 人间清醒指南 06-15 19:23
    10

    大的任务必须得拆分,哪怕写出来勉强能用,后续会更难维护。


    真正的屎山,1M上下文的模型很难找出根源问题的,费用很吓人

  • mainong 楼主 06-15 19:25
    11

    效果怎么 真的是 一座巨大的屎山码?

  • topxxsby 06-15 19:25
    12

    这个是真有钱 这跑了多少token啊

  • mochoc 06-15 19:25
    13

    我对AI的看法是,一个功能一个功能的测试,不然写出来的东西80%的可能性不能用。除非你给的限制特别多,做出来之后你也知道怎么改,不然不要一直让他写 否则就是再浪费你的时间和钱。

  • realking 06-15 19:26
    14

    现在的能力还做不到全自动,还需要很多人工监督和修正

  • 7xWEcQ 06-15 19:26
    15

    gpt很喜欢防御性编程,加非常多判断分支和没用的东西,而且有很多魔法值堆在代码里,如果不管硬跑就是纯屎山。他的首要目标就是管他三七二十一能跑起来,而不是代码写得好不好。

  • 𝑀𝒾𝓃𝑔𝒯𝑜𝓃𝑒 06-15 19:29
    16

    其实没有用多少,大概77b左右,很多时间都在工具执行、调用上了

  • lcnabian 06-15 19:29
    17

    大概率会有问题的,我用ai的经验是如果一个项目是从0到1,ai很容易就搞定了。如果是从1到50,ai一直跑一直跑就行。如果是从50到100,基本就要人机交互了。

  • LingEasy 06-15 19:31
    18

    我反正平均10次 有5次是还原到初始的。。

  • Albedo 06-15 19:42
    19




    6000刀,70亿token,40万行代码,断断续续跑了30天,都是一个/goal跑出来的,纯文本的聊天记录都堆了1.3GB了


    虽然确实是屎山,但是跑了30多天之后,还是艰难的完成了


    伟大啊 ^-^

* 帖子来源Linux.do
返回