真的有用AI执行过某个任务,几个小时不断迭代的嘛?

zetao hong 2026-09-02 16:53 1

之前看那些宣传自动执行10几个小时的,觉得很夸张。目前好像都没有真的执行过超过1个小时的

最新回复 (19)
  • kingstacker 09-02 16:54
    1

    我的token不够这么久主要是。 ^-^

  • 马上来啦 09-02 16:54
    2

    让 codex 识图跑 bench 算吗

  • KZ 09-02 17:00
    3

    Codex App里面我用goal模式最长记录是跑了4天 ^-^

  • mirror喵ovo 09-02 17:01
    4

    有的,设置goal目标,我让ai在帮我优化体积云渲染,设置了goal跑了15小时然后烧了2Btoken,当然没修好,只能说是能看的地步

  • popyui 09-02 17:01
    5

    我让我的ai做一个2013年中mac book air安装win7的u盘。

    这个u盘其实很好做,但是前提是今年不是2026,而是2016.

    我的ai很快就利用bootcamp完成了这项工作,但是这里有个巨大的坑,就是很有可能install.img被加载了但是usb驱动没有被加载。这导致鼠标键盘外设全都没用。

    我试了一下,果然,此路不通。

    丢给mac mini上的codex,让他解决这个问题。

    坏就坏在,如果这是win上的codex,它可以利用dimm工具解决。

    mac搞不了这个。

    但是无法向我交差。

    前思后想,装了虚拟机。

  • 砂銀 09-02 17:01
    6

    有那种本身编译测试时间很长的,模型其实主要在等,不是一直在输出

  • kid2freak 09-02 17:02
    7

    有些是脚本测试很长,实际编写的话感觉没有用很久

  • 卡卡西 09-02 17:02
    8


    还是有的 ^-^

  • jue 09-02 17:02
    9

    让gpt5.6给你安排一个计划,再使用superpowers的执行skill执行一下,一小时都说少了 ^-^

  • light2199 09-02 17:03
    10

    有的,但很多都是拉了一坨大的,除非是那种开放式的但有准确最终可验收结果的,可以直接用目标模式跑,但会比较耗token。否则其实一般来说真的效果不太行。

  • pineapple 09-02 17:03
    11

    有过跑4个小时,睡觉前丢个参数调优任务睡醒验收

  • 陈小爬 09-02 17:04
    12

    现在gpt5.6的速度,不是随便整个什么都是1h起步么

  • wangzhen3691 09-02 17:05
    13

    然后就是测试已通过,门禁xx通过,是否进入下一个流程 ^-^

  • 这个问题有问题 09-02 17:07
    14



    有些外包项目就是要语言转换,直接让AI慢慢跑,跑完就启动看看转换是否成功,自己测一下各个功能 ^-^

  • zetao hong 楼主 09-02 17:08
    15

    是呀,最终效果不可控感觉是最大的问题。中间又猛猛烧token和时间

  • ted 09-02 17:09
    16

    写demo个人项目可以,时间一长误差很多,不插入检查节点,基本偏离。

    这种概念更像是模型厂token消耗不完提出的概念

  • Janlink 09-02 17:10
    17



    很多吧,随便一个 goal 都得好久,不过有些会死循环,还是要看着点的。

  • 老鹰抓小鸡 09-02 17:10
    18

    用superpowers搞个大点的需求计划都要跑十几个小时 ^-^他会拆成10几个任务,跑一个build下,review下半天过去了。真实业务不是demo

  • ccqc 09-02 17:11
    19

    目标模式,不会欠费,api不报错,你让他跑一年都可以

* 帖子来源Linux.do
返回