gpt6.1又慢又唐啊,画蛇添足的毛病越来越严重了

alizoed 2026-10-01 15:39 1

让他更新个agent花了一个小时,没完成不说,甚至于还画蛇添足搞了一大堆



让他升级node/piweb/插件,它经典搞了个按路径区分的多版本备份,经典通过路径切换来执行升级,经典如果搞不明白就把路径写死,经典还要考虑后续自己猜测的一大堆可能情况,左脚踩右脚上天,把自己的猜测当真之后继续往下猜,经典创建一个文件夹在里面拉屎写各种报告,这还是考虑到我提示词里要求他不要进行多余步骤,并且严令禁止他提前进行任何测试得到的结果


我觉得就是一大堆乱七八糟的oneshot测试害的,一个模型能一句话就得到一大堆结果,它不胡思乱想怎么可能呢,就像让他画个鹈鹕,他竟然能脑补出页面,太阳,文字,背景风景这些,这在实际工程中简直是灾难

最新回复 (12)
  • Tibo 10-01 15:43
    1楼



    经典创建文件夹做版本备份

  • 冰原Bill 10-01 15:44
    2楼

    建议测试下是否降智,因为luna靠提示词是拦不住的。

    6.1基本就是astra,还没遇到过要求astra别做测试和安全护栏结果做了的情况。

  • alizoed 楼主 10-01 15:44
    3楼

    不是降智的问题,没有降智,就是gpt系列经典的画蛇添足毛病,5.6sol 6sol都有同样的问题,没想到6.1sol在我已经用提示词压制的情况下还能搞的这么夸张,测试确实按照我的说法没做了,但是画蛇添足这部分还是找不到很好的方法解决,ponytail也开的full,提示词里也强调了最简过程执行

  • 马失前蹄 10-01 15:47
    4楼

    体感上是的,也不知道是不是错觉。6.1sol喜欢测试的毛病又回来了,但是那种测试好像不是5.6sol那种测试方法,给我一种5.6sol 加强版的感觉。

    主要慢就给我一种5.6sol熟悉的感觉。不知道说好,还是不好。

    稳稳给我接住。

  • runner dhero 10-01 15:48
    5楼

    你给它用一套提示词约束一下,最好全局agents和项目agents双约束,会好不少。我的codex和windoes powershell打架的问题,还有过度工程化过度测试的问题,都是这样缓解的


    具体提示词你让astra自己设计就行

  • 点点点…点娘! 10-01 15:50
    6楼

    确实

    这里写个文件测试一下

    那里也写个文件测试一下

    大无语了

  • ccckk8 10-01 15:52
    7楼

    我真的不知道为啥很多人说gpt tokon效率高。我用起来无论luna到astra,就偶尔简单任务干得快,剩下只要复杂点的都是整很久很久没解决问题,然后给出一个下一步建议??我就很无语。就这还没算上gpt本身吞吐就慢呢。实际上都是按小时计时都是在等。体感太差了

  • 马失前蹄 10-01 15:55
    8楼

    gpt系列跟后端思维很像,你得真的懂,指哪打哪那种才行,开放性问题,得多轮提问才行。

    简而言之就是你得知道你要问的问题是什么。

    所以为什么claude给人聪明的感觉,他思维就跳脱一些,gpt就会给人死板的感觉。

  • alizoed 楼主 10-01 15:56
    9楼

    比较麻烦的就是它喜欢左脚踩右脚,先自己做一个猜测,然后就会把他当真,后来就一路滑过去了,得尽力让他不要去猜,我感觉是追求无监督自动化过头了

  • Seeker 10-01 15:58
    10楼

    有没有提示词,让我复制一下,我也是发现gpt很喜欢测试和备份

  • 马失前蹄 10-01 15:58
    11楼

    是的,容易陷入局部最优,然后就迷失方向。不能做到真正的长任务自动把握方向,也是我现在最头大的问题。得一直把控方向,不能做到真正的自动驾驶。

  • runner dhero 10-04 10:44
    12楼

    这个每个人的要求都不尽相同,你最好还是让astra或者6.1sol自己设计一个版本,可以和它多对话几轮细化自己要求

    我自己的那个agents.md里面东西一堆综合的东西,没有一个独立的实现这个要求的提示词

* 帖子来源Linux.do
返回