GPT 6 Astra 能力倒退

NYfLAmE 2026-09-09 11:27 1

如题,经过我两天高强度对GPT 6 Astra high/xhigh的使用,发现GPT 6 Astra并没有GPT 5.6 Sol那种拥有全局视角,思考周全的能力(可能是GPT 5.6 sol超长推理时长带来的优势?),GPT 6在局部最优路径上比GPT5.6强,经常会出现每一次交互只会推进一小步,在开发方案已经明确的前提下,仍然需要一直盯着它干活,因为GPT 6经常只完成了整个计划中的一小步就停下来,且会较高概率出现用局部实现完成的结论代替全局实现完成的结论,完全不具备官方所说的端到端的长程任务能力。

最新回复 (8)
  • 小车子BUBU 09-09 11:31
    1

    我用的MAX感觉很一般,ULTRA不敢用,几分钟答案都没出来就用光了

  • 9nine 09-09 11:33
    2

    现在有一个几万行的小屎山想重构,不知道用astra还是fable了

  • summerjoe 09-09 11:34
    3

    @9nine #2 fable出方案astra执行,或者国模执行astra审查

  • Miku-Desu- 09-09 11:35
    4

    之前也有这个问题,后面突然又好了,自己跑大几个小时干完

    不过后面我开了完整权限给他,不知道是不是有关系

  • NYfLAmE 楼主 09-09 12:10
    5

    @9nine #2 我会选择fable/5.6Sol给方案 grok 4.6执行,对于编码场景,目前我没有找到使用astra而不用fable/5.6 sol的场景

  • NYfLAmE 楼主 09-09 12:12
    6

    @Miku-Desu- #4 总之我没有发现5.6 sol有这种问题

  • Aphrodite 09-09 12:13
    7

    我感觉可能是有点不太稳定。


    我写论文让sol帮我扫了一下论证里面的问题点,然后让astra参考sol的结果再扫一次然后再分析。结果他准备直接用sol的结果去做分析。


    不过有时候又很聪明。之前困扰了我很久的一个论文的问题用sol一直无法很好地帮我找到解决方案,但是astra一下就找到命门了。

  • KEVI 09-09 12:18
    8

    昨天在 mid 上感觉全局视野不行,暂时还是用回来 5.6 xhigh/max 好像稳定一点(主要也是烧不起 ^-^ 我现在找问题 claude + codex 一起来找,大部分时间 claude 容易定位到问题,codex 容易绕圈)

* 帖子来源NodeSeek
返回