GPT 5.6 在ChatGPT web端的体验太勾八垃圾了,简直是无敌倒车

AAAAAAAAAAAA 2026-07-24 01:22 1

叠甲:被气昏后的情绪化输出,如有错误请指正。


本帖仅指web端中GPT的表现


GPT-5到GPT-5.5,五代模型。都在不降低能力的情况下缩短thinking时间,从GPT-5 thinking几乎每个问题都要想 10-15 分钟以上,到GPT-5.5 thinking超高几乎每个问题都只需要 1-3 分钟。我认为web端的体验都是不断在上升的。


但是到了GPT-5.6 sol thinking,这个体验真的下滑的很严重。首先就是初代 5 系的雷霆大思考又回来了,回答质量没提升多少,想的多太多了,本来先前5.5t只需要三分钟的问题,sol得雷霆思考几十分钟。


举几个例子:比如我让GPT去找文献,我看思维链明明已经找到了wiki的条目,但是这个雷霆模型居然觉得wiki里的文字不够权威,从而从wiki指向的原文库找到了原件的pdf,然后开始疯狂尝试在它的沙盒环境里OCR这个pdf,在获得原文之后,sol 再次 开始雷霆思考,该不该把这段文字给我,因为system prompt里不允许GPT引用超过15词。mlgb的,我让它找的300年前的文献,作者不知道死多久了,而GPT还在那雷霆思考会不会引发版权风险。。最后他想了44分钟,终于把我在半小时前就在他思维链里的wiki链接中复制的文字输出了。。


然后就是在很多任务中,我不知道是不是网络搜索工具出什么事情了,GPT一直在尝试把网页搞到他的小沙盒环境里,然后动用各种手段拿去信息。难道在线访问拿不到的信息保存下来再用python分析网页就能拿到?


这些任务再GPT 5.5 thinking超高的情况下,是完全不会出现的。




补充说明:调研类任务居多


然后GPT web端的雷霆模型选择器也是傻逼中的战斗机,首先每开一个新对话,都会强制给你换到最新的模型,所以如果我想继续用 GPT 5.5 的话,我就得每次对话都手动点击切换模型。很麻烦


然后GPT web端ui天天改,不知道OpenAI在想什么




多提一嘴,我愿意花正价买你的GPT pro很大原因就是因为你的ChatGPT这个web、app好用,我为了pro级别模型和超高思考强度的thinking,本来这些都是很好用的工具,查东西又快又准,特别是 5.5thinking超高,几乎什么都能迅速的查出来而且错误率很低,我想不明白为什么要这样反向升级。


说实话,现在搞成这种,我还是不大满意的。

最新回复 (14)
  • cohen 07-24 01:24
    1

    从GPT-5 thinking几乎每个问题都要想 10-15 分钟以上



    想起之前o3 mini high刚出的时候是真的离谱,很多任务都要半个小时

  • AAAAAAAAAAAA 楼主 07-24 01:25
    2

    o系列模型都思考的比较久,毕竟是雷霆思考鼻祖。当时刚用也是很震撼的,想不到一个模型居然能自己持续工作那么久。

  • cohen 07-24 01:26
    3

    只能说真让奥特曼找到消耗token的方法了,codex上紫色传说智能体不要钱的开,能力没什么提升

  • Chinamobile 07-24 01:31
    4

    昨天在web端上传了一份300M的实验数据,就两列,寻思让他处理一下。

    结果直接垃了坨大的,发出消息后 正在思考…然后就“连接已断开,正在等待完整回复”

    重试了三次都是这样,这个会话就卡死了,发什么都是连接已断开,正在等待…

    不知道是处理不了这么大的数据还是怎么着,最后用grok build跑的,又快又好

  • AAAAAAAAAAAA 楼主 07-24 01:34
    5

    我严重怀疑OpenAI为了引导大家去用他们的垃圾work模式,大大的阉了chat模式的agent能力,让chat模式只能chat。^-^

    我觉得那个work模式也是个雷霆模式,既然要耗额度我为什么不直接用Codex在我本地处理呢。而且在我这work模式很慢,首字就很慢,Codex desktop和cli都不会出现,不知道是什么原因。

  • Chinamobile 07-24 01:35
    6

    是的,之前能在web端干的事现在好多干不了了。另外弄那个work模式真的不知道是何用意,我要work的话肯定在本地work了啊,不管是处理数据还是调文件,在web端都没有优势…真的不知道在搞什么飞机。

  • 还想成为88VIP 07-24 01:37
    7

    我感觉web端挺好的啊,感觉chat的sol比codex的聪明,难道是因为我codex开的high,chat开的xhigh吗?

  • Chinamobile 07-24 01:37
    8

    而且chat模式也爱偷懒,上午处理点文章,说完了要求抽一鞭子才走一步

  • AAAAAAAAAAAA 楼主 07-24 01:40
    9

    我觉得web端中的GPT,除了本地任务之外的所有任务都比Codex聪明。只是在吐槽在能力没提升的情况下,变慢太多,很难受。

    而且在很多时候,这些思考都是在做无用功,比如钻牛角尖死命ocr一个pdf又或者思考15分钟版权问题。

  • 还想成为88VIP 07-24 01:41
    10

    无所谓,让他思考,chat是按次的 ^-^

  • 唐泽 07-24 01:48
    11

    我能忍受时长了,起码5。6之后没给我路由到5.3mini了,没更新前是真不能用,5.3mini还不如豆包聪明

  • Naxida 07-24 01:48
    12

    GPT:哈哈,我有一个小沙盒,让我看看它能干什么,对了,我可以把pdf放进小沙盒里面慢慢看,还有这个网页,也放进小沙盒里面,用点Python玩玩,然后再多塞点思维链进去看看能装多少。 ^-^

  • AAAAAAAAAAAA 楼主 07-24 01:50
    13

    真有这种感觉。不过GPT去年就有这个小沙盒了,别的模型都是该用用,不该用不用。就5.6像个拿到了新玩具的小孩一样,天天拿出来显摆。^-^


    唉,不过这样听起来蛮可爱的

  • ElyaOlan 07-24 01:57
    14

    GPT对版权问题的高度敏感性我是相当印象深刻的,尤其是GPT-image-2的画图,几乎不允许在提示词中选择指定作者的画风,无论这是否真的会引发版权问题

    当使用GPT进行写作任务时这个问题更明显了,因为用LLM进行写作任务时指定作者的文风能极大的提升其文笔水平,降低ai味,但GPT的版权敏感导致了你几乎要把省略下来的描述文风的promot全部用来让GPT相信这不会引发版权问题

    也许这也不仅需要openai进一步平衡版权保护和用户方便之间的度量,也需要有一个更明确的,在司法和道德上对用llm模仿画风和文风这一行为有一个明确的说法

* 帖子来源Linux.do
返回