5.5xh现在已经降智到完全没法用了。。

usaki 2026-06-22 15:37 1

pro20x,新加坡节点,正价开的,今天一直犯蠢,最蠢的时候是这个情况:跑完并总结了样本A的数据,然后我让它检查样本B的数据,他闷头跑了20分钟,下一句“这是A,B呢”,我纠正成B,它回答这确实是B,然后又把A的数据上下文丢了,又要我拿A的样本给它再跑一次。。。真给我气笑了^-^

最新回复 (18)
  • sauce63 06-22 15:43
    1

    是这样的,只能等新模型来了,降智起码得有一两周了,这段时间用的我难受死了

  • Suhaoxu 06-22 15:43
    2

    codex今天是废了 跑了50分钟没有解决 claude code + opus4.6 一样的提示词 3分钟就处理完了

  • jovin 06-22 15:44
    3

    所以新模型的体验提升来自于新模型发布前对老模型的降智吗 ^-^

  • mi tu 06-22 15:44
    4

    修个bug卡了一百年,和隔壁composer2.5坐一桌了,glm5.2一轮过,opus4.8一轮过,openai吃大粪去吧

  • 人人有书读 06-22 15:44
    5

    直连也这样嘛?我一直以为是我用的中专参水了呢。看来不是!

  • Jon 06-22 15:45
    6

    是的,今天让它搜一个很简单的消息,搜了好几分钟给我答错了,我阴阳它真是神人这种答案都能答出来,它还说没想到答案这么简单。PS:试了一下ds4 flash都能答对

  • goodot 06-22 15:46
    7

    这两天看论坛好多佬友说claude也降智了,说用GLM-5.2更好,不知道是不是真的

  • 一梦浮生 06-22 15:46
    8

    我说一个简单的控件改来改去改来改去就是搞不好,我tmd用cursor auto 几分钟就好了

  • Axiom 06-22 15:46
    9

    我用codex桌面板,感覺5.5 high對prompt理解能力比3.5f還差一階

  • yeluo001 06-22 15:47
    10

    claude降智没感觉,但偷懒问题很严重,一到复杂的地方就随便糊弄跳过继续后面任务了,我都把计划表拆分的很细了,结果每次关键任务都糊弄,反倒是边边角角和测试这些搞细节搞得飞起

  • sauce63 06-22 15:48
    11

    对的,新模型可能提升没有多大,但是只要我们对老模型降智一段时间然后发布新模型,大家就会感受到质的飞跃

  • fish2018 06-22 15:50
    12

    难怪这几天用得我想吐血,从早改到二半夜

  • EmmaStone63 06-22 16:15
    13

    这几天干活我都懒得打开codex了,回复我明显感觉智商不行,等新模型发了再用吧,免得工作出错

  • 墨殇 06-22 16:17
    14

    佬友的juice值测试了吗?我想了解下在codex中juice值和智商的关系有没有强关联

  • akiaug 06-22 16:18
    15

    群里偷的图

  • usaki 楼主 06-22 16:26
    16



    看着是正常的

  • KK12138 06-22 16:28
    17

    中转站把xhigh禁了。。。再也收不到768了。。。呜呜呜~

  • trader 06-22 16:29
    18

    所以降智是为了发布新模型后让用户感觉提升明显?给新模型铺路的?

* 帖子来源Linux.do
返回