我朋友新开了Claude Pro,但是他的Opus5.5答不对糖果题。但是我的可以答对

江木源 2026-10-02 17:48 1

我的朋友在经过了OpenAI的降智摧残后,费尽心思终于开通了Claude Pro并且活了一天,但是他发现他的Opus 5.5 在high以下的思考等级里是答不对娱乐测试——糖果题,而我的Opus5.5在任何的思考等级下都可以答对糖果题,这是降智了还是被风控了?新开的号都是这样子的吗?


他的号是昨晚开的,我的号是用了一个多月了。




我朋友的号:


Medium(答错)



high(答错)




我自己的号

low(答对)



最新回复 (16)
  • 某Li 10-02 17:49
    1楼

    Claude家这边答糖果题好像就是不太对的

  • Hifumi Mizuhara 10-02 17:49
    2楼

    Claude本来就不可以吧?这是测GPT降智的题目

  • neteroster 10-02 17:49
    3楼

    样本量太小,无法得出有统计意义的结论

  • 江木源 楼主 10-02 17:50
    4楼

    我的opus5.5能答对啊 effort为low都能答对

  • 泼痞 10-02 17:51
    5楼

    opus模型一直就答不对糖果题的,没啥问题,claude只有肥波才稳定能答对

  • yao min 10-02 17:51
    6楼

    一直很好奇,这个老板那么恨中国的有什么好用的。很多人根本就没正经写几个代码,一味以为这个好用?工作上其他几个已经满足99%的开发需求了。实话。

  • 江木源 楼主 10-02 17:52
    7楼

    我的opus5.5能答对 看看帖子内容再评价吧 opus5系列答不对 但是opus5.5系列能答对的 我被灰度到的时候就能答对了

  • mi tu 10-02 17:54
    8楼

    如果你没用过就这么评价也太扣帽子了吧,正经写代码的就不能觉得这好用吗 ^-^。恨中国的老板产品不能用,下一步日产车是不是不能上街了 ^-^

  • Hao 10-02 17:55
    9楼

    用 a/ 的模型又不代表站它的立场。

    但凡国内有一个性能好、性价比高的方案,我站队也未尝不快。


    换句话说,其实我们这叫师夷长技。尤其是用中转站的佬,都是间接给中国的大模型事业做了贡献的,因为中转站收集数据,卖给大模型厂商训练国产模型。这才叫真爱国

  • 泼痞 10-02 18:00
    10楼

    我的也答不对,有什么问题吗?不知道这个有啥好比较的?就你的智商高?

  • dunNaNa 10-02 18:00
    11楼

    可以不同effort多测试几次,然后再对比

  • freeqbar 10-02 18:02
    12楼

    只有opus 4.6可以稳定答对糖果题,之后的版本包括opus 5.5都是答不对糖果题的

  • 江木源 楼主 10-02 18:02
    13楼

    我的是 low medium high都能答对 我朋友的就xhigh能答对 测了几次 我的都稳定回答21 我每次都是新开对话问的

  • 江木源 楼主 10-02 18:06
    14楼

    真的假的 4.6都来了 不过让他不联网告诉我tibo是谁 记忆中的日本首相是谁都能答对

  • 江木源 楼主 10-02 18:12
    15楼

    我只是想确认一下答不出来这是不是被降智了 毕竟当时opus5.5灰度的时候 区分是不是新模型就是问糖果题 或者问tibo是谁。。。。

  • Naxida 10-02 20:53
    16楼

    忍不住今天开了个plus试试,虽然没降至画了个鹈鹕挺精致的,问了两个问题感觉很不好用。现在都明目张胆坑钱了吗,astra回答都比刚出那会差太多了,根本比不上克。还是小克香软,再也不要离开小克了。^-^

* 帖子来源Linux.do
返回