GPT真的比deepseek聪明吗?

nabi233 2026-09-10 17:37 1

在我这儿大模型第一个开始能解决实际工作上的问题是gemini3,然后后面的模型一个比一个聪明好用,然后从deepseekv4 flash开始习惯性使用了,安装接入了opencalw,然后最近能蹭公司买的gpt订阅,就开了个gpt5.5给自己用,发现把模型改到gpt5.5以后同样的工作,例如编译一个Linux,deepseek完成一次成功编译后就没有再出现过编译失败或者编译成功后无法启动的问题,gpt却一直反复的出现编译失败或者无法启动,那么高的价格却连一个低价ai都不如?还是说ai跑分榜已经沦落到鲁大师娱乐榜的地步了吗?

还有qwan3.8,试了试网页版的,感觉回答也是蠢到不行,但是网上一片叫好得嘛

最新回复 (27)
  • amang 09-10 17:38
    1

    没有,真论智商还是要看大豆包

  • czy 09-10 17:39
    2

    还有美国豆包

  • seenline 09-10 17:40
    3

    现在跑分是有点鲁大师娱乐榜,但是我们衡量的是ai的整体能力,如果老是用自己在单一任务上(甚至是一个很具体的场景上比如某个项目的某段代码、某个bug)去评价,就会落入“身边统计学”。所以你觉得gpt不如deepseek,那你就把你所有觉得不如比不上的全部整理出来,然后整合成一个benchmark,如果你做不到那就是单一的使用场景不能说明“谁更智能”

  • 缓慢前进 09-10 17:43
    4

    GPT5.5?

    我没看错吧,luna这种模型我只用来当豆包使唤。但凡要开发sol medium起步,上到astra high。

    而且,luna的价格相当便宜,比ds便宜快一个量级了…….

    你要用GPT luna,那就不贵。

  • 卡拉彼丘 09-10 17:43
    5

    还得是美国大豆包,昨晚问它两条geosite规则,直接无中生有造了两条给我 ^-^

  • dtfour09 09-10 17:46
    6

    一分价钱一分货啊。

  • nabi233 楼主 09-10 17:48
    7

    @seenline #3 作为用户干嘛要去做这个事儿,付钱看结果不就行了。

  • alittleshine 09-10 17:49
    8

    试试Astra,旧模型不如狗

  • nabi233 楼主 09-10 17:49
    9

    @缓慢前进 #4 坛友经济实力还是太超标了

  • 缓慢前进 09-10 17:50
    10

    @nabi233 #7 我连你说的话都不信了,蹭了公司的订阅专门找最底下的5.5。

    我觉得世界上应该没人能干出这种事情来

  • nabi233 楼主 09-10 17:51
    11

    @alittleshine #8 不敢用,5.5轻度使用测试下来key价格就已经到300刀左右了,Astra怕是跑几下就没额度了

  • nabi233 楼主 09-10 17:53
    12

    @缓慢前进 #10 毕竟使用主力不是我,我就是个小透明,能让蹭蹭就不错了

  • Approval8043 09-10 17:54
    13

    再串打死

  • seenline 09-10 17:54
    14

    @nabi233 #7 对啊,人家给了你结果啊,你自己又不认可,一说就是“那么高的价格却连一个低价ai都不如”

  • yue11221 09-10 17:55
    15

    5.5已经是半年之前的老模型了啊,再加上oai的算力分配。而且oai的api key比订阅贵4倍这都是常识啊,有几个自用用户能用得起api。兄弟你要这么比 我还能用豆包付费版跟gpt3比呢问问豆包聪明还是gpt聪明

  • nabi233 楼主 09-10 17:57
    16

    @yue11221 #15 啊?他俩不是同一时间发布的吗?

  • 我也要打十个 09-10 17:57
    17

    deep seek的数据滞后很多

  • 冠希陈 09-10 17:59
    18

    国模目前都很一般

  • nabi233 楼主 09-10 18:00
    19

    @seenline #14 你在说什么,给了啥结果?

  • seenline 09-10 18:02
    20

    @nabi233 #19 你在说什么?“还是说ai跑分榜已经沦落到鲁大师娱乐榜的地步了吗“ ai跑分榜不就是你要的结果么,人家测出来gpt比deepseek好啊,你这个标题到底想表达什么

  • 缓慢前进 09-10 18:03
    21

    @nabi233 #12

    这么给你说吧,最基础的team和plus订阅只要不用sol和astra,GPT-5.6 Luna都几乎快无限制用了。

    而这种模型一般都是拿来当豆包使唤的,太垃圾了。

    20X上astra可能烧的相当快,但sol开medium加上重置卡可以蹬不少时间。

    我从来没见过有人用20x订阅选5.5模型的。

  • 1952444901 09-10 18:06
    22

    5.5,何意味,串子?

  • 金秋天jj 09-10 18:08
    23

    我用起来比deepseek好,具体科研类的没试过

  • nabi233 楼主 09-10 18:16
    24

    @seenline #20 哦,在表达为什么同一时间的模型在参数和价格差距这么多的情况下,为啥体验却是相反的。

  • nabi233 楼主 09-10 18:19
    25

    @缓慢前进 #21 你这么说我就懂了,毕竟是蹭的嘛,又不是主力人员,只是看这俩模型都是一样的时间发布的

  • Maose 09-10 18:19
    26

    再串打死

  • Tans 09-10 19:25
    27

    @nabi233 #0

* 帖子来源NodeSeek
返回