opus5.5还是不靠谱相对于gpt6来说

jik 2026-09-24 09:47 1

如果一个企业级项目,在一边过的情况下两边都是最好的模型 使用opus还是存在一些明显的bug,没有使用gpt省心,虽然gpt的代码架构可能没有opus好,但是细微的bug发现的还是比opus要细致,这样对比来,gpt的模型还是胜于opus一大截,opus虽然没有幻觉但是发现不了细节,如果是开发小玩具小工具,opus可能会优于gpt,但如果是线上企业级项目总体来说opus意识不到的bug还是比gpt多,没有gpt严谨省心,但是架构可能比gpt稍微好一点,所以佬们的体验下来怎么样 突然想到我们使用模型就是为了更好的解决问题,如果opus出错的概率大,拿他和国内的模型又有什么区别

最新回复 (19)
  • 低手低手低低手 09-24 09:49
    1

    我们的6sol和6astra貌似都被路由到5.6luna了,很难受

  • loujohn 09-24 09:50
    2

    怎么我的gpt6还是总是不能一次性做好

  • Hao 09-24 09:51
    3

    应该是被风控降智了,这种情况下是被路由给 5.6-luna 模型

    随便跑一下智力测试或者模型验证就知道了

  • 合本丶 09-24 09:51
    4

    前提是gpt不降智,再是价格和性能问题

    现在用gpt,没法保证过程中会不会突然降智,然后在项目内到处拉史 ^-^

  • Galaxy_Ron 09-24 09:52
    5

    我之前用两家模型也有类似的体会:


    opus/fable 适合快速搭建项目整体框架,但是会出现遗漏和错误


    GPT 适合对 opus 的代码进行检查,强大的兜底机制和防御机制,总能发现一些问题。但是有时候会存在过度防御的问题,给出的建议未必完全可以采纳


    两家互搏似乎是个不错的选择。新的 opus 5.5 和 GPT-6 Sol 还在尝试中

  • 金陵雪 09-24 09:52
    6

    Astra智能肯定大于opus的,但是opus便宜啊,能力也差距不大

  • 09-24 09:54
    7

    所以一些人一出 Opus5.5 就说 Astra 没用,不再是 SOTA 模型的表述就很令人费解。


    用 Astra 做一个功能服务,我上线后是很少遇到 BUG的。

  • Yunfei Chen 09-24 09:56
    8

    现在的大模型架构,就没有真正靠谱的..这是底层架构问题,知道了就好.

  • jik 楼主 09-24 10:04
    9

    确实 感觉opus模型底座和gpt的可能不一样 这两个模型底座可能一个是跟据数学逻辑实际的思维链来获取,opus似乎有点猜的意思,opus可能像个人不懂得地方查找资料,再跟据自己得理解总结给你 但是模型再自己总结的时候可能会像人一样错误,gpt似乎更看重实际存在的东西,生成答案

  • jik 楼主 09-24 10:07
    10

    是的,但是opus不省心这样对比来看opus就和国内这些模型的差别不是很大,因为出错概率大

  • 巧克力雷轰 09-24 10:10
    11

    细微的bug发现



    但是没有系统是没有BUG的,且GPT太容易进入边界问题的牛角尖,然后发起漫长的对抗性测试

  • 纸飞机 09-24 10:13
    12



    可是这样用起来太贵啦,今年以来,ai能力大幅增长,费用也一直在涨。

  • cainiao3hao 09-24 10:28
    13

    从零开始搭项目,还要企业级,你这是把个人项目的经验搬了企业项目吧,牛马不会有这种情况的,都是擦那些老登拉出来的屎 ^-^


    我们这边的统计情况是claude家的几个模型用量都是astra的数倍,opus5都压astra一头,也可能是太贵了,fable的用量也不高 ^-^


    都是商业项目,找bug居多,gpt家这两代风格太慢了,每一处都要完整对下来,商业超大项目astra它又hold不住,经常半天进度为0,而claude家太敢猜了,大多数时候跟着claude的猜想做做实验,猜个几天一周的,一般都能解决,一直猜不出的反正直接反手上报 ^-^

  • jik 楼主 09-24 10:31
    14

    不是 是公司的表单项目,很大的一个前端项目,20x的gpt体验下来比opus靠谱,opus写的代码无法审核出来bug,但是gpt可以审核出来bug,并且可以复现出来

  • freeqbar 09-24 10:36
    15

    个人感觉opus强的是它的执行力,全局规划和逻辑判断能力还是落后astra一截

  • zhwyt 09-24 10:42
    16

    不管是人还是大模型,还是要有理解。

  • cainiao3hao 09-24 10:42
    17

    那就不清楚了,我这边一般是修bug比较多,基本没什么余裕找bug,写完的code直接上去跑下测试就算它过了不管了,而且太大了跟别的模块一堆联动,还拿不到源码只有dll,连给个symbol都要走一堆流程,许多hard code,让ai找也不现实


    整个链路又臭又长,光修报上来的bug都一头包了,鬼知道怎么影响到的,ai找不出的,astra跟fable都不好使,只能靠猜,猜不出来就上报甩锅说是别的team的问题 ^-^

  • lihua 09-24 10:52
    18

    astra肯定还是更强的,不过太贵了,相比之下opus5.5性价比就无敌了

  • 云兮 09-24 10:54
    19

    虽然没有幻觉但是发现不了细节,如果是开发小玩具小工具,opus可能会优于gpt,但如果是线上企业级项目总体来说opus意识不到的bug还是比gpt多,没有gpt严谨省心,但是架构可能比gpt稍微好一点,所以佬们的体验下来怎么样 突然想到我们使用模型就是为了更好的解决问题,如果opus出错的概率大,拿他和国内



    astra关键太贵了 不够用啊!!!

* 帖子来源Linux.do
返回