Claude Opus 5测评:集大成的模型

HCPTangHY 2026-07-25 12:41 1

先放野榜


Opus5简直是一年以来A畜模型的集大成者(褒贬兼具),兼有比肩fable的编程能力,也有比fable更逆天的安全甲,比sonnet 5更雷霆的大思考。



放几个示例









几乎都很完美。


但是缺点上面也说了,雷霆大思考异常严重,经常大思考到吃满最大输出



不是哥们128K都不够你用了那没办法了


而同样的,赛博甲依旧逆天



真遇到了一个字都吐不出来


同时,4.7、4.8、fable5都存在的在代码中写错别字的情况不再出现。claude系列一直有输出后回看自己的习惯,再4.7-fable中他都用来修改错别字了,而opus 5是直接开始优化代码了

最新回复 (15)
  • 利陆都2253 07-25 12:45
    1

    GLM 5.2 差距 Opus 5 这么多?


    Opus 5 这跑分吊着 Sol 打,A 社有点逆天了,这公司一方面这么反中国,一方面模型能力逆天…

  • 巧克力雷轰 07-25 12:47
    2

    opus 5也开始雷霆大思考是真的,确实也好使


    看意思现在范式又转移了

  • 今天没睡醒 07-25 12:52
    3

    野榜上的model y不会是grok4.5吧

  • 欣欣|林可欣 07-25 12:53
    4

    野榜




    懂了,5.6拉完了 ^-^

  • eroneko 07-25 12:53
    5

    Model Y是老马家的特斯拉吗

  • RyanVan 07-25 12:55
    6

    opus 5废话是真的多


    每次输出内容堪比技术报告


    比fable多3/4倍

  • zachery1 07-25 12:59
    7

    哈哈哈哈哈哈我也发现了,Model Y这是什么鬼,玩梗吗

  • 酷睿哥 07-25 13:01
    8

    模型思考内容多,是不是更有利于蒸馏?

  • Kyoma 07-25 13:01
    9

    opus5除了比较敏感其他都还可以

  • Harryzl 07-25 13:01
    10

    5.6的xhigh还没5.5的xhigh高 ^-^

  • yi124773651 07-25 13:02
    11

    继COT、ReAct后的范式应该就是所谓的交错思考吧,这也是导致思考时间越来越长的原因吧。

  • DRAGON 07-25 13:39
    12

    应该是,我也看到了 哈哈哈,笑死

  • Draw 07-25 13:45
    13

    实话,没有惊艳感……

    就冲他上线前没有大量宣发,就可以判断它和肥波是有差距的

    只能说,现在这个情况下没变成路边一条就是赢了吧,因为正常没宣发的模型基本都是……路边一条

  • yjlsx 07-25 13:46
    14

    耐压壳体那个怎么生成的,我想让它搞一个海底世界 ^-^

  • lea 07-25 13:48
    15

    我就想知道model y 是什么? 课代表呢?去小树林了吗?

* 帖子来源Linux.do
返回