Claude Opus 5.5测评:牙膏挤爆了

HCPTangHY 2026-09-23 10:43 1

先放野榜



与Astra同分第一。btw对前沿模型我这个榜基本就只有磨细节了,硬的代码能力看不太出了。


放点案例

第一格设计了基地车展开的模型









都快找不到扣分点了。


作为对抗astra的决战兵器,5.5也确实正如A畜所说拥有比肩fable的能力。真的挤爆牙膏啊,A畜开窍了()


其他方面,这一代的分词器效率似乎又下降了,但是语料和claudish方面似乎有所改善,至少文字没有opus 5那么雷霆了,op5的一些小毛病也好转了很多。


赛博甲似乎和fable 5.1对齐稍微不那么敏感了,但是对应的rp的黄甲似乎进一步提高了。


这会是一个不错的模型,但在AGI程度上可能没有Astra那么惊艳。




虽然5.5降价了,Astra的价格是你的两倍,但你的输出token比Astra多4倍啊,综合下来似乎还是Astra会更划算一些,但如果你看重任务间和模型的对话质量,还是opus 5.5更合适。

最新回复 (4)
  • 平不杠 09-23 10:46
    1

    支持大佬,我一直觉得y榜才是最权威的榜单

  • JoygenZhang 09-23 11:05
    2

    什么是Y榜,网址有吗?

  • 363653919 09-23 11:14
    3

    这Y榜,好像模型好多没在里面,

  • wei ts 09-23 11:21
    4

    Comparison of AI Models across Intelligence, Performance, and Price | Artificial Analysis 内的Output Tokens per Task吧

* 帖子来源Linux.do
返回