Claude Fable 5.1测评:新的核弹

HCPTangHY 2026-09-02 09:25 1



放几个案例,其实都没有差的,挑几个最好的








(小细节,远处的地球即便lod了依然是正确的六边形)




缺点非常明显,接近四十分钟的雷霆思考



还有就是太贵,和依旧很高的赛博安全甲

不过这不是模型的缺点,是A畜的缺点 ^-^


期待国模快点发动蒸功夫

最新回复 (19)
  • Florian 09-02 09:26
    1

    为什么不和 5.6 pro 比,5.6 pro 比 5.5 pro 好一大截吧 ^-^


    肯定不是因为比不过吧

  • neteroster 09-02 09:26
    2

    这回可能有点难蒸了(,思维链加了重放保护,不过最后的output还是可以的

  • 七玉 09-02 09:29
    3

    model y是哪个公司的神秘模型?

  • wublub 09-02 09:41
    4

    5.5 pro那么高分

  • 余君 09-02 09:42
    5

    蒸不了吧,A\发布时特意强调了fable 5.1的反蒸馏策略

  • ikb 09-02 09:47
    6

    也许是因为5.6pro已经不是一个单独的模型了。

  • Handsome Z 09-02 09:51
    7

    这啥榜单,怎么glm 5.3能比5.2还差的? ^-^

  • jerry wu 09-02 09:59
    8

    蒸馏不就是拿真实的使用输出去训练吗,不存在反蒸馏的,只要你模型还能被调用

  • Ghost32 09-02 10:14
    9

    人家蒸馏不仅仅是最终输出,还有思维链,这里主要是思维链可能处理了,蒸馏大部分学习的也是思维链,最终输出那才一点点而已

  • 贱圣Z 09-02 10:14
    10

    感觉每隔一段时间都能有核弹爆炸,震惊瘫坐的新模型 ^-^

  • 七玉 09-02 10:22
    11

    刚又看了一眼,为什么glm5.3比5.2差了这么多?还是说写反了?

  • jerry wu 09-02 10:31
    12

    a畜的思维链不一直都是隐藏的吗,不是现在才隐藏的吧

  • Ghost32 09-02 10:33
    13

    它优化的就是这里啊,避免可以通过提示词来获取到思维链。

  • jerry wu 09-02 10:35
    14

    他在前几个版本就做了防蒸思维链的措施,但蒸馏不止靠蒸cot,没cot用大量输出也是可以蒸的,无非是多花点钱效率低些

  • 西小罗 09-02 10:37
    15

    这个榜单连kimi k3都没有啊,那么水么?

  • neteroster 09-02 10:37
    16

    你说的防止蒸馏思维链是指仅输出思考摘要,加密思考内容。


    然而前段时间有一种新的获取思考内容的方法,也就是重放加密思考,具体参见: [2608.09867] Stealing Reasoning Traces from Proprietary LLM APIs


    这次是针对这个做了防御

  • jerry wu 09-02 10:39
    17

    有防肯定有攻,退一万步讲,他的思维链防御达到无敌状态(实际也不可能),也防止不了蒸馏,因为蒸馏输出是一定蒸得到,除非你这模型锁起来不卖

  • everyday_happy 09-02 10:39
    18

    核弹天天炸,就问你怕不怕

  • firespoon 09-02 10:39
    19

    主要蒸的应该是思维链吧,这个对思考能力帮助还挺大的……

* 帖子来源Linux.do
返回