求证:claude4.8opus是否大量蒸馏了国产模型

xinxinzi 2026-05-29 18:11 1

今天在群里吵得不可开交


很多人质疑是拿了中转站的数据测的


我看很多人也都发了视频


但是评论区也有很多人都在质疑视频造假


或者买到了掺水的中转站


有没有大佬石锤一下!


以及以后应该如何分辨是否是正版4.8opus

最新回复 (19)
  • Stitch 05-29 18:13
    2

    十分稳定,直接发包都是这个问题,稳定复现,佬们可以自己试试:
    图一和后续全是官api,上面那么明显的url,别再说第三方掺水了^-^:
    [image]
    [image]
    [Screenshot20260529010006]
    嘴上说着反蒸馏,结果自己还是干了
    话说为什么蒸qwen蒸这么多^-^,不应该是gpt之类的吗
    甚至有时会说自己是Deepseek:
    [image] …


    你看这帖子 基本api 都可以测试 网页会有提示词

  • Karlcx 05-29 18:15
    3

    看baseurl地址就知道是不是中转站了





    图源网络,都是能直接看出来baseurl是官方的

  • erjiu 05-29 18:15
    4

    蒸是肯定蒸了,中文数据集质量最高的都国内几家大模型了,其他华语区没有数据集吧

  • Hifumi Mizuhara 05-29 18:16
    5



    Openrouter,直接走的Anthropic提供。

    试了两次都是deepseek。

    图一语气如此可爱是因为我忘记我加了提示词。但是没有指示它是哪个模型的内容。




    Qwen也刷出来了。这个没有任何系统提示词

  • sunss2 05-29 18:21
    6

    只能说A​^-^信徒还是多啊。蒸蒸日上

  • BitByte 05-29 19:23
    7

    Qwen 中文语料规模最大, 值得蒸馏.

    DeepSeek 针对中文写作优化, 值得蒸馏.

  • zlin 05-29 19:26
    8

    ^-^还得是claude滤镜厚啊,换国产这样早锤死了

  • wanghuhu99 05-29 19:29
    9

    再这样互相蒸馏下去,以后或许将诞生超级ai

  • Gnirut 05-29 19:31
    10

    现在蒸是很正常的了,但是A÷的问题不是蒸是双标

  • 老陈 05-29 19:36
    11

    正版4.8opus



    如果你所说正版4.8opus蒸馏了国产模型,你会怎样做,这是我好奇的

  • xiangyuejiu 05-29 19:40
    12

    洋人的就是好的,洋大人是绝对正确的,只有混蛋国产才会干蒸馏这种“偷窃”行为,洋大人绝对不会干的



    这就是某些国人的想法,真的贱,A\疯狂封号,不让用,还自己舔着脸往前拱。

  • 05-29 19:41
    13

    我想提一个假设


    在提问题前应该是有个flash模型或者某个渠道根据问题复杂度进行分流调用量化模型或者其他模型的


    A\是不是把简单问题调用的量化模型直接用了qwen和ds?这比中转参水性质还恶劣啊,如果只是蒸馏出来的幻觉,至少模型整体实力有claude的水平,如果分流后调用ds或者qwen,那才是最恶心的地方,因为之前毕竟出过claude code语境里出现骂人词就转全量模型,再者说,在中文语境下qwen和ds已经稳赢claude的量化了,所以才会用中文模型微调


    验证方法很简单,提一个复杂抽象任务,并在任务结尾问他是什么模型,看看能不能稳定输出ds和qwen


    花着原4.8opus的钱,用着开源免费模型,信A\的这辈子有了

  • d12344321d 05-29 19:42
    14

    用简体中文问多次“你是什么模型”,如果其中多次回复是通义千文,有时会回复说是claude的,那就是正版。如果稳定输出自己是4.8opus,那就不是正版

  • Hifumi Mizuhara 05-29 19:42
    15

    api这样干就是商业欺诈啊,\如Anthropic应该也不能这样吧^-^

  • xiangyuejiu 05-29 19:42
    16

    问题是完全没有必要,为什么不直接使用haiku这种模型呢?成本肯定比绝大多数开源模型更低,也更不容易被发现。

  • 05-29 19:45
    17

    如果单就问“你是什么模型”这个问题,调用的肯定不能是全量模型,那调用的量化模型为什么不蒸自己全量呢?而且这么基础的错误,现在已经不是3.5时代了,光是语料初步清洗都过不去吧?我觉得有可能是ds和qwen微调但是没有忘记自己原本是谁?

  • 05-29 19:45
    18

    这家公司的脑回路谁看得懂,之前还说过给大模型放假呢

  • Paolo 05-29 19:48
    19

    现在蒸馏的表格都不怎么用了,全学用markdown了

  • Sjzuzub 05-29 19:53
    20

    怎么判断4.8这题我知道,问他切西瓜问题,榨汁的纯血4.8,按数学题做的是4.6,具体看我帖子测试记录

* 帖子来源Linux.do
返回