闹剧尘埃落定,合理讨论 [灰度测试]的 Deepseek到底是什么模型?

风 云雨 2026-08-14 10:12 1

DeepSeek API 灰测争议:Deepseek 的内部 Kingfall vs. Anthropic Fable 5 路由


背景


目前网络上有两种主要观点,围绕 DeepSeek 近期官方 API 的“灰测”与“路由”争议展开:



  • 观点一:灰测模型为 DeepSeek 内部模型 KINGFALL,由于过于强大或可能危害社会等原因,不能公开发布,只能作为内部模型使用。

  • 观点二:灰测时,V4 Pro 模型被路由到了 Anthropic 的 Fable 5 模型。


观点一:内部模型 KINGFALL


支持者理由如下:



  • DeepSeek 不可能将流量路由到 Fable 5,因为成本过于昂贵,不可能长期做公益。

  • DeepSeek 没有必要收集外部数据,因为 DeepSeek 从来不做蒸馏。

  • 灰度版本带有思维链,且思维链以 “I’m” 开头。

  • 灰度模型没有视觉能力,无法读图。


观点二:路由至 Anthropic Fable 5


支持者提供的证据链主要来自“类脑”上的帖子,可在类脑上搜索以下关键词:



关于DeepSeek近期官方API“灰测”、“路由”等争议内容的信息收集与整理



且在opencode是直接走的 Deepseek 官方API(而非opencode go/zen)


类脑有个总结贴,如果你有类脑权限可以去搜关于DeepSeek近期官方API“灰测”、“路由”等争议内容的信息收集与整理
比较明显的几个:

脏token测试全过
生物甲
猜数字概率测试匹配opus 4.8/fable
摘要性思维链
有人通过提示词让模型暴出了claude code的工作环境信息(操作系统、当前路径等),这种只有在通过类似cpa这种反代的情况下才会出现的特征


补充争议:思维链起手式


笔者想说的是:Anthropic 系列的模型也都是 “I’m” 起手,且是 summary cot。


对比截图


Opus 4.8 模型的思维链:




Deepseek 灰度模型的思维链:



备注


以上为网络争议的两种观点及各自理由整理,不代表事实确认。

最新回复 (14)
  • 风 云雨 楼主 08-14 10:19
    1



    遗憾的是 0813 版本的 V4 Pro,不知道 Kingfall 这个模型


    但是 灰测版本知道

  • doro 08-14 10:22
    2

    fable的思维链只展示精简版吧,怎么解释这个

  • 风 云雨 楼主 08-14 10:25
    3



    这个灰度版的思维链怎么看也不像原始思维链

  • 风 云雨 楼主 08-14 10:26
    4

    Stealing Reasoning Traces from Proprietary LLM APIs


    具体的 压缩思维链和解码思维链,你可以 看这篇论文,里面列举了很多

  • event 08-14 11:12
    5

    V4pro的视觉很粗躁,我是看不到审美层次的。颜色的过渡、渐变、阴影层次、透明的使用、对于内容边界的掌握、空间感触和灰测模型完全不是一个层次,不是神区二象性能解释的,即使有相对神的部分也不能和当时惊为天人的视觉呈现相比。




    支持者的一二条几乎不具有论证价值,不能对商业公司进行这种主观唯心判断的

    思维链里说它自己没有视觉能力比较能说明不太像fable

    至少模型的输入输出上不是,思维链还不知道


    相当倾向于是在合规合法的条件下对比参考模仿fable的思维链自主审查进化,但不使用fable模型输出,并仿照cursor用harness吸收更优的数据再进化。所以本阶段对算力的需求极大?

  • stardustdragona 08-14 11:15
    6

    我还是觉得路由到feble也太阴谋论了,尤其是检测到复杂问题路由到feble的

  • 比奇堡 08-14 11:16
    7


    • DeepSeek 不可能将流量路由到 Fable 5,因为成本过于昂贵,不可能长期做公益。



    那anyrouter呢?用的我爽死了

  • 树海 08-14 11:19
    8

    也不是阴谋论吧,从收集数据的角度来说也可以理解,开中转站和路由也差不多

  • TeainfrostOUO 08-14 11:21
    9

    现在看来很像是观点2,但是又没有决定性的证据,无限像fable但又不是。如果真是kingfall,为什么藏着不发呢?

  • supanono 08-14 11:36
    10

    观点一罗列的有点像串子了


    我不支持 DS 主动路由 Fable5,但我是处于风险成本考量的


    目前我们可以达成共识的:



    1. 有专业做蒸馏数据的公司,Any 就有很多人合理怀疑是出于这个目的才做慈善的

    2. 国内对第三方海外 AIGC 服务的态度是抓到就处理

    3. 国内对于用户数据出海有比较严厉的审核


    请问,DS 有什么理由自己做这件事?


    可能有人说,从别人那里拿数据:



    1. 有痕迹,会被别人知道,传出去不好听

    2. 不是一手的我不喜欢


    那我问你:



    1. 直接路由很好解释吗?现在的情况不是最好的证明?

    2. 想要一手的搞个灰手套再开一个 Any 很难吗?

  • 白学森 08-14 11:38
    11

    any路由器的用户量和ds api不是一个量级的,不能放一起

    况且正常有脑子的都不可能把一个生产级api做很大的变动吧

  • 后皇嘉树 08-14 11:57
    12

    没有人发现这个华点吗?


    Opus 的原始 cot 用的是 let me,但是总结 cot 用的是 I am


    DS 该不会真 xxx 了 xxx 吧

  • 炸酱面 08-14 11:58
    13

    这里有一些别的论据


    [观点 1] 按照 A/ 的性质,如果有路由的话 A/ 一定会说,但它没说,只说了蒸馏

    [观点 1] 没有网安甲

    [观点 1] 他们完全没有理由这么做(收集用户数据论的一个疑点是这些用户的数据质量并不高,而且很明显可以让 DS 内部的员工来自己想东西来蒸(毕竟走的是 DS 的 API))


    [观点 3] 从未有灰测论

    这个不太行,因为根据 YunhaoFu/dsv4ga-news-gather 来看,人数太多,范围太广(包括了 ln 和 ln),以及 共享对话链接 的存在都证明了至少 DS 有过灰测(大概)


    最后我希望 l 站可以增加一个帖子被下了之后留档的功能,至少也算是 200 多人的数据啊(


    (叠个甲:以上观点很有可能具有问题,若您对此感到有所疑问,请指出,我对此感到抱歉,因为我具有语言表达能力上的不足)

  • airline233 08-14 11:58
    14

    但是把官api灰度新模型也算是较大变动了

* 帖子来源Linux.do
返回