从一篇论文了里面看到的猜测: K3可能受到闭源模型思维链影响

saomalu 2026-08-12 15:06 1

最近看了一篇关于大模型加密思维链漏洞的论文 arxiv 2608.09867


附录里关于 Kimi K3 的测试结果挺有意思


让ai总结了下, 大概就是论文暗示 Kimi K3 的训练数据里很可能混入了大量闭源大模型的真实思维链数据,导致它像个“高仿号”




研究人员发现一个技术漏洞:各大模型加密的私密思考过程(思维链)可以被破解,并“移植”给其他模型。


他们在实验中给 Kimi K3 塞入了一小段 Claude 或 GPT 的私密思维链。结果发现,Kimi K3 不仅思路跟着变,甚至连最终回答的话术风格、推理论证的篇幅长度,都变得和 Claude 或 GPT 极为相似。


在统计学测试中,Kimi K3 极大概率能“预判”出 GPT 的答案。

最新回复 (7)
  • Angel 08-12 15:26
    1

    Kimi K3 的训练数据里很可能混入了大量闭源大模型的真实思维链数据




    各大模型加密的私密思考过程(思维链)可以被破解,并“移植”给其他模型。



    按照这个AI的分析来看 这不明摆了想说Kimi K3做了蒸馏 偷了Claude和GPT数据吗?





    Kimi K3 塞入了一小段 Claude 或 GPT 的私密思维链。结果发现,Kimi K3 不仅思路跟着变,甚至连最终回答的话术风格、推理论证的篇幅长度,都变得和 Claude 或 GPT 极为相似。



    这个不用管 因为别人的思维链确实会影响本模型的回复^-^^-^^-^^-^

  • meteora626 08-12 15:35
    2

    少带点政治倾向看论文吧,挺好的一篇安全论文,在你眼里只看到了k3蒸馏人家数据。^-^

  • xunxun 08-12 15:43
    3

    这结论也可以理解为 claude gpt kimi很可能起源于同一个开源模型 ^-^

  • pontevecchio 08-12 15:44
    4

    粗看了一下B4,不仅是模型回复,而且连思维过程的风格都变了,相当于拿sol和opus的思维链的开头给它们分别续写,k3,5.2这些AUC都算高的,但是inkling和d3.1区分度就很高。而且思维链长度也受影响,“不仅模仿的措辞,还模仿了Opus的思考预算”,且每题的长短分布与opus高度相关(AUC0.86)。而且预填充里根本没有关于长度的信息

  • neroZac 08-12 15:47
    5

    有意思, 还有https://stolen-thoughts.com/这样的展示论文的方式, 学习一波

  • jcc 08-12 15:50
    6

    思维链注入,本来就会影响结果


    这个并不会说明谁偷了谁


    也就是论文作者阴阳一下,再加上自媒体瞎解读,想搞个大新闻

  • Lisp 08-12 15:51
    7

    https://stolen-thoughts.com/



    你还真别说 你这一说我就要点进去看看


    其实也没什么奇怪的,搞得花里胡哨的,然后把文本框搞得歪七八扭的,

    然后有一点点小交互


    不过我更感兴趣的是这是哪个AI的作品

* 帖子来源Linux.do
返回