请deepseek团队速速阅读GLM5.2源码,速速发布deepseekv4.2

leo 2026-06-17 09:36 1

然后知谱速速阅读deepseek v4.1源码,发布GLM5.3

最新回复 (17)
  • Rao 06-17 09:36
    1

    要不要这么搞笑,真的逗,笑死我了

  • OptionalFullName 06-17 09:36
    2

    GLM 用的还是 DeepSeek 的上一代架构,读啥。GlmMoeDsaForCausalLM 基本是 DeepSeek V3.2 的底子

  • HeriX 06-17 09:37
    3

    是开放权重并不是开放源代码, 不然技术全被偷学了

  • flykiss 06-17 09:39
    4

    应该是“请deepseek团队速速 deepcopy GLM5.2权重,速速发布deepseek v4.2” ^-^

  • leo 楼主 06-17 09:42
    5

    我不懂这方面,不开放源码就只有权重,那第三方怎么部署它呢?

  • sparklydream 06-17 09:43
    6

    智谱的 infra 真能把 deepseek v4 这个架构训好吗……

  • Cimix 06-17 09:49
    7

    架构不一样,而且两个公司的方向不一样,智谱用的很多东西还来源于deepseek呢

  • 兰羽 06-17 09:53
    8

    ^-^DeepSeek 的 V4可训练的程度比目前 GLM5.2还高,GLM5.2 的基模还是 V3.2的程度。另外开放权重不代表开放源码,类似于发布了可部署的二进制文件,但是源码没有开放

  • advent 06-17 09:53
    9

    类比一下就是:

    模型开源是开放权重,等于说软件给你个安装包可以你自己部署跑起来

    但是模型训练(软件源代码)你是没有的

  • Serendipity 06-17 09:54
    10

    部署的就是模型的权重,佬儿,目前比较主流的推理框架是sglang,vllm等等

  • AFDI.Burning 06-17 09:59
    11

    左脚踩右脚 原地升天是吧

    不过就像楼上几位说的 架构不一样 不能照搬

  • musistudio 06-17 10:00
    12

    大模型开源只是开放权重不是开放代码

  • leo 楼主 06-17 10:02
    13

    懂了,我以为权重是模型的参数,要模型源码和权重同时跑呢。 ^-^

  • ciarany 06-17 10:04
    14

    事实上权重就是模型的参数,所谓的跑模型来使用模型是推理代码不是训练代码

  • gadfly3173 06-17 10:04
    15

    阅读权重吗?那阅读能力堪比GPU了

  • wpy 06-17 10:14
    16

    失传的武林绝学,左脚踩右脚上天是吧?

  • 浮世万千123 06-17 10:16
    17



* 帖子来源Linux.do
返回