冷知识:Kimi创始人也曾认为开源追不上闭源

LLMeme 2026-07-20 16:19 1

最近在读访谈《对话月之暗面杨植麟:向延绵而未知的雪山前进》(2024年3月),摘录如下:



腾讯新闻:可以用开源的模型吗?(最新消息是Google宣布开源模型Gemma)


杨植麟:开源落后于闭源,这也是个事实。


腾讯新闻:会不会只是暂时落后?


杨植麟:目前看起来不是。


腾讯新闻:为什么开源追不上闭源?


杨植麟:因为开源的开发方式跟以前不一样了,以前是所有人都可以contribute(贡献)到开源,现在开源本身还是中心化的。开源的贡献可能很多都没有经过算力验证。闭源会有人才聚集和资本聚集,最后一定是闭源更好,是一个consolidation(对市场的整合)。


如果我今天有一个领先的模型,开源出来,大概率不合理。反而是落后者可能会这么做,或者开源小模型,搅局嘛,反正不开源也没价值。



顺便一提,一年后还有个访谈也值得一看:《和杨植麟时隔一年的独家对话:“站在无限的开端”》(2025年8月,有视频)。对于开源的议题也作了进一步讨论。

最新回复 (19)
  • fengchris 07-20 16:22
    1

    24年kimi还没开源吧


    国内开源也是ds/qwen带起来的 感恩

  • Kinney Lorraine 07-20 16:26
    3

    ^-^我知道KIMI还是24年年初跑去浙江省考事业单位,在考卷上看见的,不过它真正能干活是V3发布后,算是从V3上学了不少东西

  • 猫南北 07-20 16:27
    4

    其实感觉没问题,你看他最后也说了,落后者才会开源,当时DeepSeek掏出了一个可以打爆大伙的模型并且开源了,那他们不开源确实没得玩了,除非他们继续闭源做到当时GPT的水平。

  • Neko喵头 07-20 16:28
    5

    现在都在猛猛堆算力,自用越来越遥不可及了

  • reboot 07-20 16:32
    6

    我对他们的偏见将会一直持续, 23 24年铺天盖地的广告让我恶心.

  • yricky 07-20 16:34
    7

    好在开源现在是国家级别的政策方向了,只能说感谢国家。kimi先不说,至少阿里我觉得没点政策要求不会主动继续开源的

  • LLMeme 楼主 07-20 16:35
    8

    反了,最早带头开放权重的就是 DeepSeek 、GLM 和 Qwen,Qwen 比 DeepSeek 还积极

  • yricky 07-20 16:37
    9

    但是阿里在25年末开始决策有转向,后续的wan系列视频生成、qwen image系列和qwen3.6后的大型模型都转向闭源了,3.8这次突然开源肯定有外部原因

  • ningyuan 07-20 16:37
    10

    2024年的kimi那会儿的策略还是疯狂投广告,实际几乎不能用,也就是25年初的deepseek r1的开源算是把kimi弄醒了

  • chinajojo 07-20 16:38
    11

    目前开源也是有效的,毕竟旗舰模型就不是个人用户玩得转的,只有企业投资进来才能玩得转,起码算力这碗饭可以吸引很多资本进场建设算力中心,后面闭源了,这些算力中心也可以一个一个买过来

  • 一梦浮生 07-20 16:40
    12

    先给我媳妇安装的就是kimi app,后来deepseek出来就基本不用了,现在是豆包了

  • jcc 07-20 16:44
    13

    这就是为什么,谷歌微软那种巨头搞不定更好的模型


    船大难掉头


    初创公司发现决策错了,很快就能调整


    但是大企业的高层一旦判断失误,掉头就要很久了

  • 冰封飞飞 07-20 16:45
    14

    大模型的开源和之前开源软件不一样。


    1. 大模型是权重开源,其他家不太好复刻你的模式,你的核心竞争力其实还在手里面


    2. 大模型的推理目前很难做到盈利,目前商业模式还是烧钱为主,像是Deepseek这种不开plan,优化推理消耗,API根据成本定价的少。


    3. 闭源和开源的区别,没有开源软件那么大。因为闭源能赚的钱,开源一样赚。只要你有模型强,GLM,KIMI就算限购,涨价,大家还是给你送钱。而且开源也可以上市,融资,只要你实力强,不缺钱。开源软件开源了,就很难赚钱了。他们的核心价值是代码。大模型公司核心价值是公司里面的人才以及研发路线。


    开源一样会有人员和资源聚集,实际上大模型的开源,也是商业行为,不阻碍他的商业发展的,是一种比较良性的。

  • LLMeme 楼主 07-20 16:50
    15

    还有一个原因是原研厂商在性能优化上的护城河比想象中要深厚很多


    过去以为,假如立马开放权重,大家都能部署、打价格战,最后搞研发的企业穷死了


    但 DeepSeek 证明了,价格战根本打不起来,至今没有第三方能在性价比上卷过 DS 本家

  • SugarBreeze 07-20 16:52
    16


    让我们来看同期(24年7月)梁子是怎么说的

  • 花开富贵 07-20 16:52
    17

    说白了难度太大需要的资源太多,普通开发者无力自己开发进行开源,只有商业组织有财力聚集一帮精英去做

  • LLMeme 楼主 07-20 16:56
    18

    梁这边过了两年估计也有变化。原本希望靠文化维持团队,结果还是挡不住挖人,现在也开始融资了。

  • JK 07-20 16:59
    19

    梁应该不差钱啊 旗下的幻方量化天天割散户 这次长鑫更是150多只买入

  • kamikaze 07-20 17:03
    20

    「因为开源的开发方式跟以前不一样了,以前是所有人都可以contribute(贡献)到开源,现在开源本身还是中心化的」


    这模型这东西怎么开源啊,权重什么的都是黑盒,要真想开源就把从预训练开始所有东西包括工具脚本RLHF对齐等等的全部开源,市面上没一个是全开源,Deepseek Gemma Llama Kimi Mistral都不是,导致dolphin这种无审查模型也只是在上面“微调”

* 帖子来源Linux.do
返回