大模型厂商上传用户 .git 不过是孤注一掷垂死挣扎

yidinghe 2026-09-19 21:12 1

大模型厂商为什么要开发自己的 agent ?有两个原因。第一个,他们以为 Claude Code 是 A\ 把用户绑住的主要原因。他们没看到的是 A\ 虽然是 coding agent 的鼻祖,但如今开源 coding agent 已经很成熟,Claude Code 的优势已经非常微弱了。A\ 真正绑住用户的是它长期能坐在头把交椅上的 LLM 水平。


第二个原因就是,二线 LLM 厂商的模型发布如同板块轮动,我家刚发完别家又发。为了减少自家用户去尝试竞争对手的模型,办法就是将用户绑死在自家 agent 上,增加用户迁移成本。怎么做?靠云端索引。大模型厂商打的算盘是,只要我把云端索引做好了,那么用户每次尝试别的 agent 就各种不适,只能乖乖继续用我的 agent 和我的模型。


这个手段如果出现在大模型上下文只有几十 K 的远古时期,大概率是有用的,但如今还想这么做,其实已经过时了。首先是代码索引有必要在云端吗? codegraph 这类项目证明代码索引完全可以本地生成。其次是通过 MCP 和 SubAgent 等工具,代码搜索已经不会占用多少上下文。到目前为止,发生这种事情的只有 xAI 和智谱两家,他们为了快速让自己的 coding agent 占领市场,可谓慌不择路、饥不择食、孤注一掷、不择手段。希望别家大模型厂商汲取它们的教训,莫要偷鸡不成蚀把米,反而让开发者避而远之。

最新回复 (8)
  • chongzi 09-19 21:25
    1
    1 会不会除了 coding ,目前确实没有可观的 AI 应用场景?
    2 是不是让用户在自己的模型上更多的 coding 有助于模型的训练?
    3 你觉得他们的到底是为了偷代码去做模型的训练,还是真如他们所言是去做索引?
  • yidinghe 楼主 09-19 21:29
    2
    @chongzi 问下 AI:如果不管什么代码都拿来做模型训练,会导致什么结果?
  • jacketma 09-19 22:44
    3
    @chongzi #1 coding 是利润率最高、风险系数最低的蓝海业务
    其实医疗 AI 也很赚,就是责任太大了,数据也没 code 这么容易获得
  • king888 09-20 08:55
    4
    别扯那么远,就目的来看收集数据就是为了训练模型用,没数据模型怎么精准预测,怎么进步,每家都在做,只是方式不同而已

    agent 是护城河,就跟 MACOS ,WINDOWS 之争一样,模型当硬件理解就行了,现在的 agent 在我看来就是 MS-DOS ,纯聊天方式交互迟早会给替代,换乔帮主看到现在的 agent 直摇头
  • Danswerme 09-20 08:58
    5
    @jacketma “风险系数最低”这个我也非常认同,没有别的行业可以像编程一样忍受产出结果可能存在巨大问题的..
  • poxiaohy 09-20 09:17
    6
    因为 code 是最早做开源平权的,大部分行业数据怎么获取都是个问题
  • archxm 09-20 13:38
    7
    有提交记录时的那些注释,必然会更精准啊。
  • NizumaEiji 09-20 15:53
    8
    因为有 rl 的时候过拟合的问题,所以一般自家的 llm 在自家的 agent 上的表现最好。
    前有 mimo 和自己的 mimo code
    后有 deepseek v4 pro 和 dsh
* 帖子来源V2EX
返回