梁圣为我们打开了自部署高性能模型的门

阿钖 2026-07-31 14:35 1

原本看着流口水的 minimax m3 和超英赶美的 kimi k3,我还以为小尺寸模型就这样了,只能当个小助理使使。没想到我大梁直接掏出雷霆 v4flash,别说 Gemini flash 了,glm5.2 也一样给你碾过去了。

也就是说个人用户在消费级显卡上部署可用的模型还是存在相当的可能性的!太棒了!

最新回复 (19)
  • yangyk 07-31 14:39
    1

    最近是有什么新版本发布了吗?这个V4flash不是早就发布了吗

  • 阿钖 楼主 07-31 14:43
    2

    发正式版啦!原来的预览版只能说还能用,正式版 flash 直接打穿 Z^-^

  • fishbun 07-31 14:43
    3

    之前是预览版,今天发了 flash 的正式版

  • Autsun 07-31 14:44
    4

    经过后训练的正式版v4f,ds说是比现在预览版的pro要强

  • Mevol 07-31 14:45
    5

    之前都是预览版,今天的是正式版本

  • lucas_z 07-31 14:45
    6

    之前是预览版本,现在是后训练的正式版本。



    1. 优化了编码能力

    2. 支持Responses接口,可以直接接入Codex

    3. coding agent测试 超过了v4-pro和glm5.2

  • Autsun 07-31 14:47
    7

    这个区别还是很大的,就像GLM5.2,5.1和5,基座也都是5吧,模型规模都是一样的,但是经过后训练和改进,能力增强一大截,cursor那个composer2.5也是基座kimik2.5后训练,后训练对模型的增强还是很明显的

  • 阿钖 楼主 07-31 14:50
    8

    后训练还是需要大量的数据啊。越到后面高质量人类数据也就越少。也不知道以后会不会后训练越来越难

  • yeyucca 07-31 14:51
    9

    gemini flash本来就没在桌上,把glm 5.2干了属实没想到,毕竟参数量三分之一,权重仅十分之一

  • Shawn_Aaron 07-31 14:55
    10

    不过今天这个前脚glm刚雷霆大涨价,后脚梁圣一发狙击也是没想到

  • 阿钖 楼主 07-31 15:02
    11

    flash 本来就是和 flash 级别的模型对弈的嘛。能吊打也是大胜利

  • 阳光实在美好就算美好的一天吗 07-31 15:03
    12

    v4-flash超了v4-pro和glm5.2吗?这么嗨 ^-^

  • lvxiaobu 07-31 15:05
    13

    消费级显卡部署deepseek?谁说的?上个版本就1.6T了,新版版0.016T?

  • 林夕 07-31 15:09
    14

    虽然但是,即使是v4 flash,那也和个人玩家在消费级显卡上部署没有任何关系啊

  • jcjrobert 07-31 15:11
    15

    自部署门槛要到什么样的显卡啊?小参数模型会有很好的效果么? ^-^

  • 林夕 07-31 15:12
    16

    (帖子已被作者删除)

  • 阿钖 楼主 07-31 15:17
    17

    v4flash 也就 R1 的三分之一大小,之前 R1 都掀起一股自部署热潮,现在 flash 不是洒洒水啦

  • daowong 07-31 15:22
    18

    不知道正式版放不放仓库 是不是要先只有 api 让大家爽爽再开源

  • 阿钖 楼主 07-31 15:24
    19

    要相信你梁叔叔。同时也要相信你梁叔叔的 API 价格能干到比自部署成本还低

* 帖子来源Linux.do
返回