先不要管v4pro了,v4flash的性能还能压榨!

SleepSheep睡着的羊 2026-08-15 15:15 1

最新的结论 (B 站是风禾呢研究 + 发布插件,本人仅总结):Deepseek v4pro 和 flash 内部都有两个形态,一个是 let me 雷霆大思考,一个是 we need/let’s 极简模式(此模式下模型的思考极短,并且差不多按照自己的直觉来写。这也能够解释为什么v4pro在极简模式下表现很不错,因为它的参数量很大,用直觉写也能写个差不多,还更省token)。


正常来说模型会根据问题的难度自行选择思考的模式,但是 Deepseek 在后训练时不小心把中间管理路由问题的部分训炸了,导致模型不知道该往哪一边路由,现在的路由基本纯随机(标准模式下比较随机地路由,PTC下偏向雷霆思考,极简模式就是we/let’s类的思考),并且还会逐渐往一侧偏转 (如到后期所有问题都只路由到极简或只路由到深度思考),UP 发了一个插件,能帮助 flash 正确路由 (up 找到了模型中能正确路由的一个区间),据说能把 dsv4flash 拉到体感接近 GLM5.3(不是说分数能达到 / 超过 GLM5.3,但是有比较大的提升),v4pro 则更难,正常路由的区间比 v4flash 还要小很多,此插件暂时不能提升太多 v4pro 的性能,等今晚可能 up 会发 v4pro 的插件


(群中的一些测试)




具体研究结果请到B站UP是风禾呢的最新动态查看github链接与视频

注入器与套装为dsh-routing-suite,在github上面有(暂时只支持dsh)


注:装上插件后选择Router Standard (experimental)后就可以用了,在编码开始前出现一个5~15分钟的雷霆大思考都是正常的,模型会先规划好后再进行编码

最新回复 (16)
  • 时牧 08-15 15:17
    1

    用opencodego家自部署的4flash也可以吗

    晚些时候试试

  • SleepSheep睡着的羊 楼主 08-15 15:17
    2

    UP说8月17号之前出go的插件,不过也可以上ds自己改一下插件试试

  • 落日羽音 08-15 15:17
    3

    感觉现在都是社区在帮助deepseek完善模型了,难道这也在牢梁的计划中吗 ^-^

  • Doro2077 08-15 15:18
    4

    草,真就重回大调教时代,模型需要调教才能发挥出最强能力

  • 杉茶 08-15 15:19
    5

    依旧创意工坊,这也是牢梁计划的一部分 ^-^

  • admini 08-15 15:19
    6

    v4flash 插件发了吗?聊天记录有点糊,这是调用没看出来如何注入的。

  • SleepSheep睡着的羊 楼主 08-15 15:20
    7

    注入器与套装为 dsh-routing-suite,在 github 上面有



    到github上可以搜到,注入的话让ds自己安装

  • 林语尘 08-15 15:23
    8

    借“模型随即路由”来测试一下 DSH 的插件模式在日后发展潜力如何(bushi)

  • calendar 08-15 15:23
    9

    你的意思是,我一份钱,买到了两个模型?涨价一下子合理了起来

  • Suhuanzhen 08-15 15:33
    10

    创意工坊这个我绷不住了,太形象了

  • 杉茶 08-15 15:35
    11

    牢梁难不成想走G胖的路,让模型从社区中长出来

  • 适才相戏耳 08-15 15:42
    12

    吃百家饭养成大赢鲸!

    这也是计划的一部分 ^-^

  • Karioz 08-15 15:45
    13

    牢唐你就学吧,后训练何必是人工智能,也可以是能工智人 ^-^

  • admini 08-15 15:45
    14

    我看了他的 bilibli ,并看见图文了。还找了一下论证来源。




    极简模式和标准模式不同,论坛有讨论了。

  • 开心带带 08-15 15:53
    15

    我刚试了下生成坦克模型,感觉flash在router的加持下效果优于pro+思维链优化,但是pro的逻辑性更好一点。

  • SleepSheep睡着的羊 楼主 08-15 15:53
    16

    话说我把标题改为如何治疗V4系列模型的人格分裂会有更多佬友看吗 ^-^

* 帖子来源Linux.do
返回