DS还没盖棺定论吗

风云 2026-08-16 17:57 1

这几天一直刷到dsh的插件说能提升v4系列模型


这么多天下来有真正的盖棺定论吗


并且我有个疑问就是,既然官方都开源了,没办法从源码里找线索吗?


(不太懂模型开源开的是什么,听说是权重?)

最新回复 (14)
  • 巴巴博一 08-16 17:59
    1

    应该屎废了,貌似只有极简模式在linux下才能恢复到最佳水平

  • 🐟 08-16 18:01
    2


    你的意思是说,注意到,这段文字在此权重中可以提升性能吗

  • 屑派大星 08-16 18:02
    3

    目前看来是这样的,而且使用插件来改善性能也不是百分之百的触发,还不如期待V4.1

  • impouo 08-16 18:06
    4

    这波肯定拉了坨大的了,搞半天还要用户自己拼不是在搞笑呢么。目测pro后训练过拟合了或者什么问题,总之后训练废了。还是期待下4.1或者5吧,反正肯定在弄了。

  • Ahiki 08-16 18:08
    5

    就是抽卡吧,我试了linux下极简模式和标准没啥区别

  • Ahiki 08-16 18:12
    6

    网友这种近乎执念的找补,让我想起黑神话悟空刚出的景象,主播日夜连轴转地搜寻真结局,贴吧Q群各类考据贴层出不穷,试图证明游戏体量远不止眼前所见。

  • zcrdwx 08-16 18:12
    7

    既然官方都开源了,没办法从源码里找线索吗



    如果你能把RL的训练集弄过来就知道线索了

  • zcrdwx 08-16 18:14
    8

    有区别吧,在他官方那套提示词里面,cot长度大概涨了3-4倍,会比标准好点,但是指望到5.6sol还差点

  • Eeevan 08-16 18:36
    9

    其实虽然Pro是区,但是Flash喝到Pro科研的汤了,而且意外的提升不错

  • xiedian 08-16 18:38
    10

    再怎么插件,harness,思维链。也无法改变v4pro练出错了的事实。只能等4.1了吧

  • gogogo 08-16 18:39
    11

    拉了就是拉了,别搞粉圈那一套了。别的模型你这么研究多少也能提升

  • huahai23 08-16 18:48
    12

    dsh说白了就是一个半成品agent,还没做好就端出来。而且agent目前来说,最出名的那几家做得其实都不相上下,差距都不会太大的。


    所以agent实际上的提升,我觉得不会超过10%(我往大了说,实际上更小)。更何况dsh目前的状况根本不乐观。再迭代半年再看看。

  • role_c 08-16 19:01
    13

    差不多定了啊,基本算是炸锅了,期待下一代吧。不过v4p 通过外部手段能勉强收敛发挥一定的能力,也算没炸的彻底。

  • Marion 08-16 19:07
    14

    就是屎,无论屎用插件还是极个别的环境和使用方式可以达到,都证明了没有泛化能力,而大模型没有泛化能力就是屎

* 帖子来源Linux.do
返回