有没有玩DGX本地部署的佬聊聊天都用什么模型

haodee 2026-08-26 14:55 1

ornith1.5 35B-A3B 和Qwen 3.8 27B 哪个当主力模型,还是说上两台直接部署D4flash,我单机也跟部署了D4flash不过只有7-8token/s 难搞 ^-^

最新回复 (10)
  • 🍊C☕️ 08-26 14:58
    1

    DGX 内存带宽比较低吧,算力强,但是内存带宽好笑不如mac studio

  • haodee 楼主 08-26 15:01
    2

    主打一个双机起买,单机流口水 ^-^ 好像玩这个都是玩集群的mac太贵了256统一内存能买差不多3台dgx

  • 🍊C☕️ 08-26 15:23
    3

    我也好奇,为啥老黄给他配一个256bit的,怎么也配个512bit,内存带宽到1T,更适合。 只能说刀法精湛。

  • 匿名者 08-26 15:39
    4

    35B-A3B



    流畅只有这个,能有50-60左右,其他的就别想了。

  • haodee 楼主 08-26 16:17
    5

    ornith1.5 35B-A3B 好像没有Qwen3.8厉害 不过今晚要出3.9,3.9是moe模型

  • 匿名者 08-26 16:33
    6

    小模型里面,Qwen是天,其他小模型摸不到的天。能与闭源Opus-4.6 MAX打的有来有回的小模型。

  • 席乐 08-26 16:46
    7

    ds flash 到处都是免费用,搞minimax h3 呀

  • haodee 楼主 08-26 17:23
    8

    那就等今晚Qwen出来看看效果了估计明天就有大佬发跑分了

  • haodee 楼主 08-26 17:24
    9

    没研究视频都是乱琢磨乱玩一通哈哈哈

  • 匿名者 08-26 17:53
    10

    哪裏來的消息?假的吧?最近也沒有聽説啊。

* 帖子来源Linux.do
返回