Qwen3.8的模型真的好牛逼啊。挂5090上非常流畅

一颗发财树 2026-08-24 13:56 1

特别是那种特别版的。真的让我很惊呆。。。

干啥都没限制

最新回复 (35)
  • Rayby36 08-24 13:57
    1

    还没部署,改天试试,你5090多少tps

  • Recluse 08-24 13:57
    2

    说说有多特别

  • colinqi 08-24 13:59
    3

    显卡又要涨价了!

    能替换dp flash了?

  • 主打唱跳Rap 08-24 13:59
    4

    我是那种人,请告诉我那种版本有多特别

  • vico 08-24 13:59
    5

    token/s 有多少?

  • MatchaSama 08-24 14:00
    6

    5090D单卡部署有60tps,很快的很优秀。

  • puzz1e 08-24 14:00
    7

    一个人使用够吗?

  • dtfour09 08-24 14:01
    8

    上下文多少,我觉的少了的话不能干活。肯定不是搓代码,生成一些小脚本啥的。

  • sudoerx 08-24 14:02
    9

    cpu跑的话多少分gb5可以😄

  • dtfour09 08-24 14:03
    10

    @sudoerx #9 cpu太慢了,如果上下文到1m的话,我那个38g显存就不够用了。


    好像本体占用20g左右。

  • cfers 08-24 14:04
    11

    你不会拿去生成那种吧 ^-^

  • Cipher 08-24 14:05
    12

    上下文能有多少? token/s呢?

  • icedog 08-24 14:07
    13

    qwen3.8下好了, 请问5090去哪里领

  • johndiamond 08-24 14:10
    14

    有多特别??5060能玩嘛

  • sudoerx 08-24 14:13
    15

    @dtfour09 #10 哦对还有缓存的作用 那还是不幻想cpu跑了

  • xiaoqidun 08-24 14:15
    16

    跑的什么量化?我现在跑的27b q5 q8kv。

  • sd3qs 08-24 14:15
    17

    那天试试

  • nec 08-24 14:21
    18

    我也跑了一个本地的,我发现xhigh动不动就超级长的大思考,经常也会过度思考,但是最后出的结果确实是比medium好的


    还有官方推荐 temperature 1.0,top_p 0.95,我看Reddit上有人推荐用 temperature 0.6,能有效防止发散,我今天试了下,好像确实有效果


    这模型是真nb的,我觉得能本地替代 deepseek flash 的,最主要是没审查,期待社区的各种优化微调版本出来 ^-^

  • dtfour09 08-24 14:23
    19

    @johndiamond #14 5060需要双卡。 建议2080ti 22g x 2 最便宜的还能用官方驱动的方案。 不然你在加一个5060ti 16g,也是很慢的 或者 上下文很短。

  • johndiamond 08-24 14:30
    20

    @dtfour09 #19 那还是不太适合普通大众

  • jahguleth 08-24 14:31
    21

    @cfers #11 发布于2026/8/24 14:04:35

    你不会拿去生成那种吧 ^-^


    那种啥? ^-^

  • yedhi 08-24 14:32
    22

    只有 16g 显存的我眼泪流下来

  • dtfour09 08-24 14:35
    23

    @yedhi #22 16g 可以配合内存跑,大概10来多ts。

  • dtfour09 08-24 14:35
    24

    @johndiamond #20 可以配合内存,虽然慢不少。

  • pan260 08-24 14:37
    25

    @dtfour09 #19 5060ti+4060ti,双16g的,32g跑了25g的Qwen3.8-Q5量化模型,只有30token每秒,还是mtp加速的,不玩了

  • cfers 08-24 14:39
    26

    @jahguleth #21 9kg

  • 只打精锐 08-24 14:40
    27

    这个模型在这个卡下面速度快吗

  • 江郎才尽 08-24 14:45
    28

    羡慕了 我只租了5090云主机部署玩了一会儿 感觉确实很好 这玩意继续开源优化下去 以后本地模型真能爽玩了 个人玩家本地部署最大问题现在就是上下文和速度这两点了

  • jahguleth 08-24 14:45
    29

    @dtfour09 #10 发布于2026/8/24 14:03:51

    @sudoerx #9 cpu太慢了,如果上下文到1m的话,我那个38g显存就不够用了。


    好像本体占用20g左右。


    @cfers #26 发布于2026/8/24 14:39:53

    @jahguleth #21 9kg


    ^-^ ^-^ 这个好啊,什么显卡能跑?

  • 阿古耶 08-24 14:49
    30

    3090可以跑么?

  • sudoerx 08-24 14:49
    31

    @江郎才尽 #28 有什么推荐的地方租🙂

  • qq1254870524 08-24 14:51
    32

    都买不起显卡,现在内存 硬盘太贵了

  • dtfour09 08-24 14:53
    33

    @阿古耶 #30 可以啊。

  • dtfour09 08-24 14:54
    34

    @pan260 #25 因为没有nvlink。 我说5070ti + 2080ti,有nvlink应该会更快,

  • 江郎才尽 08-24 14:59
    35

    @sudoerx #31 https://vast.ai/ 用过这个平台。像淘宝上也有租的

* 帖子来源NodeSeek
返回