Qwen3.8 27B自部署效果

mengta 2026-08-20 22:41 1

这几天在网上看了一下测评,好像还不错,基础问题、翻译这些质量都还可以,体感上面回复也比 Gemma4 31B快一点。代码没测,不过日常使用应该没问题,我把它接到了agent里面,干些活还是没问题的。







最新回复 (14)
  • 币安 08-20 22:42
    1

    什么配置

  • mengta 楼主 08-20 22:45
    2

    @币安 #1 3090x2

  • cybort 08-20 22:49
    3

    参数量少快是正常的,可以再试试A3B的模型

  • Fyzzp0o0 08-20 22:51
    4

    你这图咋回事?点一下怎么还自动跳转呢

  • mengta 楼主 08-20 22:53
    5

    @Fyzzp0o0 #4 不到啊 ^-^

  • amashazzz 08-20 23:03
    6

    换A3B起飞,但27B确实稳定,不过你不用来写代码的话可以用A3B感受下(27B写代码应该也拉.不如外接ds4f)

  • mengta 楼主 08-20 23:07
    7

    @amashazzz #6 我还是喜欢稠密模型,moe虽然快,质量还是有待考究的

  • 1952444901 08-20 23:24
    8

    基本能达到干小活的水平,写代码不太行,但单纯搞一些运维的小脚本之类的没问题,接进CODEX可以取代掉mimo之流了

  • 大鸡吧 08-21 09:56
    9

    27B要3090x2,不太划算啊,除非本地不停写代码

    ^-^

  • mengta 楼主 08-21 12:10
    10

    @大鸡吧 #9 48g才是一个甜品显存,上下文能开高点,并发也能开高点

  • 江郎才尽 08-21 12:11
    11

    这个是不是上下文就很小啊 最近看很多人玩这个 显卡价格又被干上去了

  • fanfan142 08-21 12:14
    12

    原生多模态吗 token速度多少

  • mengta 楼主 08-21 12:20
    13

    @江郎才尽 #11 还好吧,48g并发不高的话能开到128k的上下文,不过肯定体验不是很好了

  • mengta 楼主 08-21 12:20
    14

    @fanfan142 #12 原生多模态,token速度没太关注

* 帖子来源NodeSeek
返回