基于下一代 Qwen4 架构所构建的多模态 MoE 模型,阿里千问预告明晚23:00开源 Qwen3.8-Flash-Next

拾雨 2026-08-25 23:08 1

IT之家 8 月 25 日消息,魔搭社区(ModelScope)显示,阿里千问 Qwen3.8-Flash-Next 模型将于北京时间 08 月 26 日 23:00 开源。



页面显示,阿里千问将发布 Qwen3.8-Flash-Next 和 Qwen3.8-Flash-Next-FP8 两个版本模型。


据介绍,Qwen3.8-Flash-Next 是基于下一代 Qwen4 架构所构建的多模态 MoE 模型。官方称提前发布这些架构上的改进,以便社区能为即将推出的完整 Qwen4 模型家族做好准备。



官方暂未公布更多信息,IT之家附链接:




来源:基于下一代 Qwen4 架构所构建的多模态 MoE 模型,阿里千问预告明晚开源 Qwen3.8-Flash-Next - IT之家

最新回复 (9)
  • dddwill8 08-25 23:18
    1

    跑分模型,实际使用一坨狗屎,你用我推荐,给我我不用

  • calendar 08-25 23:20
    2

    不是哥们,虽然千问可能确实有问题,但是也不至于这样吧 ^-^ 这还没发布呢

  • 小强 08-25 23:21
    3

    千问这次3.8 27B挺争气的。 看看MOE这边降低硬件要求怎么样。

    之前用过他们家35 A3B本地跑书籍翻译蛮好用的。

  • deepcake 08-25 23:22
    4

    上一代的Next完全是无人在意,使用率还不如扩散模型。

  • fenglin 08-25 23:33
    5

    不太认同佬这个说法,qwen3-coder-next 感觉又快效果又好,在流行做转盘的时期,我试验每次它的效果是最稳的。从下载看不比3.5低吧。

  • dddwill8 08-25 23:37
    6

    qwen小模型没毛病,大模型真的不行,比sol都喜欢过度思考,净整些没用的,你试试看就知道了

  • GT01002 08-25 23:43
    7

    用了3.8 27b,指令遵循很好,比3.5好非常非常多,除了思考超级多但是已经可以用了

  • deepcake 08-25 23:47
    8

    那有点赤石科技了,实际下载量也没Qwen3.5高。


    80B参数分数能跟Qwen3.5 9B、4B能坐一桌去也是人才,也就只能欺负2B小模型了。


  • fenglin 08-26 00:16
    9

    毕竟是80b的模型,对于内存大小还是有点要求的,比3.5 的120b下载高也说明下载量并不像你之前说的无人在意。另外这个是模型名字都带coder,是针对编码做了特调的。并且只有3b的激活参数,这种非编码类的分数和9b,4b差不多也合理吧。但是编码能力和27b我个人体验可以相比的,并且速度快了很多。

* 帖子来源Linux.do
返回