Qwen3.8-Flash:全新架构,更强更稳更划算

Rhysliu 2026-08-27 08:37 1

Qwen3.8-Flash,这是一个多模态 MoE 模型,主模型参数量为125B,额外配备 51B 的 N-gram Embedding,每 token 激活 6B 参数。 它原生支持 262,144 token 上下文,并可通过 YaRN 扩展至 1M token。

昨天是怎么了,先是glm-5.3-flah ,晚上又看到这个! 国模起飞~

最新回复 (5)
  • 小叮当 08-27 08:59
    1

    Qwen3.8-Flash好用吗?现在国产大模型我体验下来glm和k3挺好用的,Qwen比较少见到

  • fengchris 08-27 09:04
    2

    他这个定价就输给glm-5.3-flash了 参数量大性能还强

    qwen需要好好考虑下定价跟plan给的用量了

  • 学懵了 08-27 09:04
    3

    Qwen感觉现在的主要方向就是小模型,小模型领域应该没有比Qwen更好用的了

  • KingArthur 08-27 09:05
    4

    发布即落后,qwen一下子被glm一脚干翻

  • agi_is_coming 08-27 09:24
    5

    参数量都不一样 差了100多b呢


    而且他这玩意算是试验性质的 是为了qwen4的架构做准备

* 帖子来源Linux.do
返回