今晚上真热闹,两家flash模型都赶今晚上发布了

湍流 2026-08-26 19:39 1




-GLMflash,个人体感是小激活参数MOE模型,代码特化,在训练范围内的定式问题解决能力优秀。简单测试了下糖果题、色盲题,还有自己的一些评测小题目,非代码综合能力方面大概是qwen3.6-27B的水准。虽然泛化逻辑方面较弱,但是前端表现力方面确实令人惊艳,拭目以待


-Qwen3.8-Flash-Next,新的架构(官宣是qwen4下一代尝鲜版本),125B模型主体+51BN-gram嵌入表,总计176B,每token激活6B。希望不要重演上一代Qwen3-coder-next惨剧()

最新回复 (11)
  • sparklydream 08-26 19:42
    1

    coder-next 的参考价值不如 qwen3-next-80B-A3B 大,qwen 现在已经没有 coder 命名的模型了。

  • lisi 08-26 19:44
    2

    qwen感觉不咋地没啥水花好像,有没有佬实际用过的

  • 炫彩小鱼干 08-26 19:45
    3

    还没发布呢,别急,qwen 3.8 2.7b 可是杀疯了

  • Haggi 08-26 19:45
    4

    GLMflash的前端好?没啥感觉哎

  • woouel 08-26 19:45
    5

    信息汇总:

    开源模型
    参数量小(可以运行于 DGX Spark)
    3.不是 GLM,不是 Gemini

    [IMG_0453]
    [IMG_0454]
    [Picsew_20260821191541]

    注意,请自行甄辨真伪


    这个帖子里的截图,他怎么又说你们全都错了,给我的感觉就是说话很不靠谱

  • 湍流 楼主 08-26 19:50
    6

    用起来表现力确实不错,当然也可能是我gpt用多了导致的 ^-^

  • crazycrazyshui 08-26 19:51
    7

    这个mia是不是^-^,之前他还说不是glm,故弄玄虚的^-^

  • 湍流 楼主 08-26 19:56
    8

    还真是,确实没听讲过新的coder系列的了

  • Yashiro 08-26 19:59
    9

    -GLMflash,个人体感是小激活参数MOE模型,代码特化,在训练范围内的定式问题解决能力优秀。简单测试了下糖果题、色盲题,还有自己的一些评测小题目,非代码综合能力方面大概是qwen3.6-27B的水准。虽然泛化逻辑方面较弱,但是前端表现力方面确实令人惊艳,拭目以待



    佬们预测一下这个模型会怎么收费呢

  • 星辰的光 08-26 20:08
    10

    感觉就算是质谱的模型就是贵,估计算flash还是贵。还是期待一下千问

  • okok996 08-26 20:15
    11

    牛来用了还是挺好用的,后续不知道和 deepseek flash 比价格怎么样

* 帖子来源Linux.do
返回